Qwen3.6 - воно ж наче на 27/35 мільярдів. На якому лептопі ви це запускаєте?)dext: ↑ 21.07.2026 14:40 Qwen3.6 - coding/agentic coding, не топ, але для рефакторингу/юніт-тестів/документації більше ніж достатньо, шукає баги вже краще статичних аналізаторів, краще мати harness
серед інших:
Новини
Останні статті і огляди
Microsoft розглядає можливість використання китайського ШІ Kimi K3 для Copilot
-
freezers
Junior
-
dext
Member
- Звідки: Dnipro
Звичайно що не на бомж-нео з 8ГБ RAM, маркетинг проти фізики тут не працюєfreezers: ↑ 22.07.2026 14:40 Qwen3.6 - воно ж наче на 27/35 мільярдів. На якому лептопі ви це запускаєте?)
З квантуванням Q4_K_M це в районі ~20ГБ на модель Qwen3.6-35B-A3B і всього 3 млрд. активних, тому навіть на інтегрованій GPU прийнятна швидкість, так само Gemma-4-26B-A4B-it-qat
-
DDt
Member
- Звідки: Луганск -> Северодонецк -> Харьков -> Киев
dext
есть мнение что даже Q4, а всё что ниже и подавно, туповата на фоне Q8
ну и там ещё особенности модели могут накладываться, например у меня Gemma-4-12B-it-qat зацикливалась после использования тулзов, а Qwen3.5-9B Q8 - нет
есть мнение что даже Q4, а всё что ниже и подавно, туповата на фоне Q8
ну и там ещё особенности модели могут накладываться, например у меня Gemma-4-12B-it-qat зацикливалась после использования тулзов, а Qwen3.5-9B Q8 - нет
-
ArmagedoonZergs
Member
Які це "свої"? У них нема і не було ніяких своїх моделей. Тільки моделі OpenAI.Alexx-wisa: ↑ 21.07.2026 11:37 Понабирають індусів в Майкрософт а ті потім китайців беруть на підряд, замість того щоб свій ШІ допиляти нормально.
Те що це скинули в "паблік" це причина вичавити з Альтмана знижечку.
Взагалі позиція Майків у всій цій історії виглядає як найгеніальніше рішення. Цодів вони набудували, на їх оренді зараз заробляють космічні гроші.
А моделі так чи інакше - будуть відкриті.
Відправлено через 2 хвилини 6 секунд:
With all respect.dext: ↑ 21.07.2026 14:40Qwen3.6 - coding/agentic coding, не топ, але для рефакторингу/юніт-тестів/документації більше ніж достатньо, шукає баги вже краще статичних аналізаторів, краще мати harnessfreezers: ↑ 21.07.2026 14:26 Я не дуже в курсі щодо менших моделей. Чи є якийсь юзкейс використання де такі локальні моделі можуть бути дійсно корисні? Не просто щось нагенерувати посередньої якості, а реально вирішувати якийсь клас задач нормально?
серед інших:
Gemma4 - загально призначення, доволі якісний OCR, перекладач на 140 мов
Nemotron - one-shot алгоритми та олімпіадні задачки
Але що це за проект такий де треба тільки локально все крутити? Якщо такі безпекові вимоги - чому не куплять залізо на нормальні вимоги?
Чим не влаштовує юридичні обіцянки Майкрсофта з їх AI Foundry?
Відправлено через 1 хвилину 20 секунд:
Ти трішки не в темі.dext: ↑ 21.07.2026 14:04Є моделі з меншою кількістю, в т.ч. для ноутів, в яких perf/на кількість параметрів кращий за майже все наявне на ринку
Завтра "Антрофік" закриє доступ або тихесенько перемкне користувачів певного регіону на більш тупий варіант (що практикують майже всі хмарні провайдери) - і що ви будете робити? Це питання передбачуваності/автономності/безпекиnick_ii: ↑ 21.07.2026 13:34 Ого он воно як. А деви то і не знають... То мабуть ретрогради обирають Антрофік, бо проспали декілька років.
"Корпоративний" доступ до закритих моделей і "публічний" через підписочки по типу Claude MAX - це два різних світи.