Microsoft розглядає можливість використання китайського ШІ Kimi K3 для Copilot

Обсуждение статей и новостей сайта
Автор
Повідомлення
freezers
Junior

Повідомлення

dext: 21.07.2026 14:40 Qwen3.6 - coding/agentic coding, не топ, але для рефакторингу/юніт-тестів/документації більше ніж достатньо, шукає баги вже краще статичних аналізаторів, краще мати harness
серед інших:
Qwen3.6 - воно ж наче на 27/35 мільярдів. На якому лептопі ви це запускаєте?)
dext
Member
Звідки: Dnipro

Повідомлення

freezers: 22.07.2026 14:40 Qwen3.6 - воно ж наче на 27/35 мільярдів. На якому лептопі ви це запускаєте?)
Звичайно що не на бомж-нео з 8ГБ RAM, маркетинг проти фізики тут не працює :rotate:
З квантуванням Q4_K_M це в районі ~20ГБ на модель Qwen3.6-35B-A3B і всього 3 млрд. активних, тому навіть на інтегрованій GPU прийнятна швидкість, так само Gemma-4-26B-A4B-it-qat
DDt
Member
Звідки: Луганск -> Северодонецк -> Харьков -> Киев

Повідомлення

dext
есть мнение что даже Q4, а всё что ниже и подавно, туповата на фоне Q8
ну и там ещё особенности модели могут накладываться, например у меня Gemma-4-12B-it-qat зацикливалась после использования тулзов, а Qwen3.5-9B Q8 - нет
ArmagedoonZergs
Member

Повідомлення

Alexx-wisa: 21.07.2026 11:37 Понабирають індусів в Майкрософт а ті потім китайців беруть на підряд, замість того щоб свій ШІ допиляти нормально.
Які це "свої"? У них нема і не було ніяких своїх моделей. Тільки моделі OpenAI.
Те що це скинули в "паблік" це причина вичавити з Альтмана знижечку.

Взагалі позиція Майків у всій цій історії виглядає як найгеніальніше рішення. Цодів вони набудували, на їх оренді зараз заробляють космічні гроші.
А моделі так чи інакше - будуть відкриті.

Відправлено через 2 хвилини 6 секунд:
dext: 21.07.2026 14:40
freezers: 21.07.2026 14:26 Я не дуже в курсі щодо менших моделей. Чи є якийсь юзкейс використання де такі локальні моделі можуть бути дійсно корисні? Не просто щось нагенерувати посередньої якості, а реально вирішувати якийсь клас задач нормально?
Qwen3.6 - coding/agentic coding, не топ, але для рефакторингу/юніт-тестів/документації більше ніж достатньо, шукає баги вже краще статичних аналізаторів, краще мати harness
серед інших:
Gemma4 - загально призначення, доволі якісний OCR, перекладач на 140 мов
Nemotron - one-shot алгоритми та олімпіадні задачки
With all respect.
Але що це за проект такий де треба тільки локально все крутити? Якщо такі безпекові вимоги - чому не куплять залізо на нормальні вимоги?
Чим не влаштовує юридичні обіцянки Майкрсофта з їх AI Foundry?

Відправлено через 1 хвилину 20 секунд:
dext: 21.07.2026 14:04
vmsolver: 21.07.2026 13:42

Модель на ~3 триллиона параметров? Локально? :lol:
Є моделі з меншою кількістю, в т.ч. для ноутів, в яких perf/на кількість параметрів кращий за майже все наявне на ринку
nick_ii: 21.07.2026 13:34 Ого он воно як. А деви то і не знають... То мабуть ретрогради обирають Антрофік, бо проспали декілька років.
Завтра "Антрофік" закриє доступ або тихесенько перемкне користувачів певного регіону на більш тупий варіант (що практикують майже всі хмарні провайдери) - і що ви будете робити? Це питання передбачуваності/автономності/безпеки
Ти трішки не в темі.

"Корпоративний" доступ до закритих моделей і "публічний" через підписочки по типу Claude MAX - це два різних світи.
Відповісти