dead_rat: ↑
23.07.2026 15:36
В мене в розпорядженні ~350 програмістів(разом з ЕМ/ПМ), всі пишуть код Клодом чи Курсором, на кожного 1000$ підписки. Більше вже не буде.
Що буде реально - ми переіздимо чи на дешевші моделі чи на локальний хостинг, бо з 350к$ на місяць бюджетом лише мого департамента можно швидко обмазатися GPU навіть по цінам від Хуанга, а локальні можелі вже ок під кодинг
Поддержу. Работаю на Австралию. Так там прикол еще в том, что нужно чтобы сервара для ИИ находились на ее территории. Ну или локальные ИИшки. Думаю в ЕС если не есть, то скоро будет такое же. А по общению с менеджментом понятно, что в итоге прийдем к следующему - локальные модель, собственные сервера для бизнеса и возможно облачные сервера с отдельной покупкой моделей(как сейчас за хостинг).
Сижу на локалке, в целом с последними моделями нормально. Квен 3.6 МоЕ(8бит, динамическая квантизация) показывает себя адекватно и с ним можно работать, хоть и ботлнек в промпт процессинге на консумерских машинках(те что с 128гб). Кстати это у всех, в том числе у НеВидиа и Мака - причина пропускная способность памяти. Лучшие пока НеВидиа, далее АМД и замыкает Эпл. Генерация крутиться в районе 50т/с на том же квене.
По теме. Рад за АМД. Может еще быстрее начнут пилить свой ROCM.