Дженсен Хуанг оголосив про початок ери AGI після запуску GPT‑6 Astra. Навчання ШІ могло коштувати мільярд доларів

Обсуждение статей и новостей сайта
Автор
Повідомлення
lw_007
Member

Повідомлення

FirstTDM: 10.09.2026 09:44
lw_007: 10.09.2026 00:50Що нейронка що людина відповідає і цей процес, наскільки розумію, є детермінованим.
Нет. В том то и дело, что процесс никак НЕ детерминированный. Нейронки галлюцинируют... нейронки ошибаются... это вот и есть реальность.
dead_rat: 10.09.2026 02:00Вся суть ЛЛМ в тому що вона НЕ детермінована.
:up:
dead_rat: 10.09.2026 02:00А маркетологи тому, що це чиста вода.
- Ми досягли АГІ!
- Окей, а що саме ви називаєте АГІ?
Мовчить
Абсолютно верно!

Мы что-то достигли, но что это - не совсем понятно.

Если в любых счетных задачах, даже самых сложных, мы полностью доверяем компьютерам и софту и спокойно полагаемся на результаты работы сложнейших систем с реальными объектами, то при взаимодействии с AI/AGI (по маркетинговым определениям) - необходимо всегда перепроверять результаты... системы такого рода могут галлюцинировать...
Розберіться що таке детермінізм, спочатку)

Якщо ви не здатні проконтролювати вхідні дані та внутрішні стани, не значить що воно недетерміновано.
Епістемічна стохастичність і детермінованість сумісні

Відправлено через 2 хвилини 51 секунду:
dead_rat: 10.09.2026 02:00
lw_007: 10.09.2026 00:50

Так однозначно і точно це різні речі, щось ви мене заплутали.

Що нейронка що людина відповідає і цей процес, наскільки розумію, є детермінованим.
Вся суть ЛЛМ в тому що вона НЕ детермінована.
Зображення
dead_rat
Member
Аватар користувача
Звідки: Берлін

Повідомлення

lw_007
Внутрі ЛЛМ буквально крутиться рандом по обиранню наступного токена.
Наступні токени сортуються по вирогідності, потім з них рандомно обирають - більш вирогідні обираються частіше, але недетерміновано.

Хоч подивіться відео про LLM Watermarks

З іншого боку, якщо ви філософськи вважаєте функцію х = Number.random() детермінистичною, бо ми детермінистично знаємо що вона поверне рандом, то можемо пофілософствувать
Denvys5
Member
Аватар користувача
Звідки: Kyiv

Повідомлення

dead_rat: 10.09.2026 10:41якщо ви філософськи вважаєте функцію х = Number.random() детермінистичною, бо ми детермінистично знаємо що вона поверне рандом, то можемо пофілософствувать
Бо там детерміністичний рандом залежний від сіда :teacher:
От якби там був справжній квантовий рандом, от тоді вже точно недетерміністична....
FirstTDM
Member
Аватар користувача
Звідки: Киев

Повідомлення

lw_007: 10.09.2026 10:37Якщо ви не здатні проконтролювати вхідні дані та внутрішні стани, не значить що воно недетерміновано.
Епістемічна стохастичність і детермінованість сумісні
Сдаюсь :) Я с гуманитариями не спорю.

Отправлено спустя 42 секунды:
dead_rat: 10.09.2026 10:41З іншого боку, якщо ви філософськи вважаєте функцію х = Number.random() детермінистичною, бо ми детермінистично знаємо що вона поверне рандом, то можемо пофілософствувать
Угу... прекрасный пример :up:
vmsolver
Member
Аватар користувача

Повідомлення

dead_rat
Перестань болтать глупости, степень уверенности в следующем токене часто на столько большая, что никаких вариаций нет совсем, модель легко может повторить 20кб исходник символ в символ с запланированными изменениями. Чем уже сформирован контекст, тем увереннее выход. От модели и от того, как ее обучали это конечно сильно зависит, но говорить о случайном наборе на выходе может только тот, кто не понимает как они работают.
FirstTDM
Member
Аватар користувача
Звідки: Киев

Повідомлення

vmsolver: 10.09.2026 11:41 но говорить о случайном наборе на выходе может только тот, кто не понимает как они работают.
Да дело же не в случайном наборе на выходе - проблема в НЕ детерминированности функции/системы... галлюцинации никто не отменял...
vmsolver: 10.09.2026 11:41Чем уже сформирован контекст, тем увереннее выход.
Всё правильно - выход "уверенный", но никак не 100% предсказуемый

p.s. Детерминированная функция — это функция, которая при абсолютно одинаковых входных аргументах всегда возвращает один и тот же результат

Детерминированная программная система — это система, поведение которой полностью определено её начальным состоянием и входными данными. При одинаковых исходных условиях такая система всегда проходит через один и тот же цикл состояний и выдает абсолютно идентичный результат.
Ostin
Member

Повідомлення

Враховуючи, що кожна наступна ітерація відбувається в ІНШИЙ момент часу, не можна стверджувати, що система недетермінована, адже вхідні дані завжди інші)
Шах і мат, детерміністи :lol:
Це я до того, якщо хтось увірував у святий ШІ чи AGI, то йому вже в принципі пофіг, як воно працює. Адже віра - один із світоглядних стовпів людської цивілізації)
lw_007
Member

Повідомлення

FirstTDM: 10.09.2026 11:48

p.s. Детерминированная функция — это функция, которая при абсолютно одинаковых входных аргументах всегда возвращает один и тот же результат
Ну так LLM математично і є детермінованою функцією.

Тепер лишилось загуглити що таке стохастичність, епістемічна стохастичність, і чому скрізь роблять PRNG замість TRNG.

А, ну і ще, детермінованість ніяк не виключає галюцинацій. Не розумію чому ви апелюєте до того що нейронки галюцинують.

Окремо можете спробувати знайти доведення того що квантові процеси недетерміновані і TRNG формально можливий на цьому рівні)
vmsolver
Member
Аватар користувача

Повідомлення

FirstTDM
Уменьшите температуру и будет детерминировано на столько, на сколько контекст позволяет
Уверенность 98% это не полностью уверенно, но никаких других токенов не будет кроме этого одного (если сэмплинг настроен на 0.95). Перплексия это то, о чём стоит почитать.
lw_007
Member

Повідомлення

Ostin: 10.09.2026 12:11 Враховуючи, що кожна наступна ітерація відбувається в ІНШИЙ момент часу, не можна стверджувати, що система недетермінована, адже вхідні дані завжди інші)
Шах і мат, детерміністи :lol:
Так це шах і мат тим хто стверджує що нейронки недетерміновані. Оскільки вони просто не здатні проконтролювати вхідні дані.

А взагалі, якщо по темі то не знаю чому AGI повинен бути принципово неможливим.

Якщо ЦНС людини це теж агентна система, то ІМХО питання часу, ресурсів і філософії поки щось не з'явиться.

Ну і удачі :laugh: Бо хто зна що воно вийде. Ті ж люди, багато хто і в 40 веде себе як нерозумна дитина.

PS. Почав тут читати "Суспільство розуму" Марвіна Мінського
Востаннє редагувалось 10.09.2026 12:38 користувачем lw_007, всього редагувалось 1 раз.
dead_rat
Member
Аватар користувача
Звідки: Берлін

Повідомлення

vmsolver
Відкриваю дві приватні вклакли Gemini і вставляю те саме запитання:
- Who was 35th president of USA in his one sentence main achievement?

John F. Kennedy was the 35th president of the USA, whose main achievement was successfully navigating the United States through the Cuban Missile Crisis to avoid nuclear conflict.
- Who was 35th president of USA in his one sentence main achievement?

John F. Kennedy successfully handled the Cuban Missile Crisis to avert nuclear war and established the Apollo space program to land a man on the moon.
Це що завгодно, але не детерміністична система. На один і той запит різні відповіді. Дякую, що хоч коректні
А взагалі, якщо по темі то не знаю чому AGI повинен бути принципово неможливим.
У AGI нема визначення, тож впринципі і механічний калькулятор перевершив людину. Вже років триста як.
FirstTDM
Member
Аватар користувача
Звідки: Киев

Повідомлення

lw_007: 10.09.2026 12:16Ну так LLM математично і є детермінованою функцією.
Нет. В строгом математическом смысле никакая LLM никак НЕ есть детерминированной функцией. Это факт.

Жду ссылки на опровержение этого общеизвестного факта.

p.s. Практика неоднократно подтверждает, что при многократно повторяемых идентичных запросах LLМ выдают немного разные ответы - всё это вследствие как аппаратного недетерминизма, так и вероятностного характера поведения системы при генерировании нейронкой последовательности слов в ответах.
vmsolver: 10.09.2026 12:26Уверенность 98% это не полностью уверенно
Ну да... согласен... игра в числа, которые никогда не будут достигать 100%
lw_007
Member

Повідомлення

dead_rat: 10.09.2026 12:34 vmsolver
Відкриваю дві приватні вклакли Gemini і вставляю те саме запитання:
- Who was 35th president of USA in his one sentence main achievement?

John F. Kennedy was the 35th president of the USA, whose main achievement was successfully navigating the United States through the Cuban Missile Crisis to avoid nuclear conflict.
- Who was 35th president of USA in his one sentence main achievement?

John F. Kennedy successfully handled the Cuban Missile Crisis to avert nuclear war and established the Apollo space program to land a man on the moon.
Це що завгодно, але не детерміністична система. На один і той запит різні відповіді.
І яким чином ти контолюєш вхідні дані окрім промпту? яким чином контролюєш те що gemini персоніфікується, і, можливо, ледь не з кожним твоїм цифровим відбитком в сервісах гугл?

Відправлено через 6 хвилин 22 секунди:
FirstTDM: 10.09.2026 12:36
lw_007: 10.09.2026 12:16Ну так LLM математично і є детермінованою функцією.
Нет. В строгом математическом смысле никакая LLM никак НЕ есть детерминированной функцией. Это факт.

Жду ссылки на опровержение этого общеизвестного факта.

p.s. Практика неоднократно подтверждает, что при многократно повторяемых идентичных запросах LLМ выдают немного разные ответы - всё это вследствие как аппаратного недетерминизма, так и вероятностного характера поведения системы при генерировании нейронкой последовательности слов в ответах.





vmsolver: 10.09.2026 12:26Уверенность 98% это не полностью уверенно
Ну да... согласен... игра в числа, которые никогда не будут достигать 100%
Шановний, то ми говоримо про математику, то про апаратні реалзації, то про галюцинації й точність очікуваної видачі?
У яких "негуманітаріїв" прийнято скакати між системами в межах яких ведеться диспут.

В першому повідомленні я скинув кортеж для базового опису. Гугли математику.

Далі:

FirstTDM: 10.09.2026 11:33
Сдаюсь :) Я с гуманитариями не спорю.

FirstTDM
Member
Аватар користувача
Звідки: Киев

Повідомлення

lw_007: 10.09.2026 12:48Шановний, то ми говоримо про математику
Угу... с точки зрения математики - всё очевидно: никакая LLM никак НЕ есть детерминированной функцией. Это факт.
lw_007: 10.09.2026 12:48то про апаратні реалзації, то про галюцинації й точність очікуваної видачі?
Это просто отсылки к реальным воплощениям LLM и эти факты только подтверждают НЕ детерминированность LLM систем
dead_rat
Member
Аватар користувача
Звідки: Берлін

Повідомлення

lw_007
Бо приватні вкладки, нема історії, той самий IP.

Якщо в тебе складності - запусти локальну ллм і спробуй те саме. ЛЛМ stateless, вони отримують всі дані через промпт то експеримент вийде чистим
Dilfin
Member

Повідомлення

Я думаю, що більш менш наближений до справжнього інтелекту створять тільки тоді, коли почнуть масово випускати роботів, які будуть взаємодіяти з навколишнім світом і вчитися, як малі діти, одночасно бачити, слухати, розрізняти емоції, жести, тільки тоді ші навчиться розуміти світ. Тактика скормлювати ШІ великі масиви даних принесла дуже малі результати, це як пояснювати малій людині на словах і фотографіях, що таке праска і як сильно можна об неї попектись, або як пояснювати що таке океан на картинках, до чого я веду, щоб розуміти світ потрібно знати не тільки формули, а і відчувати його, бачити, відчувати тактильно, чути запахи...
Scoffer
Member
Аватар користувача

Повідомлення

LLM не є детермінованою функцією по двом причинам:
1. В неї спеціально вбудовують рандомізатор бо так прикольніше розмовляє
2. В обчисленнях типу floating point a + b ≠ b + a через апаратні обмеження точності. Враховуючи що нейронка обчислюється не в один потік і, відповідно, результати приходять не в однаковому порядку, навіть з геть однаковими вхідними даними через мільярди ітерацій буде відчутно різний результат. Особливо на якихось там FP4.
lw_007
Member

Повідомлення

Scoffer: 10.09.2026 14:22 LLM не є детермінованою функцією по двом причинам:
1. В неї спеціально вбудовують рандомізатор бо так прикольніше розмовляє
2. В обчисленнях типу floating point a + b ≠ b + a через апаратні обмеження точності. Враховуючи що нейронка обчислюється не в один потік і, відповідно, результати приходять не в однаковому порядку, навіть з геть однаковими вхідними даними через мільярди ітерацій буде відчутно різний результат. Особливо на якихось там FP4.
1. Локально я фіксую seed і все у мене детерміновано.
Беру той же seed - результат той же.

2. Особливості реалізації, математики моделі не стосується. Із практичного досвіду - з невеликим вікном контексту поводиться детерміновано :lol:
Востаннє редагувалось 10.09.2026 20:11 користувачем lw_007, всього редагувалось 1 раз.
Scoffer
Member
Аватар користувача

Повідомлення

lw_007: 10.09.2026 20:07математики моделі не стосується
Математика ідеальної моделі не працює в реальномі світі ні зараз, ні потенційно. Нескінчена точність недосяжна. А конкретно LLM мають тенденцію до зменшення точності обчислень. Починали з FP32, дійшли до FP4, а зараз блочні FP2 і навіть 1 розглядаються.
lw_007
Member

Повідомлення

Scoffer: 10.09.2026 20:11
lw_007: 10.09.2026 20:07математики моделі не стосується
Математика ідеальної моделі не працює в реальномі світі ні зараз, ні потенційно. Нескінчена точність недосяжна. А конкретно LLM мають тенденцію до зменшення точності обчислень. Починали з FP32, дійшли до FP4, а зараз блочні FP2 і навіть 1 розглядаються.
Ще один.

То ви пробуєте довести що нейронки недетерміновані тому що вони мають псевдо-випадковий генератор чисел, то тому що воно працює на залізі, яке має скінченну точність обчислень.

Це все не робить нейронки недетермінованими, це значить лише те що ви не Демон Лапласа.
(A→B)≠(B→A)

Що таке детермінізм, і наскільки детерміновані псевдо-випадкові генератори?


Понабиралось "негуманітаріїв", які навіть не можуть сформулювати твердження.

PS. Хоч ти не будеш стверджувати що нейронки недетерміновані тому що галюцинують? :lol:
Відповісти