Дженсен Хуанг вважає, що закон Мура не працює, але NVIDIA продовжить збільшувати продуктивність GPU

Обсуждение статей и новостей сайта
Автор
Сообщение
Scoffer
Member
Аватара пользователя

Сообщение

vmsolver
Ну звісно що це не закон. Ніхто не заарештує тебе якщо не будеш подвоювати транзистори :laugh:
Але це досить важлива тенденція для планування майбутнього розвитку. Якщо раніше ти ці х2 транзисторів отримував практично гарантовано через 2 роки, то зараз через 3, а то може і 4. Плюс дорожче, і не без приросту жору, чого раніше не спостерігалось. Я не знаю коли саме прийде ця фінально точка, що "вже все", через рік, два, чи десять, але вона вже точно на горизонті. Розвиток в сторону калориферів теж не нескінчений.

Відправлено через 7 хвилин 38 секунд:
Кінцевих пристроїв це також стосується, в молодості хуанг випускав відяхи з 9 місячним циклом, чи щось типу того, а зараз 3 роки.
vmsolver
Member
Аватара пользователя

Сообщение

Scoffer: 23.05.2025 15:51Ну звісно що це не закон. Ніхто не заарештує тебе якщо не будеш подвоювати транзистори :laugh:
Там же не про те законы ))
Да какие там тенденции, звонят в TSMC спрашивают сроки внедрения нового техпроцесса и его характеристики, получают библиотеки и можно оценивать площадь тех или иных своих блоков, портов ввода/вывода, потребление чипа и так далее. И вот, ты знаешь тенденции и можешь обосновано (читай с контроллируемыми рисками) выбирать конфигурацию железа своей новой линейки или чего там у тебя, закон Мура тут до лампочки :gigi:

Сказали что техпроцесс с более лучшими характеристиками будет через 3 года, вот сидишь и думаешь как эти три года продавать свою продукцию, маркетологи придумают с каким прогрессом надо выводить новые продукты и т.д. Чтобы к новому техпроцессу исчерпать потенциал старого, а на новом по-прежнему надавать по щам всем конкурентам, а те, в свою очередь, делают тоже самое.
Scoffer: 23.05.2025 15:51в молодості хуанг випускав відяхи з 9 місячним циклом
В молодости трава была зеленее, а GPU сильно проще.
Да и чаще не значит лучше.
Scoffer
Member
Аватара пользователя

Сообщение

vmsolver: 23.05.2025 16:10GPU сильно проще
Я б посперечався. DirectX 7-11 відяхи апаратно доволі складні через складні алгоритми. Саме дірект7 добив всі альтернативи нвідії і аті. А апаратні DX12 з подальшою програмною емуляцією за необхідності менших діректів роблять всі кому не лінь, навіть китайці. Уніфікована шейдерна архітектура за великим рахунком маслає картинку брутфорсом.
vmsolver: 23.05.2025 16:10Да и чаще не значит лучше.
Покупцю так точно не краще що відяха протухла менше ніж за рік :D Але чисто по інтенсивності впровадження нових техпроцесів все стало відчутно повільніше.
Inqizitor2022
Member
Откуда: Харьков

Сообщение

Была бы третья контора, которая сказала бы типа - вот вам аналог 5090 за 400 баксов - сразу бы и закон Мура заработал и технологии нашлись бы и цены были бы низкие. А когда на рынке олигополия и сговор Куртки и племяшки - понятно, что не будет никакого праздника в ближайшее время.

Отправлено спустя 3 минуты 16 секунд:
Scoffer: 23.05.2025 17:37Покупцю так точно не краще що відяха протухла менше ніж за рік :D Але чисто по інтенсивності впровадження нових техпроцесів все стало відчутно повільніше.
Во-первых, за 2 года, во-вторых, тогда таких неадекватных цен не было, Жираф 3 стоил 300 баксов, например. Жираф 3 ти 500 стоил 349 баксов, Жифорс 3 ти 200 стоил ниже 200 баксов.
Scoffer
Member
Аватара пользователя

Сообщение

Inqizitor2022
жефорс 256 жовтень 1999
жефорс 2 червень 2000
жефорс 3 лютий 2001
жефорс 4 лютий 2002
жефорс фх січень 2003
+ в рамках одного жефорса стабільно 2-3 техпроцеси на рефрешах

Відправлено через 4 хвилини 57 секунд:
Наприклад на нвідієвських фуфіксах було 130, 140, 150 TSMC і 130 IBM :horror:
vmsolver
Member
Аватара пользователя

Сообщение

Scoffer: 23.05.2025 17:37
vmsolver: 23.05.2025 16:10GPU сильно проще
Я б посперечався. DirectX 7-11 відяхи апаратно доволі складні через складні алгоритми. Саме дірект7 добив всі альтернативи нвідії і аті. А апаратні DX12 з подальшою програмною емуляцією за необхідності менших діректів роблять всі кому не лінь, навіть китайці. Уніфікована шейдерна архітектура за великим рахунком маслає картинку брутфорсом.
Наоборот, сложность ГПУ резко выросла, посмотри на усреднённое количество транзисторов на одно CUDA ядро разных архитектур, там заметный рост.
DirectX 7 был сложнее чем предыдущие версии. Сейчас более тонкие техпроцессы чем раньше, поэтому то, что ранее было сложно сделать, сейчас валяется в далеком уголке чипа и ни на что не влияет. Поэтому китайцы там что-то делают.
Так и раньше было брутфорсом, только делали это очень примитивной машинкой автоматом, сейчас этот автомат стал универсальным и полностью программируемым.
Scoffer: 23.05.2025 17:37
vmsolver: 23.05.2025 16:10Да и чаще не значит лучше.
Покупцю так точно не краще що відяха протухла менше ніж за рік :D Але чисто по інтенсивності впровадження нових техпроцесів все стало відчутно повільніше.
Ну да, кому же хочется взять дорогую видеокарту и через месяц узнать, что вышла новая, на 60% быстрее, с меньшим потреблением и с кучей новых фич ))

Следующее поколение должно быть сильно интереснее, потому как ожидается переход на новый техпроцесс, это почти всегда интересно и вызывает рост характеристик и энергоэффективности. А какой рост на старом техпроцессе мы можем видеть на примере Blackwell-а.
AssayMAS
Member
Откуда: ][аркiв

Сообщение

Scoffer: 23.05.2025 15:51Я не знаю коли саме прийде ця фінально точка, що "вже все", через рік, два, чи десять, але вона вже точно на горизонті.
каменный век закончился потому что закончились камни...
за сто лет были ЭВМ на механике, лампах, реле, транзисторах, микросхемах логики, микропроцессорах...
и никто не мешает с высоким скоростями интернета и низким пингом вернуться к терминалам - ведь у игровых сервисов одна проблема пинг - и как следствие инпутлаг.
И будет Хуан торговать видеокартами "по подписке" - как инет карточками на dial-up в 90-е...
vmsolver: 23.05.2025 18:01кому же хочется взять дорогую видеокарту и через месяц узнать, что вышла новая, на 60% быстрее
ну не через месяц, а через пол года и в ДВА раза дороже... четко просчитывают маркетолоХи - как увеличить надои с "корпораций союзников", а они уже с податного населения... но опять есть рынок б.у. с которым будут бороться - налогами, запрограммированным устареванием (повышенным вольтажом питания), введут серийники, привязку карт к учеткам от игр в инете... .
Нет того преступления на которое не пойдёт капиталист за ради 300% прибыли...

Відправлено через 5 хвилин 9 секунд:
vmsolver: 23.05.2025 18:01сейчас этот автомат стал универсальным и полностью программируемым
только рынок труда в США с вами не согласен - просто программист до 0,1млн в год, куда программист 0,1-0,25млн, программист что умеет в АМД я видел до 0,35млн в год...
так что до универсальности далеко ВСЕМ. Ибо цель всех капиталистов не свершения во славу рода людского, а заработок денег.
daesz
Member
Аватара пользователя

Сообщение

Дженсен Хуанг вважає, що закон Мура не працює, але NVIDIA продовжить збільшувати продуктивність GPU
Дженсен Хуанг вважає, що закон Мура не працює, але NVIDIA почне збільшувати продуктивність GPU.
Пофіксив.
Inqizitor2022
Member
Откуда: Харьков

Сообщение

Scoffer: 23.05.2025 18:01 Inqizitor2022
жефорс 256 жовтень 1999
жефорс 2 червень 2000
жефорс 3 лютий 2001
жефорс 4 лютий 2002
жефорс фх січень 2003
+ в рамках одного жефорса стабільно 2-3 техпроцеси на рефрешах

Відправлено через 4 хвилини 57 секунд:
Наприклад на нвідієвських фуфіксах було 130, 140, 150 TSMC і 130 IBM :horror:
Таки да, я с Вуды 2 перешёл на Geforce 2 Mx 400, а потом Жираф 3 ti500 290/270 по чипу и памяти, может поэтому не заметил, что оно каждый год менялось. Жираф 3 потрясал своей мощью, это было одно из самых сильных впечатлений. Потом 9800 про от АТИ поставил, тоже бомба. :super:
ronemun
Advanced Member

Сообщение

Ні, не всім тре soic, а от cowos тре дуже багатьом
cowos - це зєднання чіпів в ширину, аж до 3000 мм2 (далі обіцяють 8000)

щодо закону Мура то він вже давно міг перейти з одного кристалу на групи і на той час Гордон Мур напевно це і враховував.
Дивує чому це раніше не впровадили - це прості дроти на простій частоті 2-5 ГГц.
Зараз навіть найгірші зєднання між чіплетами дають 1 ГБайт/с на контакт, > 1000 ГБ/с на 1 мм краю кристалу, а кращі інтерфейси ще в 3-5 раз швидші. Для прикладу, шина FSB@400 в Core 2 в теорії мала 26 ГБ/с, хватило б 32 контакти, а чіп 8 біт ddr3@2ГГц - 2 ГБ/с. По суті, взагалі не потрібні були б північні мости з величезними площами під інтерфеси ddr/qdr чи SerDes FSB/QPI/HT, скаженими затримками, а енергії на передачу даних тратили б в 10ки раз меньше.
Як приклад, 3д кеш в Ryzen приєднаний через 9 тисяч TSV зєднань загальною площею 1 мм2 і забезпечує 2,8 Терабайт/с, в 1.6 швидше інтерфейсу 512біт gddr7 в жефорсе 5090, який на відеокристалі займає 150 мм2, 20% площі, і споживає як слон. Аналогічна економія була б в чіпах памяті + зник би їх нагрів.
Для зєднання 2х чіпів хватало притиснути їх поближче і зєднати зверху через продовгастий тонкий кремнієвий чи полімерний міст з потрібною шириною шини. А велику кількість однакових чіпів, наприклад DRAM/кеш - ставити їх перпендикуляно, торцем, прямо на основний чіп. Було б як в 3д кеші - пряме зєднання 256 біт займає 0,5 мм, тут хватило б і 8 раз меньше.
daesz
Member
Аватара пользователя

Сообщение

ronemun
я не дуже сильний в кристалах, але чи є якась фізична перешкода, яка заважає просто збільшити його площу? Якщо в умовній 5090 площа 744mm2, що заважає зробити чіп площею, скажімо, 1000mm2 на тому ж тех процесі? Вийде більше куда ядер за рахунок "брут форсу" (ну тобто просто більшій кількості ядер) з тим же тех процесом.
Timedemo
Member
Откуда: Ненька Украина

Сообщение

daesz: 24.05.2025 05:29 ronemun
я не дуже сильний в кристалах, але чи є якась фізична перешкода, яка заважає просто збільшити його площу? Якщо в умовній 5090 площа 744mm2, що заважає зробити чіп площею, скажімо, 1000mm2 на тому ж тех процесі? Вийде більше куда ядер за рахунок "брут форсу" (ну тобто просто більшій кількості ядер) з тим же тех процесом.
збільшення споживання на 30 відсоктів.
waryag
Member
Аватара пользователя
Откуда: Суми

Сообщение

Phos4: 23.05.2025 09:25Питання не в тому чи можуть нвідія і амд робити швидші карти, ми вже бачили і чіпи з 2 кристалами наприклад і впевнений є й інакші подібні напрямки розвитку, питання тільки в тому наскільки вони хочуть це робити, стагнація ринку в умовах відносної монополії це те до чого прагнуть всі ці виробники
Щоб люди по 10 років сиділи на одній карті? Зростання продуктивності повинно бути достатнім, щоб робити вигідним апгрейд хоча би раз в два покоління.

Відправлено через 16 хвилин 19 секунд:
daesz: 24.05.2025 05:29я не дуже сильний в кристалах, але чи є якась фізична перешкода, яка заважає просто збільшити його площу? Якщо в умовній 5090 площа 744mm2, що заважає зробити чіп площею, скажімо, 1000mm2 на тому ж тех процесі? Вийде більше куда ядер за рахунок "брут форсу" (ну тобто просто більшій кількості ядер) з тим же тех процесом.
1) Відеокарти масштабуються краще за процесори, але далеко не ідеально. 5090 вдвічі жирніше за 5080 по кількісним показникам, але по продуктивності краще лише відсотків на 50.
Така ж ситуація і у АМД, де половинка 9070хт відстає далеко не вдвічі.
2) Є обмеження площі, що обробляє фотосканер за один прохід, зараз це десь 850мм кв (і серверні чипи нвідіа близькі до нього).

Відправлено через 16 хвилин 5 секунд:
Scoffer: 23.05.2025 15:51 Кінцевих пристроїв це також стосується, в молодості хуанг випускав відяхи з 9 місячним циклом, чи щось типу того, а зараз 3 роки.
Хіба що з урахуванням рефрешів.
3 покоління тесли, 2 - фермі, потім 3(з ноутами) кеплера.

Так і зараз за рефреш можна рахувати ті/супер версії :lol:
Scoffer
Member
Аватара пользователя

Сообщение

waryag
Раніше рефреші випускались на новому техпроцесі, так що не зовсім те ж саме.
waryag
Member
Аватара пользователя
Откуда: Суми

Сообщение

Scoffer: 24.05.2025 13:19 Раніше рефреші випускались на новому техпроцесі, так що не зовсім те ж саме.

З трьох моїх прикладів два - на тому ж т/п. :D

І краще цитуй нормально, інакше не приходить сповіщення.
Phos4
Member
Аватара пользователя
Откуда: Луцьк

Сообщение

waryag
Щоб люди по 10 років сиділи на одній карті? Зростання продуктивності повинно бути достатнім, щоб робити вигідним апгрейд хоча би раз в два покоління.
Людей мотивує купувати нові карти не зростання продуктивності нових поколінь, а зростання системних вимог ігр, і з цим якраз проблем немає. Просто тепер на бюджетних картах недостатність приросту сирої потужності компенсується за рахунок апскейлерів які постійно покращуються і нові версії апскейла недоступні на старих поколіннях. Gtx960 була картою на рівні 780, 1060 на рівні 980, те що 5060 не може догнати 3070 по продуктивності наглядно показує який прогресс ми маємо зараз.
спойлер
епл он вже скільки років нічого кардинально не міняє в своїх телефонах і нічого, люди знаходять причини купувати, при цьому не треба тратити купу грошей на якісь дослідження, всі техпроцеси налагоджені,мінімально зусиль максимально профіту, рай.
q1nex
Member
Откуда: Харьков

Сообщение

waryag: 24.05.2025 10:58 1) Відеокарти масштабуються краще за процесори, але далеко не ідеально. 5090 вдвічі жирніше за 5080 по кількісним показникам, але по продуктивності краще лише відсотків на 50.
Така ж ситуація і у АМД, де половинка 9070хт відстає далеко не вдвічі.
Но при этом если сравнить 5090 с 4090, то производительность 5090 выше, чем у 4090, ровно на столько, на сколько больше ядер она имеет (на 33%). Т.е. в данном случае масштабирование - идеальное. Как и в случае со всеми остальными картами 50й и 40й линейки - можно взять 2 любые карты, посчитать разницу в количестве ядер и их частоте, сравнить с разницей производительности карт по данным techpowerup, и цифры будут идентичные. Только 4090 и 5090 выбиваются из картины и выдают совсем не ту производительность, которую должны. Кажется мне, что у этих карт слабое место - кеш. Та же 4090 имеет всего-лишь +12.5% по кешу относительно 4080, в то время как по ядрам +68%. У 5090 относительно 5080 та же история. Напрашивается логичный вопрос: зачем так душить мощнейший чип недостаточным размером кеша? Я думаю, что причина в том, что кристаллы 4090 и 5090 - это обрезки от проф-карт, а им, видимо, больше кеша не нужно. А Хуангу не нужно выкатывать еще более производительную карту, чем 4090/5090 - они и так вне конкуренции. Поэтому имеем что имеем. Если в 60й линейке будут чиплеты, то вангую, что флагман будет иметь огромный прирост относительно 5090, т.к. очень просто будет набрать нужный кеш. Только за счёт достаточного размера кеша и нового техпроцесса можем получить +77% производительности. Но Хуанг зажмет давать столько прироста в рамках 1 поколения без увеличения цены, поэтому вангую цену на флагман (будь то 6090 или 6090 ти) в $2500.
Scoffer
Member
Аватара пользователя

Сообщение

waryag: 24.05.2025 15:03З трьох моїх прикладів два - на тому ж т/п.
Тесла покрила всі техпроцеси з 90нм по 40нм включно, їх там штук 5 було. Фермі 40 і 28. Кеплер лише 28. Ну так 28нм це початок застою. Передостанній массовий планарний техпроцес (і останній для цпу/гпу), після котрого транзистор довелось ставити раком, а маркетологи почали нанометри рахувати зі стелі :D

Відправлено через 3 хвилини 56 секунд:
Оці всі фінфети, круглі затвори і інші чудеса об'ємної літографії задарма не обходяться. Там де планарний техпроцес вимагав 3-5 масок, там фінфету треба 10-20, а круглозатворникам всяким 30-50. Відповідно і ціна. До 28нм вона зменшувалась, а потім навпаки.
ronemun
Advanced Member

Сообщение

daesz: 24.05.2025 05:29 ronemun
я не дуже сильний в кристалах, але чи є якась фізична перешкода, яка заважає просто збільшити його площу? Якщо в умовній 5090 площа 744mm2, що заважає зробити чіп площею, скажімо, 1000mm2 на тому ж тех процесі? Вийде більше куда ядер за рахунок "брут форсу" (ну тобто просто більшій кількості ядер) з тим же тех процесом.
ряд причин тут гарно описані
1. вже згадана вище - розмір поля сканера. Сканер тому що це 26 міліметрова щілина яка рухається на 33 мм.
Цитата зі статті:
Стандартна фотошаблонка (на якій нанесений малюнок маски) має розмір 104 мм на 132 мм. Потім літографічний інструмент експонує крізь фотошаблон, щоб нанести елементи на пластину зі зменшенням у 4 рази. Це поле має розмір 26 мм на 33 мм. Більшість дизайнів не ідеально поєднуються з розміром 26 мм на 33 мм.
2. кількість дефектів. Ріст площі у 2 рази не просто збільшує дефекти у 2 рази. Дефекти непередбачувані, вони не рівнорозподіляються по площі пластини рівномірно, тому більший кристал може повністю піти в брак якщо дефекти на ньому зконцентруються у модулях які не можна відключити.
3. чим більший чіп тим більше їх втрачається на краях пластини - вона ж кругла. В статі є приклад - якщо кристал 800мм2 розбити на 2 по 432 (+8% на кожній половинці для зєднання чіплетів MCM), то з 1 пластини вийде або 30 великих кристалів, або 39.5 пар половинок, хоча в останніх сумарна площа на 8% більша. Ще менші кристали знаачно вигідніші.
Уявіть, всього 30 кристалів з пластини, (30х800=24 тисячі мм2, площа пластини 70 тисяч), а пластина коштує зараз 20+ тисяч $ (в статті 17к за 5 нм у 22 році, відтоді ціни декілька раз піднімались навіть на старі техпроцеси, а нові ще дорожчі), тобто 660 за кристал, і це лише виробництво пластин. А розробка, реклама, прибуток...

майбутнє за чіплетами тому що технологія зєднання настільки прогресує що до 30 року буде 1 мільйон зєднань на 1мм2. Зараз від 10+ тисяч, але в Sony є знаачно меньші отвори і густіші, це дозволяє окремо виробляти світлочутливий сенсор для камер, а логіку для нього на іншому кристалі приєднанти знизу для кожного пікселя
Ще тестують геніальний спосіб на основний кристал в певні місця чіпляти кристали площею 1-2 мм2 зі швидкістю буквально 15 хвилин на цілу пластину, 70 тисяч мм2. Це знаачно спрощує додавання банок кешу L3(1,5 мм2 на 2-3 Мбайт), або навпаки, на дешеву 6-7 нм пластину зверху чіпляти ядра проца, наприклад AMD Zen4c має 1.6 мм2, Intel e-core - 1.1

Відправлено через 21 хвилину 57 секунд:
del
waryag
Member
Аватара пользователя
Откуда: Суми

Сообщение

q1nex: 24.05.2025 20:02Но при этом если сравнить 5090 с 4090, то производительность 5090 выше, чем у 4090, ровно на столько, на сколько больше ядер она имеет (на 33%). Т.е. в данном случае масштабирование - идеальное.
Сравнивать две карты разных (хоть и близких) поколений с разным количеством блоков, памяти(разной!) и ПСП - ну такое.
В пределах одной серии от 5080 до 5090 и близко нет 100% прироста.

Відправлено через 8 хвилин 43 секунди:
q1nex: 24.05.2025 20:02Как и в случае со всеми остальными картами 50й и 40й линейки - можно взять 2 любые карты, посчитать разницу в количестве ядер и их частоте, сравнить с разницей производительности карт по данным techpowerup, и цифры будут идентичные
Это в какой вселенной. Даже между идентичными по чипу версиями 5060ти местами огромная разница, а у вас все четко пределах двух поколений :popcorn:
q1nex: 24.05.2025 20:02Та же 4090 имеет всего-лишь +12.5% по кешу относительно 4080, в то время как по ядрам +68%.
Вы забыли про 50% превосходство в ширине шины. 1,50*1,125=1,69 :lol:

Відправлено через 1 хвилину 8 секунд:
q1nex: 24.05.2025 20:02А Хуангу не нужно выкатывать еще более производительную карту, чем 4090/5090 - они и так вне конкуренции.
Выпрос не в конкуренции. Вы видели цены профкарт на том же чипе?
Ответить