В AMD вважають, що в архітектури ARM немає переваг над x86

Обсуждение статей и новостей сайта
Відповісти
Автор
Повідомлення
tornadox
Member
Аватар користувача
Звідки: мені знати що ти не дивак?

Повідомлення

Vladys77
Як тут вже охрестили, "новий місцевий навіжений", пророкує що скоро кінець Х86, і агітує за АРМ (чи мак - не зрозуміло)
viewtopic.php?p=4027541#p4027541
daesz
Member
Аватар користувача

Повідомлення

Юра, ти де?
item2
Member
Звідки: Київ

Повідомлення

dext: 08.09.2025 14:32 Аціо
Ви краще поясніть, чому AMD досі не може вилізти з 4-wide decode, - зможете? Питання риторичне B-)
Пояснюю.

1. AMD зробила ставку не на "тупе" розширення декодера, а на його обхід.
​Як це працює: Коли процесор вперше бачить складну x86-інструкцію, він її розкодовує на прості внутрішні мікро-операції (µops). Ці мікро-операції зберігаються у спеціальному швидкому кеші (µop cache).
​Результат: Коли цей код виконується знову (наприклад, у циклі), процесор більше не звертається до повільного 4-wide декодера. Він бере вже готові мікро-операції прямо з µop-кешу. А ось ширина вибірки з цього кешу в Zen 4 становила вже 6 мікро-операцій за такт. Якщо тести покажуть, що 6 - вузьке місце, збільшать в наступному поколінні без проблем.

Тобто тільки перше виконання коду повільніше. Після його декодування АМД
проц буде працювати швидше, а головне - енергоефективніше.

2. Зміни у Zen 5. Тепер АМД має вже 8 (2*4) wide декодер на ядро, а вибірка з µop-кешу вже 12 (2*6) інструкцій. І може виконувати вже 8 цілочисельних інструкцій одночасно:

Front end
• Introducing a dual decode pipeline
- Decoder throughput scaled from 4 to 8 (2x4) per cycle (4 per thread, 4 in single thread)
- Op cache throughput expanded from 9 → 12 (2x6) per cycle (6 per thread, 6 for single thread)

Back end

• Dispatch width of integer operations expanded from 6 → 8
mrigi
Member
Аватар користувача

Повідомлення

Боже, така холіварна тема і усього чотири страниці :popcorn:
l-m
Member

Повідомлення

mrigi: 08.09.2025 21:02 Боже, така холіварна тема і усього чотири страниці :popcorn:
Просто, за винятком одного навіженого, який десь пропав, всім в цілому байдуже на ARM :shuffle:
pelia
Member
Аватар користувача

Повідомлення

Юра не прийде, так само як Володя не приходить у треди де інтел сам собі штанці мочить
dext
Member
Звідки: Dnipro

Повідомлення

item2: 08.09.2025 20:01 1. AMD зробила ставку не на "тупе" розширення декодера, а на його обхід.
​Як це працює: Коли процесор вперше бачить складну x86-інструкцію, він її розкодовує на прості внутрішні мікро-операції (µops). Ці мікро-операції зберігаються у спеціальному швидкому кеші (µop cache).
Ні. З того самого інтервью (якого ніхто з вас не читав) AMD зробила ставку на точність Branch Prediction, чим і поясноє 4-wide - що родової проблеми складності декодерів x86 не вирішує, взагалі, а лище приховує, до певної межі (доки вистачає транзисторів на роздуття L0)

До того ж в ARM ніщо не заважає зробити так само, але абсолютний лідер за IPC/енергоефективності (яблуко) так не робить і "тупо" збільшує кількість декодерів, вже 5+ років маючи недосяжний для x86 IPC і енергоефективність
Тобто тільки перше виконання коду повільніше. Після його декодування АМД
проц буде працювати швидше, а головне - енергоефективніше.
Лише за умови, що ви на оптимістичному сценарії, коли у вас весь "гарячий код" в L0, а так буває не завжди, поклададись на виключно оптимістичні сценарії - це як мінімум себе не поважати, як мінімум, себе B-)
Front end
• Introducing a dual decode pipeline
- Decoder throughput scaled from 4 to 8 (2x4) per cycle (4 per thread, 4 in single thread)
- Op cache throughput expanded from 9 → 12 (2x6) per cycle (6 per thread, 6 for single thread)

Back end

• Dispatch width of integer operations expanded from 6 → 8
Це чудово, що ви можете цитувати презентації (навіть з нерелевантною інформацією), яле якщо у вас в пайплайні виникає "бульбашка" і її необхідно заповнити - куций 4-wide від AMD програє абсолютно всім, навіть Інтелу 11-го покоління, тож 5+wide це лише питання часу, "запам'ятайте цей твіт" як то кажуть, я ж обов'язково вам це нагадаю B-)
Technetium
Member
Звідки: Харкiв

Повідомлення

Та досить вам згадувати yuriy_dd, в темі по Ноктуа йому все пояснили :) звісно що він занадто впертий, щоб ось так просто визнати поразку, але навряд чи знову буде проситись на аргументовану дискусію ну бо просто все що він вміє то тролити. То ж надалі рекомендую просто ігнорити його повідомлення, сам себе швидше виживе
dext
Member
Звідки: Dnipro

Повідомлення

Scoffer: 08.09.2025 17:24 Будь-який внятний сучасний проц зобов'язаний мати максимально крутий бранч предіктор до котрого лише додумаються інженери тому що він обмежує не тільки фронт, а ще і бекенд. Від точності передбачення предіктора напряму залежить наскільки широкі нутрощі проца можна зробити. І грамотна архітектура мала б йому допомагати, наприклад предикатами. AArch64 очевидно до грамотний архітектур не належить, в розрізі хайперфу так точно, а в розрізі шо там по іот особисто мене слабко цікавить.

Більш того, бранч предіктор це мало не головна інтелектуальна цінність, максимально прихована від усіх. Доходить до того що ні інтел, ні амд, ні аплє, ні ібм не афішують точно що саме вони юзають в якості предіктора. Лише слухи ходять що у амд персептрони, а інтел зліз з tage на щось інше, бо артефактів tage не спостерігається.
Типова демагогія.
Просто нагадую, що в Crestmont збільшили глибину вибірки branch prediction в 4 (ЧОТИРИ) рази, чи дало це приріст хоча б в 2, 1.5 рази? Це знову риторичне питання щодо "інновацій x86" за для подолання родових болячок x86 :laugh:
daesz
Member
Аватар користувача

Повідомлення

Technetium: 08.09.2025 21:57звісно що він занадто впертий
Думаю, там діло не у впертості :shuffle:
1234waltz
Member

Повідомлення

Загалом смішні ці похвали arm, з урахуванням того, що Neon до рівня SSE2 доріс на 10 років пізніше і 128 bit повноцінним став тільки з Кортекса А15. SVE по факту в більшості консьюмерських чіпах, включно з Яблоками або відсутній, або заблокований. Навіть в десктопних Snapdragon Elite. Тобто зовсім смішно на фоні avx, avx2 та avx 512 в усіх чипах АМД.
Scoffer
Member
Аватар користувача

Повідомлення

dext: 08.09.2025 22:08Просто нагадую, що в Crestmont збільшили глибину вибірки branch prediction в 4 (ЧОТИРИ) рази, чи дало це приріст хоча б в 2, 1.5 рази?
А чому це має дати приріст в 2 рази? Єдиний параметр бранч предіктора це ймовірність з якою він робить своє передбачення. Скільки він там чого для цього вибирає це його особисті справи. От коли бранч з 98% вгадування зробить 99.5% отоді і будуть одразу твої два рази. Не раніше.
Від ефективності предіктора в ооо суперскалярі залежить взагалі ВСЕ, ну і ще трішечки від префетчера. Маючи гарний предіктор далі не треба бути генієм щоб накидати додаткових блоків в ширину ооо.
dext
Member
Звідки: Dnipro

Повідомлення

1234waltz: 08.09.2025 22:16 Загалом смішні ці похвали arm, з урахуванням того, що Neon до рівня SSE2 доріс на 10 років пізніше і 128 bit повноцінним став тільки з Кортекса А15. SVE по факту в більшості консьюмерських чіпах, включно з Яблоками або відсутній, або заблокований. Навіть в десктопних Snapdragon Elite. Тобто зовсім смішно на фоні avx, avx2 та avx 512 в усіх чипах АМД.
Кому потрібні 512+ бітні вектори в звичайному скалярному софті? Нікому, бо без ручної оптимізації в обмеженій кількості сценаріїв - нуль вигоди. Тому і не злетів з IceLake, і зараз майже нікому не потрібний, на відміну від скалярів, які і є тим самим показником IPC
tornadox
Member
Аватар користувача
Звідки: мені знати що ти не дивак?

Повідомлення

Technetium: 08.09.2025 21:57Та досить вам згадувати yuriy_dd, в темі по Ноктуа йому все пояснили :) звісно що він занадто впертий, щоб ось так просто визнати поразку, але навряд чи знову буде проситись на аргументовану дискусію ну бо просто все що він вміє то тролити. То ж надалі рекомендую просто ігнорити його повідомлення, сам себе швидше виживе
:gigi: ахахаха :lol:
я ще не бачив щоб він визнав поразку, він навпаки вважає що в кожній вітці саме він "втер носа" всім "фанатам х86"
дуже обмежений кругозір (принаймні з його постів) в людини якій подарили мак і вона навіть реально не знає як його використовувати, просто сидить і радіє думкою що там самий економічний(ні) і самий продуктивний(ні) процесор. Просто радіє і кидає бенчмарки і відео з ютуба, галюцинує що він користується лише самописним софтом (написаним 20 років назад) який компілиться на мак м1 без змін.
А згадуємо ми його, бо схоже що від домашнього карантину це тепер стало новим хоббі, заходити в випадкові вітки і писати про М1 і М4 і Снепдрегон тим самим викликаюти безкінечний срач.
dext
Member
Звідки: Dnipro

Повідомлення

Scoffer: 08.09.2025 22:57 А чому це має дати приріст в 2 рази? Єдиний параметр бранч предіктора це ймовірність з якою він робить своє передбачення. Скільки він там чого для цього вибирає це його особисті справи. От коли бранч з 98% вгадування зробить 99.5% отоді і будуть одразу твої два рази. Не раніше.
Від ефективності предіктора в ооо суперскалярі залежить взагалі ВСЕ, ну і ще трішечки від префетчера. Маючи гарний предіктор далі не треба бути генієм щоб накидати додаткових блоків в ширину ооо.
В того ж ябдука глибина вибірки менша (тобто і затрати енергії), тож і і енергоефективність вища, і продуктивність - що ж пішло не так у вашому плані? :laugh:
Scoffer
Member
Аватар користувача

Повідомлення

dext: 08.09.2025 23:05що ж пішло не так у вашому плані?
У нашому все пішло по плану, а у вашому аплє обісралось в іграх, де цей бранч предіктор максимально задіяний.
https://www.overclockers.ua/ua/news/app ... uirements/
Сайнбенч, на котрий ви тут з володьою на пару наярюєте, особливої предикції не вимагає, зато як доходить до реально складного софту, так одразу "ой, всьо".
tornadox
Member
Аватар користувача
Звідки: мені знати що ти не дивак?

Повідомлення

l-m: 08.09.2025 21:24Просто, за винятком одного навіженого, який десь пропав, всім в цілому байдуже на ARM :shuffle:
мені не байдуже на АРМ, я все чекаю ту революцію АРМ про яку він говорить, але чомусь отримуємо якісь одноразові процесори з закритою екосистемою за преміальною ціною. Ціна Снепдрегон Еліт вже перевалила за ціни продуктивних ноутбучних х86, хоча крім 18 годин перегляду локального відео ці SoC нічого більше цікавого запропонувати не можуть. М серія непогана, але там екосистема. В мене зараз м4 про, ніби й класно, але це не х86, багато софту не працює, ти або ставиш те що є в апсторі, або гуляєш. Це не лінукс де тобі сотні крутих шарів сумісності і запускай софт хоча з він 95, хоч кіберпанк.
dext
Member
Звідки: Dnipro

Повідомлення

Scoffer: 08.09.2025 23:07 У нашому все пішло по плану, а у вашому аплє обісралось в іграх, де цей бранч предіктор максимально задіяний.
Ви ж порівнювали на iGPU/dGPU +/- однакової ігрової продуктивності, чи не так? :rotate:
Scoffer: 08.09.2025 23:07 Сайнбенч, на котрий ви тут з володьою на пару наярюєте, особливої предикції не вимагає, зато як доходить до реально складного софту, так одразу "ой, всьо".
Я не знаю що це за нерсонаж, напевно я його також "ображаю" час від часу, але результат CB в категорії CPU залежить виключно від продуктивності CPU, чи не так?
Якщо ви не розумієте різниці між тестами виключно ЦП та ЦП+ГП (вбудованого у випадку яблука та дискретних 5080/5090 у випадку PC) то далі тут нічого обговорювати, принципово B-)
Scoffer
Member
Аватар користувача

Повідомлення

dext: 08.09.2025 23:18але результат CB в категорії CPU залежить виключно від продуктивності CPU, чи не так?
Результат СВ, котрий не використовує бренч предіктор тому що не використовує бранчі цікавий лише прихильникам папуг в СВ. Нічого спільного з результатами в нормальному софті ці папуги не мають.
спойлер
Зображення
AntonyKandaurov
Member
Аватар користувача
Звідки: Славетне місто Запоріжжя

Повідомлення

Та ну нє, не вбивайте його дитину, не вбивайте!!11!
Відповісти