Новини
Останні статті і огляди
В AMD вважають, що в архітектури ARM немає переваг над x86
-
tornadox
Member
- Звідки: мені знати що ти не дивак?
Vladys77
Як тут вже охрестили, "новий місцевий навіжений", пророкує що скоро кінець Х86, і агітує за АРМ (чи мак - не зрозуміло)
viewtopic.php?p=4027541#p4027541
Як тут вже охрестили, "новий місцевий навіжений", пророкує що скоро кінець Х86, і агітує за АРМ (чи мак - не зрозуміло)
viewtopic.php?p=4027541#p4027541
-
daesz
Member
Юра, ти де?
-
item2
Member
- Звідки: Київ
Пояснюю.dext: ↑ 08.09.2025 14:32 Аціо
Ви краще поясніть, чому AMD досі не може вилізти з 4-wide decode, - зможете? Питання риторичне![]()
1. AMD зробила ставку не на "тупе" розширення декодера, а на його обхід.
Як це працює: Коли процесор вперше бачить складну x86-інструкцію, він її розкодовує на прості внутрішні мікро-операції (µops). Ці мікро-операції зберігаються у спеціальному швидкому кеші (µop cache).
Результат: Коли цей код виконується знову (наприклад, у циклі), процесор більше не звертається до повільного 4-wide декодера. Він бере вже готові мікро-операції прямо з µop-кешу. А ось ширина вибірки з цього кешу в Zen 4 становила вже 6 мікро-операцій за такт. Якщо тести покажуть, що 6 - вузьке місце, збільшать в наступному поколінні без проблем.
Тобто тільки перше виконання коду повільніше. Після його декодування АМД
проц буде працювати швидше, а головне - енергоефективніше.
2. Зміни у Zen 5. Тепер АМД має вже 8 (2*4) wide декодер на ядро, а вибірка з µop-кешу вже 12 (2*6) інструкцій. І може виконувати вже 8 цілочисельних інструкцій одночасно:
Front end
• Introducing a dual decode pipeline
- Decoder throughput scaled from 4 to 8 (2x4) per cycle (4 per thread, 4 in single thread)
- Op cache throughput expanded from 9 → 12 (2x6) per cycle (6 per thread, 6 for single thread)
Back end
• Dispatch width of integer operations expanded from 6 → 8
-
mrigi
Member
Боже, така холіварна тема і усього чотири страниці 
-
l-m
Member
Просто, за винятком одного навіженого, який десь пропав, всім в цілому байдуже на ARM
-
pelia
Member
Юра не прийде, так само як Володя не приходить у треди де інтел сам собі штанці мочить
-
dext
Member
- Звідки: Dnipro
Ні. З того самого інтервью (якого ніхто з вас не читав) AMD зробила ставку на точність Branch Prediction, чим і поясноє 4-wide - що родової проблеми складності декодерів x86 не вирішує, взагалі, а лище приховує, до певної межі (доки вистачає транзисторів на роздуття L0)item2: ↑ 08.09.2025 20:01 1. AMD зробила ставку не на "тупе" розширення декодера, а на його обхід.
Як це працює: Коли процесор вперше бачить складну x86-інструкцію, він її розкодовує на прості внутрішні мікро-операції (µops). Ці мікро-операції зберігаються у спеціальному швидкому кеші (µop cache).
До того ж в ARM ніщо не заважає зробити так само, але абсолютний лідер за IPC/енергоефективності (яблуко) так не робить і "тупо" збільшує кількість декодерів, вже 5+ років маючи недосяжний для x86 IPC і енергоефективність
Лише за умови, що ви на оптимістичному сценарії, коли у вас весь "гарячий код" в L0, а так буває не завжди, поклададись на виключно оптимістичні сценарії - це як мінімум себе не поважати, як мінімум, себеТобто тільки перше виконання коду повільніше. Після його декодування АМД
проц буде працювати швидше, а головне - енергоефективніше.
Це чудово, що ви можете цитувати презентації (навіть з нерелевантною інформацією), яле якщо у вас в пайплайні виникає "бульбашка" і її необхідно заповнити - куций 4-wide від AMD програє абсолютно всім, навіть Інтелу 11-го покоління, тож 5+wide це лише питання часу, "запам'ятайте цей твіт" як то кажуть, я ж обов'язково вам це нагадаюFront end
• Introducing a dual decode pipeline
- Decoder throughput scaled from 4 to 8 (2x4) per cycle (4 per thread, 4 in single thread)
- Op cache throughput expanded from 9 → 12 (2x6) per cycle (6 per thread, 6 for single thread)
Back end
• Dispatch width of integer operations expanded from 6 → 8
-
Technetium
Member
- Звідки: Харкiв
Та досить вам згадувати yuriy_dd, в темі по Ноктуа йому все пояснили
звісно що він занадто впертий, щоб ось так просто визнати поразку, але навряд чи знову буде проситись на аргументовану дискусію ну бо просто все що він вміє то тролити. То ж надалі рекомендую просто ігнорити його повідомлення, сам себе швидше виживе
-
dext
Member
- Звідки: Dnipro
Типова демагогія.Scoffer: ↑ 08.09.2025 17:24 Будь-який внятний сучасний проц зобов'язаний мати максимально крутий бранч предіктор до котрого лише додумаються інженери тому що він обмежує не тільки фронт, а ще і бекенд. Від точності передбачення предіктора напряму залежить наскільки широкі нутрощі проца можна зробити. І грамотна архітектура мала б йому допомагати, наприклад предикатами. AArch64 очевидно до грамотний архітектур не належить, в розрізі хайперфу так точно, а в розрізі шо там по іот особисто мене слабко цікавить.
Більш того, бранч предіктор це мало не головна інтелектуальна цінність, максимально прихована від усіх. Доходить до того що ні інтел, ні амд, ні аплє, ні ібм не афішують точно що саме вони юзають в якості предіктора. Лише слухи ходять що у амд персептрони, а інтел зліз з tage на щось інше, бо артефактів tage не спостерігається.
Просто нагадую, що в Crestmont збільшили глибину вибірки branch prediction в 4 (ЧОТИРИ) рази, чи дало це приріст хоча б в 2, 1.5 рази? Це знову риторичне питання щодо "інновацій x86" за для подолання родових болячок x86
-
daesz
Member
Думаю, там діло не у впертостіTechnetium: ↑ 08.09.2025 21:57звісно що він занадто впертий
-
1234waltz
Member
Загалом смішні ці похвали arm, з урахуванням того, що Neon до рівня SSE2 доріс на 10 років пізніше і 128 bit повноцінним став тільки з Кортекса А15. SVE по факту в більшості консьюмерських чіпах, включно з Яблоками або відсутній, або заблокований. Навіть в десктопних Snapdragon Elite. Тобто зовсім смішно на фоні avx, avx2 та avx 512 в усіх чипах АМД.
-
Scoffer
Member
А чому це має дати приріст в 2 рази? Єдиний параметр бранч предіктора це ймовірність з якою він робить своє передбачення. Скільки він там чого для цього вибирає це його особисті справи. От коли бранч з 98% вгадування зробить 99.5% отоді і будуть одразу твої два рази. Не раніше.dext: ↑ 08.09.2025 22:08Просто нагадую, що в Crestmont збільшили глибину вибірки branch prediction в 4 (ЧОТИРИ) рази, чи дало це приріст хоча б в 2, 1.5 рази?
Від ефективності предіктора в ооо суперскалярі залежить взагалі ВСЕ, ну і ще трішечки від префетчера. Маючи гарний предіктор далі не треба бути генієм щоб накидати додаткових блоків в ширину ооо.
-
dext
Member
- Звідки: Dnipro
Кому потрібні 512+ бітні вектори в звичайному скалярному софті? Нікому, бо без ручної оптимізації в обмеженій кількості сценаріїв - нуль вигоди. Тому і не злетів з IceLake, і зараз майже нікому не потрібний, на відміну від скалярів, які і є тим самим показником IPC1234waltz: ↑ 08.09.2025 22:16 Загалом смішні ці похвали arm, з урахуванням того, що Neon до рівня SSE2 доріс на 10 років пізніше і 128 bit повноцінним став тільки з Кортекса А15. SVE по факту в більшості консьюмерських чіпах, включно з Яблоками або відсутній, або заблокований. Навіть в десктопних Snapdragon Elite. Тобто зовсім смішно на фоні avx, avx2 та avx 512 в усіх чипах АМД.
-
tornadox
Member
- Звідки: мені знати що ти не дивак?
Technetium: ↑ 08.09.2025 21:57Та досить вам згадувати yuriy_dd, в темі по Ноктуа йому все пояснилизвісно що він занадто впертий, щоб ось так просто визнати поразку, але навряд чи знову буде проситись на аргументовану дискусію ну бо просто все що він вміє то тролити. То ж надалі рекомендую просто ігнорити його повідомлення, сам себе швидше виживе
я ще не бачив щоб він визнав поразку, він навпаки вважає що в кожній вітці саме він "втер носа" всім "фанатам х86"
дуже обмежений кругозір (принаймні з його постів) в людини якій подарили мак і вона навіть реально не знає як його використовувати, просто сидить і радіє думкою що там самий економічний(ні) і самий продуктивний(ні) процесор. Просто радіє і кидає бенчмарки і відео з ютуба, галюцинує що він користується лише самописним софтом (написаним 20 років назад) який компілиться на мак м1 без змін.
А згадуємо ми його, бо схоже що від домашнього карантину це тепер стало новим хоббі, заходити в випадкові вітки і писати про М1 і М4 і Снепдрегон тим самим викликаюти безкінечний срач.
-
dext
Member
- Звідки: Dnipro
В того ж ябдука глибина вибірки менша (тобто і затрати енергії), тож і і енергоефективність вища, і продуктивність - що ж пішло не так у вашому плані?Scoffer: ↑ 08.09.2025 22:57 А чому це має дати приріст в 2 рази? Єдиний параметр бранч предіктора це ймовірність з якою він робить своє передбачення. Скільки він там чого для цього вибирає це його особисті справи. От коли бранч з 98% вгадування зробить 99.5% отоді і будуть одразу твої два рази. Не раніше.
Від ефективності предіктора в ооо суперскалярі залежить взагалі ВСЕ, ну і ще трішечки від префетчера. Маючи гарний предіктор далі не треба бути генієм щоб накидати додаткових блоків в ширину ооо.
-
Scoffer
Member
У нашому все пішло по плану, а у вашому аплє обісралось в іграх, де цей бранч предіктор максимально задіяний.dext: ↑ 08.09.2025 23:05що ж пішло не так у вашому плані?
https://www.overclockers.ua/ua/news/app ... uirements/
Сайнбенч, на котрий ви тут з володьою на пару наярюєте, особливої предикції не вимагає, зато як доходить до реально складного софту, так одразу "ой, всьо".
-
tornadox
Member
- Звідки: мені знати що ти не дивак?
мені не байдуже на АРМ, я все чекаю ту революцію АРМ про яку він говорить, але чомусь отримуємо якісь одноразові процесори з закритою екосистемою за преміальною ціною. Ціна Снепдрегон Еліт вже перевалила за ціни продуктивних ноутбучних х86, хоча крім 18 годин перегляду локального відео ці SoC нічого більше цікавого запропонувати не можуть. М серія непогана, але там екосистема. В мене зараз м4 про, ніби й класно, але це не х86, багато софту не працює, ти або ставиш те що є в апсторі, або гуляєш. Це не лінукс де тобі сотні крутих шарів сумісності і запускай софт хоча з він 95, хоч кіберпанк.l-m: ↑ 08.09.2025 21:24Просто, за винятком одного навіженого, який десь пропав, всім в цілому байдуже на ARM
-
dext
Member
- Звідки: Dnipro
Ви ж порівнювали на iGPU/dGPU +/- однакової ігрової продуктивності, чи не так?Scoffer: ↑ 08.09.2025 23:07 У нашому все пішло по плану, а у вашому аплє обісралось в іграх, де цей бранч предіктор максимально задіяний.
Я не знаю що це за нерсонаж, напевно я його також "ображаю" час від часу, але результат CB в категорії CPU залежить виключно від продуктивності CPU, чи не так?Scoffer: ↑ 08.09.2025 23:07 Сайнбенч, на котрий ви тут з володьою на пару наярюєте, особливої предикції не вимагає, зато як доходить до реально складного софту, так одразу "ой, всьо".
Якщо ви не розумієте різниці між тестами виключно ЦП та ЦП+ГП (вбудованого у випадку яблука та дискретних 5080/5090 у випадку PC) то далі тут нічого обговорювати, принципово
-
Scoffer
Member
Результат СВ, котрий не використовує бренч предіктор тому що не використовує бранчі цікавий лише прихильникам папуг в СВ. Нічого спільного з результатами в нормальному софті ці папуги не мають.dext: ↑ 08.09.2025 23:18але результат CB в категорії CPU залежить виключно від продуктивності CPU, чи не так?
- спойлер

-
AntonyKandaurov
Member
- Звідки: Славетне місто Запоріжжя
Та ну нє, не вбивайте його дитину, не вбивайте!!11!