Китай нашёл альтернативу гонке техпроцессов: новый ИИ-чип обходит NVIDIA по скорости памяти

Китайская компания DFSX представила новую архитектуру для ИИ-ускорителей, сделав ставку не на уменьшение техпроцесса, а на увеличение пропускной способности памяти. По заявлениям разработчиков, суперузел TY64 на базе будущих чипов DF2000 сможет обеспечить до 960 ТБ/с пропускной способности памяти — почти вдвое больше, чем 576 ТБ/с у системы NVIDIA GB200 NVL72.

Вместо перехода на более тонкие техпроцессы DFSX продолжает использовать 14-нм производство, компенсируя это трёхмерной компоновкой. Память размещается непосредственно над вычислительными блоками и соединяется с ними с помощью гибридного 3D-соединения без микроконтактов (microbumps), что сокращает задержки и повышает скорость обмена данными.

Компания считает, что главным ограничением современных ИИ-систем стала не вычислительная мощность, а так называемая «стена памяти», из-за которой ускорители простаивают в ожидании данных. Именно поэтому DF2000 делает ставку на значительно более высокую пропускную способность, хотя по производительности BF16 заметно уступает решению NVIDIA: 64 PFLOPS против 360 PFLOPS у GB200 NVL72.

Следующим этапом станет чип DF3000, который, по планам DFSX, увеличит пропускную способность памяти до 20 ТБ/с на один процессор и 1280 ТБ/с в составе TY64 SuperNode. Это уже приблизится к уровню NVIDIA Vera Rubin NVL72, несмотря на использование гораздо более зрелого 14-нм техпроцесса.

Источник: www.playground.ru

0 0 голоса
Рейтинг новости
1
0
Подписаться
Уведомить о
0 комментариев