Стартап d-Matrix представил на конференции Hot Chips 2026 ускоритель Raptor для запуска генеративных моделей. Его вычислительный кристалл установлен прямо поверх специально разработанной памяти DRAM. Компания заявляет пропускную способность 100 ТБ/с при объёме памяти 32 ГБ на карту.
Вычислительный кристалл выпускается по техпроцессу TSMC N4P. Он соединён с памятью лицевыми сторонами с шагом контактов 36 микрон. Такое расположение сокращает путь данных между памятью и вычислительными блоками.
По измерениям d-Matrix, передача одного бита требует 0,37 пДж. Для перемещения данных в базовый кристалл HBM4 нужно около 2,4 пДж. Авторы совместной работы d-Matrix и Университета Британской Колумбии также рассчитали, что одна карта Raptor даст в 4,7 раза больше производительности, чем решения с HBM.
За высокую скорость приходится платить энергопотреблением. Вертикальный интерфейс использует 296 Вт из общего бюджета корпуса в 422 Вт. Память работает при температуре до 105 °C, поэтому её приходится обновлять в восемь раз чаще обычного. d-Matrix уменьшила банки памяти, и обновление занимает 1,37% доступной пропускной способности.
Главное ограничение Raptor — объём памяти. У карты только 32 ГБ против 192–288 ГБ у будущих ускорителей с HBM4. Поэтому d-Matrix предлагает объединять 72 карты в стойку с 2,3 ТБ памяти. По расчётам компании, такая система сможет обслуживать модель Kimi K3 на 2,8 трлн параметров и выдавать 988 токенов в секунду на пользователя при контексте в миллион токенов.
Все показатели производительности пока остаются прогнозами на основе ранних образцов. Независимых тестов Raptor нет. Компания рассчитывает выпустить ускоритель в 2027 году, но не назвала цену, объёмы поставок и производителя нестандартной DRAM. Именно доступность этой памяти определит, сможет ли Raptor выйти за пределы демонстрации.