Стартап d-Matrix оголосив, що використає технологію NVLink Fusion від NVIDIA для інтеграції власних ШІ-процесорів Raptor безпосередньо у серверні системи на базі інфраструктури NVIDIA. Це означає, що виробник GPU фактично відкриває частину своєї високошвидкісної серверної екосистеми для сторонніх спеціалізованих чипів.

d-Matrix спеціалізується на інференсі — етапі, коли вже навчена модель обробляє реальні запити користувачів. Саме інференс лежить в основі чатботів, голосових асистентів, систем генерації коду та інших сервісів, які мають відповідати швидко й із мінімальною затримкою.
Навчання великих моделей зазвичай потребує величезних кластерів GPU, але після завершення навчання економіка роботи системи змінюється. Компанії починають шукати дешевші та енергоефективніші процесори, які можуть виконувати мільярди щоденних запитів.
Raptor створений саме для такого сценарію. d-Matrix заявляє, що його архітектура оптимізована під низьку затримку й високу ефективність під час виконання моделей, а не під їхнє початкове навчання.
NVLink Fusion дозволяє стороннім прискорювачам підключатися до серверної архітектури NVIDIA через високошвидкісні інтерфейси, спеціальні конектори та спільну пам’ять. Це дає можливість будувати гібридні сервери, де GPU NVIDIA та інший ШІ-чип виконують різні етапи роботи.
d-Matrix планує завершити фінальний дизайн Raptor до кінця 2026 року. Системи, які поєднуватимуть Raptor з інфраструктурою NVIDIA, очікуються у 2027 році.
Стартап також співпрацює з Astera Labs над спеціалізованими високошвидкісними каналами передачі даних усередині серверів. Для інференсу це критично, оскільки обчислення можуть втрачати перевагу, якщо дані занадто повільно переміщуються між пам’яттю та різними прискорювачами.
d-Matrix уже має підтримку великих інвесторів. Microsoft брала участь у раунді фінансування на $110 млн ще у 2023 році, а після залучення $450 млн у 2025 році компанію оцінювали приблизно у $2 млрд.
Перший власний ШІ-чип d-Matrix почала постачати наприкінці 2024 року. Raptor має стати наступним поколінням і значно глибше інтегруватися в серверні платформи великих дата-центрів.
Для NVIDIA така співпраця показує зміну стратегії: компанія не лише продає власні GPU, а й намагається зробити NVLink стандартом, навколо якого інші виробники будуватимуть власні прискорювачі.

3062