На конференции GTC Дженсен Хуанг снова появится в кожаной куртке и продемонстрирует впечатляющие достижения NVIDIA в области искусственного интеллекта. Генеральный директор компании объявил о начале новой фазы развития ИИ, сосредоточив внимание на технологиях инференса. Главным акцентом стало оборудование – серверный комплекс Nvidia Groq 3 LPX rack, который включает 72 сервера Vera Rubin и 256 чипов LPU от стартапа Groq, с которым NVIDIA заключила сделку за $20 млрд.
Хуанг отметил, что эта система сможет генерировать 700 миллионов токенов в секунду, что в 350 раз быстрее, чем предшествующие технологии. Компания также объявила о партнерствах в сфере цифровых двойников и создании коалиции разработчиков ПО. В рамках этого сотрудничества планируется ускорение разработки передовых ИИ-моделей.
Кроме того, стартап Nscale, поддерживающий NVIDIA, анонсировал создание облачного вычислительного кластера в Западной Виргинии. В заключение конференции была продемонстрирована работающая модель робота Олафа от NVIDIA и DeepMind, продемонстрировавшая новые потенциалы в физическом ИИ.