Выпустив Groq 3 LPX в полную эксплуатацию, NVIDIA расширяет возможности вывода Vera Rubin для агентов
Следующая эра вывода ИИ не будет определяться каким-то одним прорывным чипом, сетью или системой. Это будет определяться тем, как каждый уровень фабрики ИИ работает вместе. Вот почему NVIDIA расширяет Vera Rubin NVL72 за счет быстрой генерации токенов для агентных систем.
Анонсированная сегодня стоечная система NVIDIA Vera Rubin NVIDIA Groq 3 LPX находится в стадии полного производства. В тесте искусственного анализа с использованием Gemma 4 31B, агентной модели с открытым исходным кодом, она доставляла 3400 выходных токенов в секунду для сценариев использования с длинным контекстом со 100 000 токенов, критически важных для агентных систем, что в 4 раза быстрее, чем ближайшая альтернативная платформа.
Отраслевые партнеры по всему миру внедряют платформенные решения Vera Rubin. SpaceXAI объявила, что процессоры NVIDIA Vera станут основой следующего поколения агентного ИИ. CoreWeave внедрила в производство Spectrum-X Multiplane, который соединяет стойки NVIDIA Vera Rubin с помощью нескольких параллельных коммутаторов для обеспечения высокоскоростных, плоских сетей искусственного интеллекта без потерь. Nebius — первое облако искусственного интеллекта, использующее NVIDIA Groq 3 LPX.
Источник: NVIDIA (перевод)
