NVIDIA Groq 3 LPX, Vera Rubin 시스템과 함께 AI 추론 성능 향상
With Groq 3 LPX in Full Production, NVIDIA Extends Vera Rubin Inference for Agents
NVIDIA는 Vera Rubin NVL72 플랫폼을 기반으로 한 Groq 3 LPX를 전량 생산 중이며, 이는 100,000 토큰 길이의 컨텍스트에서 초당 3,400개의 출력 토큰을 생성할 수 있다. Nebius는 Groq 3 LPX를 채택하여 개발자들에게 높은 반응 속도의 에이전틱 AI 애플리케이션을 위한 토큰 생성 속도를 제공한다. SpaceXAI는 에이전틱 AI 아키텍처를 구축하기 위해 NVIDIA Vera CPUs를 사용할 계획이다.
NVIDIA Groq 3 LPX는 에이전틱 워크로드를 위한 최저 지연 시간의 토큰 생성을 지원하여, 개발자들이 실시간 AI 경험을 대규모로 구축할 수 있도록 한다.
원문 출처
NVIDIA Blog