TensorRT Edge-LLM, Jetson AGX Thor에서 MLPerf Edge Agentic 벤치마크 6.4배 빠르게 완료
TensorRT Edge-LLM Completes the MLPerf Edge Agentic Benchmark 6.4x Faster on Jetson AGX Thor
AI 에이전트는 클라우드 데이터 센터에서 차량, 로봇 및 기타 엣지 장치로 이동하고 있다. 에이전트는 단일 프롬프트에 응답하는 챗봇과 달리 일련의 단계를 통해 작업을 수행하며, 도구를 선택하고 그 결과를 평가하며 대화가 길어짐에 따라 계속해서 추론을 진행한다. 이러한 워크플로우는 엣지 추론에 새로운 요구 사항을 부과하며, 모델은 빠르게 토큰을 생성해야 한다.
TensorRT Edge-LLM은 Jetson AGX Thor에서 엣지 환경에서의 AI 에이전트 성능을 크게 향상시킬 수 있다.
원문 출처
NVIDIA Technical Blog