Category
AI 프로덕트·스타트업
AI 프로덕트·스타트업은 모델을 감싸 실제 사용자 가치를 파는 영역이다. 데모는 쉽지만 신뢰성·단가·해자 없는 래퍼라는 벽에 부딪힌다. 한국 시장에선 결제·법무·개인정보 규제까지 함께 풀어야 출시에 닿는다. 기술보다 PMF와 운영 완성도가 생존을 가른다.
Salesforce, Anthropic과 협력해 Claudeforce 출시 및 Flex Credits 기반 수익 모델 강조
Salesforce는 Q2 재무 결과를 발표하며 Anthropic과 협력해 Claudeforce를 출시했다. Claudeforce는 Claude의 서비스와 Salesforce의 기업 데이터, 워크플로우, 비즈니스 로직을 통합하며, 37개의 사전 구축된 '판매 기술'을 제공한다. 고객은 소비 기반 요금제인 Flex Credits를 통해 서비스에 접근할 수 있으며, 전체 예약의 50%가 Flex Credits를 통해 발생했다고 밝혔다. 또한, 새로운 Slack 버전과 AI 지원 비서인 Coworker도 함께 제공될 예정이다.
OpenAI의 경영진 변화와 Greg Brockman의 권력 집중
OpenAI의 공동 창립자이자 사장인 Greg Brockman이 최근 몇 달 동안 다른 고위 경영진들이 떠나면서 회사 내에서 권력을 집중하고 있다. Brockman은 현재 ChatGPT, Codex 등 소비자 및 기업 제품 팀을 총괄하며, OpenAI의 일상 운영을 주도하고 있다. Sam Altman은 IPO와 회사의 전반적인 방향에 집중하고 있으며, Brockman은 기업 비즈니스와 소비자 측면 모두를 관리하고 있다.
NVIDIA RTX Spark, 게임과 기술을 Gamescom에서 공개
NVIDIA는 독일 쾰른에서 열리는 Gamescom에서 RTX Spark를 소개하며 새로운 게임, 안티치트 기술, 시각적 품질 향상을 지원한다고 밝혔다. Electronic Arts, Embark, Ubisoft 등 여러 게임 개발사가 RTX Spark에 블록버스터 타이틀을 제공할 예정이다. RTX Spark는 개인 AI 에이전트, 고급 콘텐츠 제작, 고성능 게임을 통합한 플랫폼으로, EA Javelin 안티치트 기술을 통해 공정한 게임 플레이를 지원한다. RTX Spark는 올 가을 출시된다.
NVIDIA NVLink Fusion과 NVHBM 고대역폭 메모리 기술 확장
NVIDIA는 NVLink Fusion을 NVHBM이라는 차세대 고대역폭 메모리 기술로 확장했다. NVHBM은 메모리 컨트롤러를 HBM 기본 다이에 통합하여 최대 30% 더 높은 메모리 대역폭과 15% 낮은 HBM 전력 소비를 제공하며, XPU 컴퓨트 다이에서 최대 25%의 공간을 절약한다. 아마존의 Annapurna Labs는 NVHBM 기술을 활용하여 AI 워크로드의 성능과 효율성을 향상시키기 위한 협력 작업을 진행할 예정이다.
NVIDIA, HuggingFace를 130억 달러에 인수
NVIDIA가 HuggingFace를 130억 달러에 인수하기로 결정했다. 이는 HuggingFace의 연간 반복 수익(ARR) 1억 5천만 달러의 약 80배에 해당하며, 2026년 고객 기반이 두 배로 증가한 결과이다. 이 인수가는 2026년 1월 NVIDIA의 초기 제안인 70억 달러에서 거의 두 배 증가한 것이다.
라이브 서비스에서 AI 도입의 어려움과 실무자의 우려
라이브 서비스는 이미 운영 중인 제품으로, 기능 추가가 가능하지만 기존 기능 삭제는 어렵다. 이로 인해 유지보수 부담이 커지고, AI 도입 시에도 복잡한 데이터 연결성과 코드 구조로 인해 정확한 처리가 어려워진다. 실무자는 AI의 판단이 잘못될 경우 사용자에게 즉각적인 영향을 미칠 수 있어 신중한 접근이 필요하다고 언급한다.
토스증권 추천 시스템의 진화와 RAG 기반 검색 기술
토스증권의 추천 시스템은 배치 중심에서 실시간 개인화로 변화하고 있으며, 유저의 행동 이벤트와 아이템 변경 이벤트를 반영하여 추천을 루프 형태로 운영하고 있다. 추천의 고도화에 따라 임베딩 모델과 벡터 저장소 운영이 중요해지고 있으며, RAG는 검색을 제품화하는 문제로 접근하여 하이브리드 검색과 리랭킹을 통해 검색 품질을 개선하고 있다. RAG 플랫폼은 다양한 제품에서 활용되고 있으며, 각 서비스의 요구에 맞춰 검색 결과를 최적화하고 있다.
OpenAI의 Jalapeño 칩, 경쟁사보다 빠른 AI 응답 제공
OpenAI는 새로운 AI 칩 Jalapeño가 다른 AI 시스템보다 작업을 더 효율적으로 수행하고 응답을 더 빠르게 반환한다고 발표했다. Jalapeño는 낮은 지연 시간과 높은 처리량을 제공하며, AI 시스템이 일반적으로 이 두 가지 사이에서 트레이드오프를 해야 하는 문제를 해결한다. 이 칩은 Broadcom과의 협력으로 제작된 응용 프로그램 전용 집적 회로(ASIC)로, AI 추론을 위해 설계되었다.
LLM을 생산 환경에서 평가하는 방법
언어 모델은 깨끗한 벤치마크에서 잘 수행되더라도 실제 환경에서는 어려움을 겪을 수 있다. LLM 기반 시스템의 프로토타입 단계에서는 벤치마크와 큐레이션된 데이터셋이 유용하지만, 생산 단계로 접어들면 평가 문제는 달라진다. 실제 입력은 모호할 수 있고, 레이블이 일관되지 않을 수 있으며, 중요한 맥락이 누락되거나 잘릴 수 있다. GitHub의 비밀 스캐닝 시스템을 평가하면서 이러한 문제를 경험했다. 비밀 스캐닝은 레포지토리에 커밋된 자격 증명을 식별하는 작업으로, LLM이 문자열을 올바르게 분류할 수 있는지를 아는 것보다 노이즈 경고를 줄이면서도 충분한 재현율을 유지할 수 있는지를 이해하는 것이 중요했다. 평가 기준은 주요 결과, 안전 제약, 운영 가이드라인으로 나뉘며, 각 지표의 상호 교환성을 고려하지 않아야 한다.
AWS 기반 AI 지식 관리 시스템 구축
조직들은 축적된 지식을 관리하는 데 어려움을 겪고 있으며, 기존의 문서화 방법은 비효율적이다. AWS 서비스를 활용한 커스터마이즈 가능한 클라우드 기반 솔루션이 제안되며, 이는 지식을 캡처하고 유지하며 전달하는 지능형 아바타 시스템을 포함한다. 이 시스템은 제조업, 의료, 금융 서비스, 에너지 기업 등 다양한 산업에서 사용될 수 있으며, 사용자들은 자연어 쿼리를 통해 절차와 정책에 접근할 수 있다. 시스템은 데스크톱 브라우저, 음성 상호작용, 텍스트 기반 쿼리를 지원한다.
Amazon SageMaker HyperPod에서 Ray 기능 통합 발표
AWS는 Amazon SageMaker HyperPod에 Ray 기능을 통합하여 대규모 기계 학습을 위한 전용 인프라를 제공한다고 발표했다. 데이터 과학자들은 SageMaker Studio에서 Ray 클러스터를 생성하고 관리하며, Ray 대시보드와 Amazon Managed Grafana 대시보드를 열 수 있다. HyperPod는 노드 건강 모니터링과 자동 복구 기능을 통해 Ray 훈련 작업에 자동 장애 허용 기능을 제공하며, 기존의 Ray API와 KubeRay를 사용하여 기존 스크립트와 워크플로우가 수정 없이 실행될 수 있다.
AI 공장을 위한 NVLink Fusion과 XPUs의 통합
AI 공장은 지속적으로 운영되며, 경제성은 초당 토큰, 와트당 토큰, 토큰당 비용, 활용도 및 가동 시간으로 정의된다. AI 플랫폼의 설계 및 개발은 XPUs 설계뿐만 아니라 네트워킹, 아키텍처, 소프트웨어 및 공급망 생태계까지 포함해야 한다. NVLink Fusion은 XPUs를 NVIDIA의 AI 인프라에 연결하여 성능을 높이고 시장 출시 시간을 단축하며 리스크를 완화한다. NVLink의 6세대 기술은 72-XPU 도메인에서 높은 대역폭과 낮은 지연 시간을 제공하며, XPU 간 전송 지연은 기존 이더넷 솔루션보다 3배 낮고 패킷 전송 속도는 10배 높다.
Stripe, OpenRouter 인수로 AI 모델 라우팅 시스템 구축
Stripe는 OpenRouter를 인수하여 수십 개 공급자의 수백 개 모델에 대한 요청을 라우팅하는 게이트웨이를 확보했다. 이로 인해 AI 모델 선택이 금융적 결정으로 변모하고 있으며, AI 애플리케이션은 이제 단일 공급자에 의존하지 않고 최적의 공급자를 선택하는 구조로 변화하고 있다. 또한, Etched는 700억 달러의 가치로 첫 번째 랙을 배송하며 전문화된 추론 하드웨어의 생산이 시작되었음을 나타내고 있다. DeepSeek는 새로운 다중 모달 모델을 통해 이미지와 스크린샷을 이해할 수 있는 능력을 확장하고 있다.
허깅페이스, 130억달러 이상 기업 가치로 매각 검토
허깅페이스가 기업 가치 130억달러(약 18조원) 이상을 기준으로 매각 가능성을 검토하고 있다. 현재 구체적인 인수 계약은 체결되지 않았으나, 투자은행과 협력해 잠재적 인수자들의 관심을 타진 중이다. 허깅페이스는 개발자들이 AI 모델을 발견하고 공유하며 활용할 수 있도록 지원하는 플랫폼이다.
OpenAI의 그렉 브록먼, 권력 집중
OpenAI는 올해 여러 사건을 겪었다. 엘론 머스크와의 재판, 애플의 고소, 다른 AI 회사 해킹 사건 등으로 어려움을 겪었으며, IPO를 준비하는 과정에서 여러 경영진이 떠났다. 이 과정에서 그렉 브록먼이 OpenAI의 대통령으로서 권력을 집중하고 있다.
Nvidia, 컴퓨트를 자산 클래스로 전환하기 위한 5000억 달러 자금 조달 추진
Nvidia CEO 젠슨 황은 기술 칩이 투자 가능한 자산 클래스로 자리잡고 있다고 밝혔다. Apollo, BlackRock, Blackstone, Brookfield, Goldman Sachs, KKR와 협력하여 5000억 달러의 자금을 조달해 컴퓨트를 자산 클래스로 전환할 계획이다. 이는 수익을 창출하는 자산으로, 생산적이며 유연한 특성을 지닌다.
Stripe, OpenRouter 인수 계획 발표 - 80억 달러
Stripe는 OpenRouter를 80억 달러에 인수할 계획이다. OpenRouter는 AI 모델의 집계 및 배급업체로, 몇 달 전 13억 달러의 가치로 자금을 조달했다. Stripe는 OpenRouter를 통해 고객 관계에 집중하고, API 호출의 마진을 최대화하기보다는 저렴한 모델을 찾는 데 초점을 맞출 수 있다. Stripe는 API 호출 라우팅 외에도 고객의 수익성을 관리하는 데 도움을 줄 예정이다.
NVIDIA DSX MaxLPS를 통한 AI 공장 성능 극대화
AI 공장은 전력 제약이 있는 산업 시스템이다. 데이터 센터에 몇 개의 GPU가 들어가는지가 아니라, 각 사용 가능한 메가와트가 얼마나 많은 AI 출력을 제공할 수 있는지가 중요하다. AI 추론 작업의 경우, 애플리케이션 수준의 성능을 와트당 측정하는 것이 AI 공장 효율성을 평가하는 핵심 지표가 된다.
Anthropic, 10월 상장 시 2조 달러 가치 예상
Anthropic의 투자자들은 이 AI 스타트업이 10월에 2조 달러 이상의 가치로 상장될 것으로 예상하고 있다. 이는 SpaceX를 초과하는 수치로, Anthropic의 빠르게 증가하는 수익이 현재 가치를 두 배 이상으로 높일 수 있을 것으로 보인다. 이러한 상장은 초기 투자자들에게 수십억 달러의 이익을 가져올 수 있지만, AI 붐에 대한 공공 시장의 우려를 시험할 것이다.
Google Gemini와 Pixel, 5개 축구 클럽과 협력하여 팬 경험 향상
Google Gemini와 Pixel이 5개 글로벌 축구 클럽과 협력하여 AI와 스마트폰 기술을 통해 팬의 경기일 경험을 향상시키고 있다.
LinkedIn, AI 슬롭 버튼 사용자가 100만 명 이상
LinkedIn은 7월 30일에 'Seems like AI slop' 버튼을 발표했으며, 사용자가 100만 명을 넘었다고 밝혔다. 이 버튼은 게시물의 세 점 메뉴에서 접근할 수 있다. LinkedIn의 최고 제품 책임자 Hari Srinivasan에 따르면, AI 탐지기 Pangram이 LinkedIn의 장문의 41%가 완전히 AI 생성으로 표시되었다고 보고한 이후 몇 주 만에 이 버튼이 도입되었다.
Learn Leap: 개인 자료로 학습하는 AI 튜터
Learn Leap은 사용자가 자신의 자료를 업로드하면 AI 튜터가 이를 바탕으로 가르치는 플랫폼이다. 이 튜터는 사용자의 자료에 대한 전체 맥락을 이해하고 퀴즈, 플래시카드, 시험 등을 만들어 이해도를 테스트할 수 있다. 현재 초기 단계로, 사용자 피드백을 받고 있다.
Meta AI, Mac 전용 앱 출시
Meta가 AI 챗봇을 위한 새로운 Mac 앱을 출시한다고 발표했다. 이 앱은 사용자가 화면에 있는 내용을 기반으로 AI 챗봇과 창을 공유할 수 있으며, 챗봇은 제안, 질문에 대한 답변, 콘텐츠 생성 등을 제공한다. 또한, Mac에서의 Meta AI는 모든 앱에서 음성 인식 기능을 지원한다.
Poolside, NVIDIA에 12억 달러 규모의 역직원 인수 진행
Poolside는 NVIDIA에 12억 달러 규모의 역직원 인수를 진행했다. 이 과정에서 Poolside의 창립자들은 10억 달러를 받고 남아 있으며, 109명의 직원이 NVIDIA로 이직한다. Eiso Kant는 모든 적용 연구 및 엔지니어링 역할을 채용하고 있으며, 115명의 엔지니어와 연구원이 모델 개발에 참여했다고 밝혔다. 현재 AI의 가치가 실험 기반 문제 해결에 더 크게 기여할 것이라고 강조했다.