News
AI 뉴스
매일 수집·정리하는 전세계 AI 소식을 최신순으로
Orderful, 공급망 데이터 관리 효율화를 위한 3500만 달러 투자 유치
Orderful Inc.는 공급망 효율성을 높이기 위해 인공지능을 활용하는 스타트업으로, 3500만 달러의 자금을 확보했다고 발표했다. 이번 시리즈 C 라운드는 Koch Disruptive Technologies가 주도하고 NewRoad Capital이 참여했다. 이번 투자로 Orderful의 총 외부 자금은 8500만 달러에 이른다.
YC가 제시한 AI 시대의 좋은 아이디어 조건
Y Combinator의 Jon Xu는 AI 시대의 좋은 아이디어는 실질적인 문제 해결을 목표로 해야 하며, 구체적인 실행 가능성을 갖추어야 한다고 강조했다. 또한, 아이디어가 실제로 사용될 수 있는 환경에서 검증되어야 한다고 언급했다. 이러한 조건들은 AI 기반 스타트업의 성공 가능성을 높이는 데 중요한 요소로 작용할 것이다.
Anthropic, Slack에서 Claude Tag로 대체하여 항상 켜져 있는 AI 동료 제공
Anthropic은 기존 Claude in Slack 앱을 종료하고, 항상 켜져 있는 대안인 Claude Tag를 도입한다고 발표했다. Claude Tag는 조직의 Slack 인스턴스에 '팀원'으로 참여하여 관리자가 결정한 채널과 도구, 데이터, 코드베이스에 접근할 수 있다. 사용자는 채널 내에서 @Claude를 태그하여 다양한 작업을 위임할 수 있으며, Claude Tag는 환경에 대한 맥락을 구축하고, 코드 작성, 제품 메트릭 추적, 지원 티켓 처리 등의 작업을 수행할 수 있다. 기존의 Claude-Slack 커넥터는 8월 3일에 서비스 종료되며, Enterprise 및 Teams 고객은 오늘부터 Tag에 접근할 수 있다. Tag는 채널 내에서 상호작용하는 모든 사용자와 동일한 Claude를 공유하며, 사용자가 매번 설명할 필요 없이 장기적으로 학습한다.
Claude Tag의 도입은 Slack 내에서 팀원처럼 협력할 수 있는 AI 도구를 제공하여 개발자들이 작업을 보다 효율적으로 위임하고 관리할 수 있게 한다.
llm-d를 활용한 AI 모델의 추론 속도 향상
연구자들은 llm-d를 사용하여 AI 모델의 추론 속도를 최대 5배 향상시키고 처리량을 두 배로 증가시킬 수 있음을 보여주었다. 이 과정에서 이종 GPU를 활용하였다.
GitHub Copilot 앱을 통한 업무 자동화로 리더십 향상
GitHub의 한 선임 이사는 GitHub Copilot 앱을 사용하여 업무 자동화를 통해 효율성을 높였다고 전했다. 이 앱은 macOS, Windows, Linux에서 사용할 수 있으며, 여러 저장소에서 병렬 세션을 실행하고, 실시간으로 작업을 시각화할 수 있는 기능을 제공한다. 그는 40개의 자동화를 설정하여 매일 회의 준비, 접근 권한 확인, 중요 메시지 선별 등을 자동으로 처리하고 있으며, 이를 통해 아침 시간을 절약하고 업무의 맥락을 파악하는 데 도움을 받고 있다고 밝혔다.
로버트 라이트, AI를 인류의 '신 테스트'로 설명
Nonzero의 로버트 라이트가 AI를 단순한 기술적 도전이 아닌 인류의 '신 테스트'로 설명하며, 딥러닝의 진화적 관점에서 모델 간의 선택 시장을 논의했다. 그는 소비자, 기업, 정부가 비제로섬 협력을 강화하는 AI를 선택할지, 아니면 최악의 유인을 반영하고 증폭하는 시스템으로 나아갈지를 결정하는 것이 중요하다고 강조했다.
AI 모델 선택이 비즈니스와 사회적 협력에 미치는 영향을 이해하는 것이 중요하다.
Meta의 AI 시스템 오류와 Craft Conference 키노트 요약
Craft Conference에서 발표된 키노트 'Slow Down to Speed Up'에서는 Meta의 AI 시스템에서 발생한 심각한 오류 사례가 언급되었다. Meta AI가 사용자에게 이메일 주소 변경을 허용하는 'zero auth' 정책으로 인해 전직 미국 대통령의 계정이 탈취되는 사건이 발생했다. 이 사건은 AI가 생성하고 검토한 코드와 보안 및 품질 관리 팀의 인력 감축이 원인으로 지적되었다. 최근 6개월간 AI 에이전트의 발전과 함께 소프트웨어 품질 저하, 팀 생산성 정체 등의 경향이 나타나고 있다.
Meta의 사례는 AI 시스템의 보안과 품질 관리가 소홀해질 경우 심각한 결과를 초래할 수 있음을 보여준다.
SNOW의 Automatic Sharding 기술 소개
네이버의 NAVER ENGINEERING DAY 2026에서 Automatic Sharding 기술이 소개되었다. 이 기술은 수천 개의 서비스가 한정된 GPU 자원을 효율적으로 공유할 수 있도록 하며, 모델 로딩 오버헤드를 제거하여 AI 모델 서빙의 속도와 안정성을 향상시킨다. 발표 내용에는 SNOW AI 콘텐츠 서빙 구조, Manual Sharding의 한계, Automatic Sharding 알고리즘 설계 및 배포 전략 등이 포함된다.
Automatic Sharding 기술은 GPU 환경에서 AI 모델 운영 자동화를 고민하는 개발자들에게 유용한 솔루션이 될 수 있다.
Josh Elman, a16z 합류와 소비자 기술의 미래
Josh Elman은 LinkedIn, Facebook, Twitter, Robinhood, Discord, Musical.ly, TikTok, Apple 등 주요 소비자 기술 제품과 회사에 기여한 경험을 바탕으로 소비자 AI와 기술의 진화에 대해 논의했다. 대화에서는 AI가 새로운 소비자 제품 세대를 여는 방법, 발견과 유통의 변화, 그리고 창립자들이 이전 플랫폼 변화에서 배울 수 있는 점에 대해 다루었다. Elman은 소비자 기술에서 여전히 탐색되지 않은 기회와 함께 유지율, 네트워크 효과, 제품-시장 적합성에 대한 자신의 견해를 공유했다.
AI가 새로운 소비자 제품 세대를 여는 방법에 대한 논의는 개발자들이 향후 소비자 기술의 방향성을 이해하는 데 도움이 된다.
nexos.ai와 Codex의 새로운 기능 소개
nexos.ai는 100개 이상의 AI 모델에 접근할 수 있는 통합 플랫폼으로, 사용자가 가장 적합한 AI를 자동으로 선택해준다. Codex는 반복적인 워크플로우를 보여주면 이를 재사용 가능한 기술로 변환하는 기능을 제공한다. Claude Code는 HTML 페이지를 공유할 수 있는 아티팩트를 지원하며, OpenAI는 GPT-5.5-Cyber의 새로운 버전을 통해 사이버 보안 프로그램을 확장하고 있다.
NVIDIA Agent Toolkit을 통한 전문화된 AI 구축
기업들은 워크플로우에 맞는 전문화된 AI 구축 방법을 모색하고 있다. NVIDIA Agent Toolkit은 사용자 맞춤형 모델, 도구 및 안전한 실행 환경을 제공하여 기업과 개발자가 신뢰할 수 있는 디지털 AI 동료를 구축할 수 있도록 지원한다. 이 툴킷은 NVIDIA Nemotron 오픈 모델과 BioNeMo Toolkit을 포함해, 생명과학, 의료, 사이버 보안 등 다양한 분야에서 AI 에이전트의 활용을 가속화하고 있다. 예를 들어, CrowdStrike는 98.5%의 정확도로 경고를 분류하는 전문 보안 에이전트를 운영하고 있으며, Cadence와 Synopsys는 칩 설계 및 엔지니어링 워크플로우를 위한 자율 에이전트를 개발하고 있다.
OpenAI, Appia Foundation을 통해 고급 AI의 공동 기준 구축 지원
OpenAI는 Appia Foundation을 통해 고급 AI에 대한 공동 기준을 구축하고, 평가 프레임워크, 안전 관행 및 글로벌 협력을 지원하고 있다.
뉴욕시 선거일과 FiveThirtyEight 폐쇄 소식
오늘은 뉴욕시에서 선거일로, NY-12 지역의 등록된 민주당원은 Alex Bores에게 투표할 마지막 날이다. FiveThirtyEight는 ABC와 디즈니에 의해 완전히 폐쇄되었으며, Nate Silver는 브랜드 관리에 대한 비판으로 인해 매각이 거부되었다고 전했다. 또한, 텍사스 BBQ 레스토랑들이 고기 가격 상승으로 인해 폐쇄되고 있으며, 도매 가격이 100% 상승했음에도 불구하고 가격 변화가 크지 않다는 혼란이 있다.
AI가 감정을 인식하는 방식의 발전과 한계
AI 시스템이 대화 중 감정을 분석하는 방식에 대한 내용이다. 'Emotion AI'는 얼굴 표정, 목소리 톤, 행동을 기반으로 감정을 추정하며, NiCE와 Genesys 같은 기술 콜센터 플랫폼이 고객의 감정 상태를 감지해 실시간으로 에이전트에게 대응을 조정하도록 돕고 있다. 그러나 현재 대부분의 시스템은 특정 감정을 하나만 감지하는 데 집중하고 있어 인간의 복잡한 감정을 이해하기에는 부족하다. 새로운 연구 분야인 'human-context AI'는 개인의 성격과 감정을 실시간으로 추적하고 여러 입력을 결합하여 환경에 맞는 반응을 평가하는 방향으로 발전하고 있다.
2026년 AI 발전 단계와 2030년대의 중요성
2026년 AI는 언어 기반 생성 AI 모델이 사회에서 유용해지기 위해 많은 조건이 충족되어야 하는 awkward stage에 있다. 기술의 한계로 인해 물리적 및 인간 세계를 더 잘 이해하기 위해서는 더 많은 자금 지원이 필요하다. 2030년대와 2040년대는 진정한 다중 스펙트럼 AI의 통합 컴퓨팅 패러다임을 개발하는 데 중요한 시기로 예상된다.
NVIDIA, 세계 500대 슈퍼컴퓨터 중 400대 이상 운영
NVIDIA 기술은 TOP500의 81%와 새로 추가된 시스템의 90%를 차지하며, 26개의 시스템이 NVIDIA Grace CPU를 채택했다. Green500에서 1위인 KAIROS는 NVIDIA Grace Hopper Superchip을 사용하고, TOP500의 376개 시스템이 NVIDIA 네트워킹으로 연결되어 있다. NVIDIA는 AI, 시뮬레이션 및 과학을 위한 시스템 구축에서 선호되고 있으며, NVIDIA 시스템은 AI 훈련과 추론 성능에서 다른 플랫폼의 두 배 이상을 제공한다. JUPITER는 유럽에서 가장 빠른 슈퍼컴퓨터로, 인간 뇌를 세포 수준에서 매핑하고 있으며, 새로운 NVIDIA Blackwell 아키텍처를 기반으로 한 시스템들이 아시아, 유럽, 미국에서 순위에 진입하고 있다.
NVIDIA의 기술 채택은 한국의 AI 및 고성능 컴퓨팅 분야에서 경쟁력을 높이는 데 중요한 요소가 될 것이다.
Vibecode 앱, 사이트 및 게임 소개
Vibecode는 다양한 앱, 사이트 및 게임을 제공하는 플랫폼이다.
NVIDIA, 통신 운영을 위한 신뢰할 수 있는 24/7 AI 에이전트 도입
통신 운영자들은 네트워크 관리, 고객 서비스 및 백오피스 운영을 자동화하기 위해 생성 AI를 사용하여 상당한 성과를 보고하고 있다. NVIDIA는 TM Forum의 DTW Ignite 2026에서 자율 네트워크를 위한 AI 에이전트를 시연하고 있으며, SoftBank Corp.는 NVIDIA NeMo Safe Synthesizer와 NeMo Anonymizer를 사용하여 개인 정보 보호가 가능한 합성 데이터셋을 생성하고 있다. AdaptKey는 자율 5G 네트워크 운영을 위한 보안 강화된 장기 에이전트를 시험하고 있으며, Amdocs는 고객 지원을 위한 자율 에이전트의 잠재력을 보여주고 있다.
토스 커머스 도메인에서의 지식 관리 기준과 자동화 도입
토스의 커머스 도메인에서 Technical Writer 황동진은 문서화의 중요성을 강조하며, AI를 활용한 자동화 시스템을 도입하여 문서 초안을 생성하는 방법을 설명했다. 커머스 위키는 AI가 제품 변경 공지와 질의응답 결과를 바탕으로 문서 초안을 작성하고, 이를 팀원들이 검토하여 승인하는 구조로 변화했다. 그러나 문서의 신뢰성과 관리 기준이 부족해 여전히 문제가 발생하고 있으며, 이에 따라 '커머스 문서·지식 거버넌스'를 제안하고, 지식 관리 기준을 설정하였다.
토스, AI를 활용한 Technical Writer 자동화 계획
토스의 Technical Writing Partner 김혜빈은 AI를 통해 Technical Writer(TW)의 역할을 자동화하겠다는 목표를 세웠다. 현재 TW는 3명으로, 약 4천 명의 인원에 비해 문서 리뷰 부담이 크다. 이를 해결하기 위해 TW의 문서 작성 및 리뷰 프로세스를 AI에게 넘기고, AI가 테크니컬 라이팅 원칙을 기반으로 문서를 작성하고 리뷰하도록 Skill을 개발했다. 사내 메신저와 GitHub에서 AI가 자동으로 문서 작업을 수행할 수 있도록 시스템을 구축했다.
AI를 통해 문서화 작업의 효율성을 높이고, 개발자들이 더 이상 TW와 일정을 조율하지 않아도 되도록 하여 업무 흐름을 개선할 수 있다.
LLM 평가 패널의 신뢰성 분석
LLM-as-a-judge 패널은 여러 모델의 투표를 집계하여 신뢰성 있는 평가를 기대하지만, 9개의 최전선 LLM 모델이 3개의 자연어 추론 데이터셋에서 테스트한 결과, 9명의 판사가 제공하는 정보는 약 2개의 독립적인 투표에 해당하는 것으로 나타났다. 패널의 명목상 독립성의 약 75%가 상관 오류로 인해 저하되었다.
이 연구는 LLM 평가의 신뢰성을 높이기 위한 모델 선택 및 평가 방법론에 대한 중요한 통찰을 제공한다.
ParallelKernelBench: LLM이 다중 GPU CUDA 커널 작성 성능 테스트
ParallelKernelBench는 LLM이 87개의 실제 워크로드에 대해 빠른 다중 GPU CUDA 커널을 작성할 수 있는지를 테스트한다. 가장 성능이 좋은 모델은 3분의 1 이하의 문제를 해결했지만, 일부 생성된 커널은 공개 구현보다 더 나은 성능을 보였다.
LLM의 다중 GPU 커널 작성 능력에 대한 실질적인 성능 평가가 이루어져, 향후 개발에 참고할 수 있는 기준이 될 수 있다.
ChaosNLI 데이터셋을 활용한 NLI 모델의 레이블 분포 학습
주석자가 레이블에 대해 의견이 일치하지 않을 경우, 그 불일치 자체가 신호를 전달하며, 이를 포착하기 위해 필요한 주석자 수는 평가 지표에 따라 달라진다. 연구에서는 ChaosNLI 데이터셋에서 100명의 독립적인 주석자 판단을 기반으로 레이블 분포에 대해 NLI 모델을 미세 조정하고, 메트릭 의존적인 포화 현상을 확인하였다. 3-class NLI 설정에서 엔트로피 상관관계는 모델이 불일치를 유발하는 항목을 식별하기 위해 약 20~50명의 주석자가 필요하며, 분포 일치(KL 발산)는 약 10명에서 포화된다.
NLI 모델의 성능 향상을 위해 필요한 주석자 수를 이해하는 것은 효율적인 데이터 수집 및 모델 학습 전략 수립에 도움이 된다.
Sakana, Fugu 다중 에이전트 모델 출시 및 OpenAI Daybreak 소프트웨어 보안 확장
Sakana가 Fugu라는 단일 API 다중 에이전트 모델을 출시했다. OpenAI는 소프트웨어 보안을 위해 Daybreak를 확장했다. AI 인프라 부채와 전력 거래가 가속화되었으며, Five Eyes는 최전선 사이버 모델에 대해 경고했다. Getty는 OpenAI와 디스플레이 계약을 체결했다.