News
AI 뉴스
매일 수집·정리하는 전세계 AI 소식을 최신순으로
Anthropic, OpenAI보다 먼저 비공식 IPO 제출
Anthropic이 비공식 IPO 제출을 통해 OpenAI보다 먼저 AI 역사상 가장 큰 IPO를 가속화할 것으로 보인다. 2023년 9월 또는 10월에 이루어질 예정이다. AI 스타트업들은 자금 집중으로 인해 어려움을 겪고 있으며, PitchBook 데이터에 따르면 미국의 857개 유니콘 스타트업 중 절반이 최근 3년간 자금을 조달하지 못했다. AI는 기존 스타트업에 큰 영향을 미치고 있으며, 2021년에 마지막으로 자금을 조달한 스타트업은 평균 68% 가치가 하락했다.
자기 홍보 스레드: 개인 프로젝트 및 협업 요청 게시
사용자는 개인 프로젝트, 스타트업, 제품 배치, 협업 필요, 블로그 등을 이 스레드에 게시할 수 있다. 제품 및 서비스에 대한 결제 및 가격 요구사항을 언급해야 하며, 링크 단축기, 링크 집계 웹사이트, 자동 구독 링크는 게시할 수 없다. 신뢰 남용 시 계정 정지 조치가 있을 수 있으며, 커뮤니티가 이 실험을 원치 않을 경우 종료될 수 있다.
MiniMax-M3의 효율적 추론을 위한 KV-block-major 희소 주의 메커니즘
Together는 MiniMax-M3의 효율적 서비스를 위해 KV-block-major 희소 주의 메커니즘, 페이지 기반 MSA 디코드, 최적화된 인덱스 스코어링, Rust 기반의 멀티모달 게이트웨이를 활용했다.
이 기술들은 대규모 데이터 처리와 멀티모달 AI 시스템 개발에 있어 성능 향상을 가능하게 한다.
Anthropic, IPO를 위한 기밀 S-1 양식 제출
Anthropic이 미국 증권거래위원회에 기밀 S-1 양식을 제출하며 IPO를 준비하고 있다. 최근 시리즈 H 자금 조달에서 650억 달러를 완료해 기업 가치는 9,650억 달러에 달하며, 이는 OpenAI의 8,520억 달러 가치를 초과한다. Anthropic은 수익성이 있는 첫 분기를 보고할 가능성이 있지만, 재무 상태는 IPO 제출이 공개될 때까지 정확히 평가할 수 없다.
Anthropic의 IPO 준비는 AI 스타트업의 재무 투명성에 대한 논의를 촉발할 수 있다.
Google I/O 2026을 위한 AI 활용 사례
Google I/O 2026을 제작하는 데 AI가 어떻게 사용되었는지에 대한 내용을 다룬다.
AI를 활용한 이벤트 제작 과정은 개발자들에게 AI 도구의 실제 적용 사례를 보여준다.
Ethan He가 설명하는 Grok Imagine과 비디오 에이전트의 미래
Ethan He는 NVIDIA Cosmos World Model에서 xAI로 이동하여 Grok Imagine을 3개월 만에 개발했다. 그는 비디오 모델이 LLM에서 주로 지능을 얻고 있으며, 다음 단계는 LLM과 상호작용 모델에 집중해야 한다고 주장했다. 비디오 생성의 다음 진화는 계획, 생성, 편집, 비판 및 반복을 수행할 수 있는 시스템이 될 것이라고 언급했다. Grok Imagine 0.9와 대규모 오디오-비디오 생성에 대한 논의도 포함되었다.
미국 AI 경제, 2025년 2500억 달러 예상
미국의 AI 경제는 연간 2,600% 성장할 것으로 예상되며, 2025년에는 약 2500억 달러에 이를 것으로 보인다. 그러나 기존 GDP 통계에서는 이러한 성장이 잘 드러나지 않고 있으며, AI의 경제적 영향은 주로 AI 추론 사용에서 발생하고 있다. AI 컴퓨팅 지출은 2023년 370억 달러에서 2024년 900억 달러, 2025년 2190억 달러로 증가할 것으로 예상된다. AI의 품질 조정 출력은 2024년에 약 2,290%, 2025년에 2,271% 성장할 것으로 보인다.
AI 모델 생태계의 경제적 균형: 폐쇄형 모델의 프리미엄과 API 비즈니스의 쇠퇴
2026년 초는 AI 산업에 중요한 시점으로, 코딩 에이전트가 높은 프리미엄을 지불할 시장을 보여주고 있다. 폐쇄형 모델을 제공하는 연구소들은 최고의 모델을 보호하기 위해 API 출시를 지연시키고, 높은 마진을 유지할 것이다. 현재 Anthropic과 OpenAI가 가장 효율적인 모델을 만들고 있으며, 향후 5-10년 내에 이들 기업은 2-10조 달러의 가치를 가질 것으로 예상된다.
CANN의 발전과 Huawei Ascend 칩의 활용 사례
CANN은 현재 '청소년기'로 전환되었으며, 개발자들이 독립적으로 문제를 해결하고 코드 기여를 시작하고 있다. AIGCode는 Ascend 칩을 사용하여 7B 규모의 Mixture-of-Experts 모델을 사전 훈련하는 과정에서 65%의 Model Flops Utilization을 달성했으며, 이는 업계 평균의 거의 두 배에 해당한다. 또한, 한 상장 은행은 AI를 핵심 리스크 관리 프로세스에 직접 통합했다고 발표했다.
Nathan의 개인 AI 인프라: Daniel Miessler의 감사
Daniel Miessler는 Nathan의 개인 AI 인프라를 논의하며, 1GB 데이터베이스를 가진 Claude Code 인스턴스와 독립적으로 일정 관리, 커뮤니케이션, 프로젝트를 처리하는 두 개의 자율 AI '직원'을 소개했다. 또한, AI-인간 상호작용의 사회적 규범, '이상적인 상태'를 AI와 공유하는 이유, 그리고 'Bitter Lesson engineering' 개념을 설명했다. Mercury는 가상 카드, 지출 한도, 상인/카테고리 잠금 기능을 제공하며, Sequence는 복잡한 가격 책정을 위한 전체 수익 워크플로우를 처리한다. Claude는 연구, 작문, 코딩, 조직을 지원하는 AI 협업 도구이다.
2026년 상반기 프런티어 모델 지형: Opus 4.8·GPT-5.5·Gemini 3.1의 분업 구도
2026년 들어 주요 연구소가 차세대 플래그십을 연달아 공개했다. Anthropic은 Claude Opus 4.8을, OpenAI는 GPT-5.5를, Google은 100만 토큰 멀티모달 컨텍스트를 갖춘 Gemini 3.1 Pro를, xAI는 Grok 4.3을 내놓았다. 종합 지능 지표에서는 Opus 4.8이 근소하게 선두를 지키지만 흥미로운 점은 단일 1위가 아니라 작업별로 강점이 갈린다는 것이다. 코딩은 Opus 4.8과 GPT-5.5가 접전이고, 추론·데이터 분석은 Gemini 3.1 Pro, 창작은 GPT-5.5, 비용 대비 에이전트·툴 사용은 Grok이 우위를 보인다는 평가가 나온다. 한국 개발자에게 시사점은 명확하다. "제일 좋은 모델 하나"를 고정하기보다 작업 유형·예산·지연 요구에 따라 모델을 라우팅하는 멀티모델 아키텍처가 합리적 기본값이 되고 있다.
단일 SOTA 모델 의존에서 작업별 모델 라우팅으로 설계 패러다임이 바뀌고 있어, 프로덕션 아키텍처 결정에 직접 영향을 준다.
컨텍스트를 격리해 노이즈를 다스리는 서브에이전트 패턴 입문
서브에이전트는 메인 에이전트가 집중된 하위 작업을 처리하기 위해 띄우는 별도 에이전트 인스턴스다. 각자 맞춤 시스템 프롬프트, 전용 도구 집합, 그리고 독립된 컨텍스트 윈도우를 가진다. 덕분에 노이즈가 많은 작업의 컨텍스트를 격리하고, 여러 분석을 병렬로 돌리며, 특화된 지침을 적용할 수 있다. Claude Code에서는 에이전트와 서브에이전트의 파일 형식이 동일하다. 둘 다 YAML 프론트매터를 가진 마크다운 파일이며, 프로젝트 단위는 `.claude/agents/`, 사용자 단위는 `~/.claude/agents/`에 둔다. 코드베이스 관례에 의존하는 워크플로는 프로젝트 단위가, 이식 가능한 습관은 사용자 단위가 적합하다. 판단 기준은 간단하다. 작업이 시끄럽고 경계가 분명하며 요약하기 쉬우면 서브에이전트를 쓰고, 작고 긴밀히 결합돼 공유 멘탈 모델에 의존한다면 메인 대화에 머물러라(요약을 거치면 맥락이 약해지기 때문).
구직 및 채용 공고 템플릿 안내
채용 공고를 올릴 때는 '[Location], Salary:[], [Remote | Relocation], [Full Time | Contract | Part Time] 및 [Brief overview, what you're looking for]' 형식을 사용해야 한다. 구직자는 '[Location], Salary Expectation:[], [Remote | Relocation], [Full Time | Contract | Part Time] Resume: [Link to resume] 및 [Brief overview, what you're looking for]' 형식을 따라야 한다. 이 커뮤니티는 경험이 있는 사람들을 위한 공간이다.
Google AI Studio를 활용한 I/O 2026 퀴즈 제작
Google AI Studio를 사용하여 I/O 2026의 주요 발표에 대한 퀴즈를 제작했다.
Don Lincoln의 고에너지 물리학 연구와 팟캐스트 정보
Don Lincoln은 Fermilab의 입자 물리학자로, 고에너지 물리학의 최전선에서 수십 년간 연구해왔다. 팟캐스트에서는 자연의 법칙 통합, 아인슈타인의 상대성 이론, 전자약력, 입자 충돌기의 작동 원리, 힉스 보존 발견, 모든 이론, 빈 공간의 물리학, 반물질, 암흑 에너지, 암흑 물질, 물리학의 미래에 대해 논의한다. 팟캐스트 관련 링크와 연락처 정보도 제공된다.
Cursor의 새로운 자동 검토 실행 모드
Auto-review는 Cursor가 승인 프롬프트를 줄이고 안전하게 실행할 수 있도록 하는 새로운 실행 모드이다. 이 모드는 Shell, MCP, Fetch 도구 호출에 적용되며, 허용된 호출은 즉시 실행되고 샌드박스에서 실행 가능한 호출은 샌드박스에서 실행된다. 나머지 에이전트 작업은 분류기 서브 에이전트로 전달되어 호출을 허용할지, 다른 접근 방식을 시도할지, 또는 사용자의 승인을 요청할지를 결정한다. 실행 모드는 **Settings > Cursor Settings > Agents > Approvals & Execution**에서 구성할 수 있으며, 분류기 에이전트에 사용자 정의 지침을 제공하여 방향을 조정할 수 있다.
Auto-review 모드는 Cursor의 실행 효율성을 높이고 사용자 승인 과정을 간소화할 수 있다.
Together AI, 세계에서 가장 빠른 음성 인식 스택 구축
Together AI는 ASR을 GPU 추론 문제로만 보지 않고 전체 경로 시스템 문제로 다루어 세계에서 가장 빠른 음성-텍스트 변환 스택을 구축했다.
Cognition의 Walden Yan과 OpenInspect의 Cole Murray, 비동기 에이전트 시대의 변화
AIEWF 웹사이트가 오픈되었으며, CFP 마감이 2일 남았다. AI 엔지니어링 설문조사에 참여하면 2천 달러 이상의 크레딧과 무료 AIE WF 티켓을 받을 수 있다. 비동기 에이전트 시대가 도래하면서, 개발자들은 이제 에이전트를 배경에서 작동하게 하여 소프트웨어 개발을 보다 효율적으로 진행할 수 있다. Cognition의 Walden Yan은 OpenInspect의 Cole Murray와 함께 비동기 에이전트의 발전과 'spec to pull request' 워크플로우의 실현 가능성에 대해 논의하였다. 또한, Devin의 7배 PR 성장과 16%에서 80%로의 커밋 비율 증가에 대해 설명하였다.
2026 NAVER Engineering Day, 전 직군 참여 확대
네이버는 매년 봄과 가을에 Engineering Day를 개최하여 200개 이상의 기술 세션을 공유하며 서로의 기술과 경험을 나누고 있다. 2026년에는 AI 도구의 발달로 전 직군이 참여할 수 있는 행사로 확장되어 약 150개의 온라인 기술 세션과 AI 도구 핸즈온 워크숍, 외부 초청 연사 세션 등이 진행된다. 마지막 날에는 다양한 직군이 팀을 이뤄 해커톤을 통해 현업의 문제를 해결하는 활동도 포함된다. D2 채널을 통해 약 20개의 기술 세션 영상이 6월부터 순차적으로 공개될 예정이다.
2026 NAVER Engineering Day는 AI 도구의 활용을 통해 전 직군의 기술 경험을 공유하는 기회를 제공한다.
Data Formulator 0.7: 기업 데이터 분석을 위한 AI 기반 오픈소스 시스템
Data Formulator 0.7은 데이터 연결, 에이전트 안내 탐색, 시각화 개선을 결합한 오픈소스 AI 기반 기업 데이터 분석 시스템이다. 이 시스템은 데이터 커넥터 기능을 포함하여 데이터베이스, 데이터 웨어하우스, BI 시스템, 객체 저장소 및 로컬 파일 간의 재사용 가능한 연결을 지원하며, 통합 작업을 줄인다. 컨텍스트 인식 에이전트는 데이터 준비, 분석 탐색, 시각화 생성 및 복잡한 분석 워크플로우를 지원한다. 사용자는 SQL이나 프로그래밍 전문 지식 없이도 여러 데이터 소스에서 분석을 반복적으로 탐색하고 개선할 수 있다.
Ben Tossell, Magic Path를 통해 인터랙티브 컴포넌트 생성
Ben Tossell은 인터랙티브 컴포넌트를 만들기 위해 Magic Path를 사용하여 디자인 자산과 애니메이션을 생성하는 작업을 진행하고 있다. 그는 다양한 스타일을 실험하고 있으며, Magic Path의 무료 플랜을 빠르게 소진한 후 프로 플랜에 가입했다.
Magic Path를 통해 여러 에이전트가 디자인 자산을 생성할 수 있어, 개발자들이 효율적으로 컴포넌트를 제작할 수 있는 방법을 제공한다.
Vibe, Work 및 Code 모드로 출시
Vibe는 장기 생산성과 코딩을 위한 통합 에이전트로, Work 및 Code 모드와 함께 출시되었다. 또한 새로운 Vibe VS Code 확장 기능이 추가되었다.
Anthropic, Fast 모드 대폭 인하한 Claude Opus 4.8 공개
Anthropic이 2026년 5월 28일 Claude Opus 4.8을 공개했다. API 모델 ID는 claude-opus-4-8이며 기본 단가는 입력 100만 토큰당 $5, 출력 $25로 이전 세대와 동일하게 유지됐다. 주목할 변화는 Fast 모드 단가가 입력 $10·출력 $50로 떨어져 직전 세대 대비 약 3배 저렴해진 점이다. 코딩·에이전트 작업·전문 업무 성능이 강화됐고, 결함을 그냥 지나칠 확률이 약 4분의 1로 줄었다고 한다. Claude Code에는 한 세션에서 수백 개의 서브에이전트를 병렬로 돌리는 동적 워크플로우가 들어갔고, claude.ai와 Cowork에서 사용자가 직접 추론 강도(effort)를 고를 수 있게 됐다. Opus 4.8·4.7과 Sonnet 4.6은 추가 요금 없이 100만 토큰 컨텍스트를 지원한다.
Apple, CVPR 2026에서 연구 발표
Apple은 2026년 6월 3일부터 7일까지 덴버의 콜로라도 컨벤션 센터에서 열리는 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR)에 참석하여 새로운 연구를 발표할 예정이다. Apple은 이 회의를 후원하며, 컴퓨터 비전 및 패턴 인식 분야의 과학 및 산업 연구 커뮤니티를 한자리에 모으는 행사이다.