본문으로 건너뛰기

News

AI 뉴스

매일 수집·정리하는 전세계 AI 소식을 최신순으로

NewsAI 리서치·논문·

Reiner Pope의 칩 설계 강의 및 MatX 소개

Reiner Pope가 기본 논리 게이트부터 시작하여 GPU, TPU, FPGA, 인간 두뇌의 구조까지 설명하는 강의를 진행했다. Reiner는 새로운 칩 스타트업 MatX의 CEO이며, 이전에는 Google에서 소프트웨어 효율성, 컴파일러, TPU 아키텍처에 대해 작업했다. 또한, Crusoe는 SemiAnalysis의 ClusterMAX 보고서에서 금 티어 GPU 클라우드 중 하나로, 동일한 GPU 가격에도 불구하고 5-15% 낮은 총 소유 비용(TCO)을 제공한다. Jane Street와의 대화에서는 AI 사용 및 기술 인재 채용에 대한 의견이 나왔다.

Dwarkesh Podcast원문
NewsAI 툴·

Mistral AI Studio에서 내장 및 사용자 정의 MCP로 기업 데이터 연결

Mistral AI Studio에서는 재사용 가능한 커넥터, 직접 도구 호출, 인간 승인 제어 기능을 통해 기업 데이터를 AI 애플리케이션에 연결할 수 있다.

Mistral AI News원문
NewsAI 에이전트·

Daytona의 AI 에이전트를 위한 컴퓨터 필요성

2026 AI Engineering Survey에 참여하면 $2,000 이상의 크레딧과 AIE WF 티켓을 받을 수 있다. Daytona는 AI 에이전트를 위한 조합 가능한 컴퓨터와 상태 유지 샌드박스를 제공하며, 고객은 하루 약 850,000개의 샌드박스를 운영하고 있다. Daytona는 코드 실행 상자 대신 AI 샌드박스를 제공하기 위해 인프라를 전환했으며, 60ms에 하나의 샌드박스를 시작할 수 있다. 또한, RL/eval 워크로드가 사용량의 약 50%를 차지하게 되었다.

Latent Space: The AI Engineer Podcast원문
NewsAI 에이전트·

MagenticLite, MagenticBrain, Fara1.5: 소형 모델 최적화된 에이전틱 경험

MagenticLite는 브라우저와 로컬 파일 시스템에서 단일 워크플로우로 작동하는 에이전틱 애플리케이션이다. Magentic-UI의 차세대 버전으로, 소형 모델에 최적화된 하네스를 결합하여 설계되었다. MagenticBrain은 계획, 코드 작성 및 위임 기능을 제공하며, Fara1.5는 웹 탐색에서 성능을 두 배로 향상시킨 9억 개의 매개변수를 가진 컴퓨터 사용 모델이다. 이 세 가지 구성 요소는 함께 작동하도록 설계되어 효율적인 에이전트 성능을 제공한다.

Microsoft Research Blog원문
NewsAI 리서치·논문·

AI 컴퓨팅 파워의 대부분은 최전선 연구소에서 사용되지 않음

OpenAI는 2022년 ChatGPT 출시로 AI 붐을 일으켰으며, 2023년 Nvidia의 AI 관련 매출이 4배 증가했다. 2025년 말 OpenAI의 연구, 훈련 및 추론에 사용되는 컴퓨팅 파워는 세계 AI 컴퓨팅 공급의 약 10%에서 15%를 차지할 것으로 추정된다. Anthropic, xAI, Google, Meta의 AI 연구소를 포함하더라도 이들 연구소의 총합은 세계 총량의 절반에도 미치지 않는다. 2025년 말 기준으로 OpenAI, Anthropic, xAI의 총 H100e는 약 400만 개 미만으로 추정된다.

Epoch AI — Benchmarking Hub원문
NewsAI 코딩실전·

Claude Code, 오케스트레이션 스크립트로 수백 병렬 서브에이전트 시대로

Anthropic의 Code with Claude 2026에서 Claude Code의 멀티 에이전트 오케스트레이션이 한 단계 도약했다. 리드 에이전트가 전문 서브에이전트들에게 작업을 위임하고, 각 서브에이전트는 자신만의 모델·프롬프트·도구를 갖되 공유 파일시스템 위에서 병렬로 일한다. 더 나아가 Claude가 단일 세션 안에서 수십에서 수백 개의 병렬 서브에이전트를 돌리는 오케스트레이션 스크립트를 동적으로 직접 작성하고, 결과가 사용자에게 도달하기 전에 스스로 검증한다. 최근 업데이트로는 중첩 서브에이전트(서브에이전트가 또 서브에이전트를 띄움), 스마트한 모델·리전 처리, 플러그인 검색, Chrome·VSCode·터미널 워크플로 개선이 추가됐다. 기본 모델은 Claude Opus 4.8로, high effort가 기본값이고 가장 어려운 작업에는 /effort xhigh를 쓴다. 발표 5종(Dreaming, Outcomes, 멀티 에이전트 오케스트레이션, 사전 제작 에이전트 10종을 갖춘 Claude Finance, Add-ins) 중 코딩 실무와 직결되는 것이 이 오케스트레이션이다.

'서브에이전트를 내가 일일이 구성한다'에서 '모델이 오케스트레이션 스크립트를 스스로 짜고 자가 검증한다'로 넘어간 것이 핵심 변화다. 한국의 1인·소규모 팀이 사람 손 없이 병렬 작업량을 키울 수 있는 직접적 지렛대이며, 동시에 검증 루프(에이전트가 에이전트를 리뷰)를 설계에 내장하지 않으면 환각·회귀가 누적된다는 교훈도 같이 따라온다. effort 파라미터로 비용·품질을 조절하는 감각이 새로운 실무 역량이 된다.

MindStudio원문
NewsAI 프로덕트·스타트업·

Vega: 정부 발급 자격증명으로 개인 정보 보호하며 신원 증명하는 기술

Vega는 사용자가 정부 발급 자격증명(예: 나이, 신원, 직업 상태)을 공개하지 않고도 사실을 증명할 수 있게 해준다. 이 시스템은 100ms 이내에 제로 지식 증명을 생성하며, 모바일 운전면허증 및 EU 디지털 아이덴티티 지갑과 같은 실제 형식을 목표로 한다. Vega는 Rust로 개발되었으며 곧 오픈 소스화될 예정이다. 이 기술은 사용자가 AI 중재 서비스와 상호작용할 때 신뢰를 구축하는 데 필요한 빠르고 개인 정보 보호를 강화한 인증 방법을 제공한다.

Microsoft Research Blog원문
News보안·규제·저작권·

AI를 일반 기술로 보는 관점과 정부 개입의 필요성

Derek Thompson은 AI의 노동 시장 영향이 느리다는 주장에 동의하며, 현재 GDP 성장률과 고용률을 근거로 AI가 일반 기술로서의 특성을 보인다고 언급했다. 그러나 AI의 위험성에 대해서는 비관적인 입장을 취하며, 정부의 '비상' 개입이 필요하다고 주장했다. 그는 AI의 새로운 위험이 기존 기술과 다르다고 강조하며, 정부가 AI를 비정상 기술로 간주하고 규제를 강화해야 한다고 주장했다. 반면, 발췌에서는 정부의 비상 개입이 가져올 부작용과 대안으로서의 회복력 강화를 논의하고 있다.

AI Snake Oil (Narayanan & Kapoor)원문
News생성 이미지·영상·음성·

Stable Audio 3.0 출시, 오픈 웨이트 음악 모델 제공

Stable Audio 3.0이 출시되었으며, 이는 완전 라이센스된 데이터로 훈련된 오픈 웨이트 음악 모델 패밀리이다. 사용자는 Stability AI Community License 또는 연 매출 100만 달러 이상의 조직을 위한 Enterprise License에 따라 생성한 결과물을 소유하고 배포 및 상업화할 수 있다. 주요 기능으로는 최대 6분까지의 가변 길이 생성과 휴대기기에서의 전체 곡 작곡이 포함된다. Stable Audio 3.0 Small과 Medium 모델은 Hugging Face에서 다운로드 가능하며, Large 모델은 Stability AI API를 통해 이용할 수 있다.

Stability AI News원문
NewsAI 모델·API실전·

Cohere Command A+, 첫 완전 Apache 2.0 엔터프라이즈 모델로 H100 2장 구동

Cohere가 2026년 5월 20일 Command A+를 공개했다. 총 218B·활성 25B의 sparse MoE 모델로, 회사 역사상 처음으로 가중치를 완전 Apache 2.0 라이선스로 풀었다. 핵심은 두 가지 엔지니어링 성과다. 첫째, W4A4 무손실 양자화(lossless quantization)로 NVIDIA H100 단 2장에서 풀 모델을 돌릴 수 있게 했다 — 자체호스팅 진입장벽을 크게 낮춘 지점이다. 둘째, 네이티브 인용 생성(native citation)을 모델 차원에서 지원해, RAG 파이프라인에서 별도 후처리 없이 근거 출처를 토큰 레벨로 붙인다. 추론·멀티모달 이해·다국어(48개 언어, 비유럽어 효율 개선 포함)·검색·툴 사용을 단일 모델에 통합한 '에이전트 워크로드용' 포지셔닝이다. 배포는 Cohere API, Microsoft Foundry의 Managed Compute, 그리고 Hugging Face 무료 데모 스페이스로 열렸다. 메시지는 명확하다 — 주권(sovereign) AI, 즉 규제·에어갭·공공 인프라처럼 데이터가 외부로 나갈 수 없는 환경을 정조준했다.

오픈웨이트 + 완전 Apache 2.0 + 인용 네이티브의 조합은 한국의 금융·공공·의료처럼 망분리/감사 요건이 빡빡한 도메인에서 특히 강하다. 'H100 2장이면 돈다'는 건 온프레미스 자체호스팅의 현실적 비용을 처음으로 단일 노드 수준으로 끌어내린 선언이다. RAG에서 인용을 모델이 직접 생성하면 환각 검증·컴플라이언스 로깅 코드를 상당 부분 걷어낼 수 있어, 규제 산업 빌더에겐 DeepSeek/Llama 대안 카드가 하나 더 생겼다.

Cohere / VentureBeat원문
NewsAI 프로덕트·스타트업·

OpenAI, 새로운 음성 인텔리전스 API 기능 출시 및 Claude for Legal 발표

OpenAI는 GPT Realtime 2( GPT-5 기반) 및 실시간 번역, Whisper 전사 기능을 포함한 새로운 음성 인텔리전스 API 기능을 출시했다. Thinking Machines는 두 모델 아키텍처와 맞춤형 추론 스택을 가진 저지연 전이중 대화 시스템을 미리 공개했으며, 강력한 상호작용 벤치마크 결과를 보고했다. Anthropic은 법률 분야를 위한 Claude를 출시하고 AWS와의 파트너십을 확대했다. OpenAI는 자해 위험에 대한 신뢰할 수 있는 연락처 기능을 도입했으며, RL에서 사고의 연쇄적 평가에 대한 조사를 진행하고 있다.

Last Week in AI (Kurenkov & Harris)원문
NewsAI 툴실전·

Cursor 3.5, 격리 VM에서 도는 자율 코딩 클라우드 에이전트 공개

AI 네이티브 에디터 Cursor가 3.5에서 클라우드 에이전트를 핵심 기능으로 내놨다. 격리된 클라우드 VM 안에서 터미널·브라우저·데스크톱 접근 권한을 갖고 작업을 수행해, 로컬 머신을 점유하지 않고도 자율 실행이 가능하다. 앞선 3.0은 백그라운드/클라우드 에이전트를 처음 도입했고, 3.3은 병렬 서브에이전트(Build in Parallel)와 파일 트리 규모의 다중 파일 리팩터링이 가능한 Composer 2.5를 더했다. 과거 Composer로 불리던 에이전트 모드는 복잡한 작업(REST API 구축, 의존성 마이그레이션, 테스트 작성)을 설명하면 계획→파일 생성·수정→터미널 명령 실행→완료까지 반복한다. 여러 팀의 실측에서 표준 구현 작업 기준 30~50% 속도 향상이 보고됐다. 크로스 파일 추론이 강화돼 큰 코드베이스 맥락을 유지하며 변경 전파를 이해한다.

에이전트가 로컬을 벗어나 격리 클라우드에서 도는 방향은 보안·재현성·병렬성 측면에서 팀 단위 도입의 현실적 분기점이 된다.

Codersera
NewsAI 프로덕트·스타트업·

구글, 25년 만에 검색 상자 디자인 개편 발표

구글은 I/O 개발자 회의에서 검색 상자를 AI 기반의 대화형 인터페이스로 개편한다고 발표했다. 새로운 검색 상자는 텍스트, 이미지, PDF, 비디오, 크롬 탭을 입력받을 수 있으며, AI 오버뷰와 AI 모드를 통합하여 사용자 경험을 개선한다. 이 변화는 사용자가 복잡한 질문을 쉽게 할 수 있도록 돕는 AI 기반의 쿼리 제안 시스템을 포함하고 있다. 새로운 검색 상자는 즉시 모든 국가와 언어에서 사용 가능하다.

구글의 검색 상자 개편은 AI 기능 통합을 통해 개발자들이 사용자 인터페이스 설계 시 대화형 경험을 고려해야 함을 시사한다.

VentureBeat — AI원문
NewsAI 코딩중급·

구글 Antigravity 2.0: IDE를 버리고 '에이전트 우선' 개발 플랫폼으로

구글이 2026년 5월 19일 I/O에서 작년 11월 처음 선보였던 Antigravity를 전면 재설계한 2.0을 공개했다. 핵심 전환은 'IDE 안의 어시스턴트'에서 '에이전트 오케스트레이션을 일급 추상으로 둔 독립 데스크톱 앱'으로의 이동이다. 기존 Antigravity IDE와 별개인 독립 데스크톱 앱에 더해 Antigravity CLI, Antigravity SDK, Gemini API의 Managed Agents, 엔터프라이즈용 Gemini Enterprise Agent Platform까지 한 번에 묶어 발표했다. 기본 모델은 Gemini 3.5 Flash로 통일됐다. 무대 데모에서는 병렬 에이전트 군집이 OS 코어를 바닥부터 빌드하고(토큰 비용 1,000달러 미만) 그 위에서 Doom 클론을 라이브로 돌렸다. 단일 코딩 어시스턴트 경쟁에서 벗어나 '멀티 에이전트 워크플로 관리'를 제품의 본질로 재정의했다는 점이 핵심이다. CLI와 SDK를 함께 내놓은 것은 데스크톱 GUI 밖, 즉 CI 파이프라인과 자동화 안에서도 같은 에이전트를 돌릴 수 있게 하려는 포석이다.

구글이 'IDE 보조'가 아니라 '에이전트 오케스트레이터'를 제품의 본질로 못박았다는 점이 신호다. Cursor·Claude Code와 정면 충돌하는 포지셔닝이며, CLI+SDK를 동시 출시한 것은 터미널과 CI 안에서 같은 에이전트를 돌리려는 한국 빌더에게 직접적 선택지가 된다. 기본 모델을 Flash 계열로 깐 것은 병렬 에이전트의 토큰 경제성을 전제로 한 설계라는 점도 주목할 만하다.

MarkTechPost원문
NewsAI 코딩·

코딩 에이전트의 실제 추론 벤치마크 결과

코딩 에이전트의 실제 추론 벤치마크에서 TensorRT-LLM보다 31% 더 높은 TPS를 기록했으며, 포화 상태에서 TTFT는 2배 개선되었고, Claude Opus 4.6보다 76% 낮은 비용을 나타냈다.

Together AI Blog원문
NewsAI 코딩중급·

Cursor Composer 2.5: 자체 코딩 모델로 프런티어 근접 성능을 1/10 비용에

Cursor가 2026년 5월 18일 Composer 2.5를 공개했다. 길고 도구 호출이 많은 IDE 세션을 위해 만든 자체 에이전틱 코딩 모델로, SWE-Bench Multilingual 79.8%, CursorBench v3.1 63.2%로 Opus 4.7(61.6%)을 근소하게 앞서는 프런티어 근접 점수를 냈다. 결정적 포인트는 비용이다. Claude Opus 4.7이나 GPT-5.5 대비 API 비용이 약 1/10 수준이라, 에이전트가 도구를 수십 번 호출하는 long-running 세션의 경제성을 바꿔놓는다. Composer 라인은 2025년 10월 첫 자체 모델로 시작해(유사 지능 모델보다 4배 빠르고 대부분 턴을 30초 안에 완료) Composer 2(2026년 3월, 입력 $0.50/M·출력 $2.50/M)를 거쳐 2.5에 이르렀다. 최신 업데이트에서는 서브에이전트가 다시 서브에이전트를 띄울 수 있고, 리뷰어 서브에이전트가 테스트 작성 서브에이전트에게 위임하는 식의 다단 위임이 가능해졌으며 각 단계가 자신의 프롬프트·모델을 유지한다.

ChatForest원문
NewsAI 리서치·논문·

fast16 악성코드와 Muon 옵티마이저의 문제점

fast16.sys는 고정밀 계산 소프트웨어를 표적으로 삼아 메모리 내 코드를 패치하여 결과를 조작하는 20년 된 컴퓨터 바이러스이다. 이 바이러스는 LS-DYNA 970, PKPM, MOHID과 같은 고정밀 엔지니어링 도구와 관련이 있으며, 물리적 계산에 체계적인 오류를 도입하여 과학 연구를 저해할 수 있다. 한편, Muon 옵티마이저는 훈련 중 일부 뉴런이 영구적으로 손상되는 버그를 가지고 있으며, 이에 대한 대안으로 Aurora라는 새로운 옵티마이저가 개발되었다. Aurora는 1.1B 파라미터 트랜스포머를 훈련시켜 Muon보다 더 낮은 손실을 기록하였다.

fast16과 Muon의 문제는 AI 모델 훈련 및 고정밀 계산 소프트웨어의 신뢰성에 중대한 영향을 미칠 수 있다.

Import AI (Jack Clark)원문
NewsAI 리서치·논문·

DeepSeek, 20일 만에 500억 달러로 평가액 3배 증가

DeepSeek의 평가액이 20일 만에 500억 달러로 3배 증가했다. Zongming She는 DeepSeek이 화웨이와 유사한 사명을 가지고 있으며, 외부 제약에 맞서 국내 역량을 투자해야 한다고 주장했다. DeepSeek V4는 화웨이의 Ascend 칩과의 최적화를 통해 국내 대형 언어 모델과 컴퓨팅 파워 간의 '칩-모델 파트너십'의 역사적인 돌파구를 마련했다고 설명했다. 또한, DeepSeek의 급격한 평가액 증가는 중국의 독립적인 AI 필요성과 관련이 있으며, 중국 통합 회로 산업 투자 기금의 투자 관심이 주요 요인으로 지목되었다.

ChinAI (Jeffrey Ding)원문
NewsAI 툴·

BERTopic과 LLMs를 활용한 블로그 태그 추가

Vicki Boykis는 블로그에 BERTopic과 LLMs를 사용하여 태그를 추가했다. 이 프로젝트는 약 6-10시간 소요되었으며, Claude Code와 Pi를 사용하여 진행되었다. LLMs는 텍스트 요약, 정보 검색, 질문 응답 등에서 뛰어난 성능을 보이며, 태깅 작업에서도 효과적이다.

Vicki Boykis Tech Blog원문
NewsAI 리서치·논문·

DeepSeek V4, Gemma 4, Kimi K2.6 등 오픈 모델 출시 및 CAISI 평가 결과

이번 달 DeepSeek, Gemma, Kimi 등 여러 오픈 모델이 출시되었으며, CAISI는 이들 모델의 평가를 진행했다. CAISI의 평가에 따르면, 오픈 모델은 미국의 최전선 모델에 비해 성능 격차가 점점 더 커지고 있으며, Elo 점수 계산을 통해 이 격차를 확인했다. Gemma 4는 4B, 9B, 31B 모델과 26B-A4B MoE를 포함하며 Apache 2.0 라이센스를 채택했다. DeepSeek V4는 Pro와 Flash 두 가지 크기로 출시되었고, Flash 모델이 상대적으로 좋은 성능을 보이고 있다.

Interconnects (Nathan Lambert)원문
News보안·규제·저작권중급·

EU AI Act GPAI 제재 발효(8월)와 한국 AI 기본법 시행(1월): 규제가 실집행 단계로

2026년 상반기는 AI 규제가 '문서상 의무'에서 '실제 집행'으로 넘어간 분기점이다. EU AI Act의 범용 AI(GPAI) 모델 의무는 2025년 8월부터 법적으로 발효된 상태였지만, 2026년 8월 2일부터 EU AI Office가 정식 집행 권한을 갖는다. 전 세계 연매출의 3% 또는 1,500만 유로 중 큰 금액까지 과징금을 부과할 수 있고, 문서·정보 요청, 모델 평가, 시정·회수 명령 권한이 생긴다. 2025년 8월 이전 출시된 모델은 2027년 8월까지 유예된다. 5월 7일 Digital Omnibus 정치 합의로 이 일정이 그대로 간다는 점이 확인됐다. 한국은 한발 앞서 1월 22일 'AI 기본법'과 시행령이 발효됐다 — 세계 첫 시행 가능한 고영향(high-impact) AI 규제법으로 평가된다. 의료·에너지·공공서비스 등 고영향 영역의 영향평가, 위험관리체계와 인적 감독, 생성형 AI 산출물의 표시(라벨링), 국내 대리인 지정 의무를 담았다. 다만 벌칙 조항 적용은 1년 유예됐다.

규제 텍스트를 읽던 시기는 끝났고, 이제는 '누가 집행하고 얼마를 물리느냐'의 단계다. 한국 빌더는 EU 시장에 모델·기능을 제공하면 GPAI 의무 사정권에 들고, 동시에 국내 AI 기본법의 고영향 영향평가·생성물 라벨링·국내대리인 요건을 1년 유예가 끝나기 전에 제품에 내장해야 한다. 라벨링과 학습데이터 투명성은 출시 직전에 붙이는 게 아니라 설계 단계부터 데이터 계보(provenance)와 함께 가야 재작업을 피한다.

Latham & Watkins / Cooley원문
NewsAI 리서치·논문·

LLM 아키텍처의 최근 발전: KV 공유, mHC, 압축 주의

최근 LLM 아키텍처는 긴 컨텍스트 효율성에 중점을 두고 있으며, KV 캐시 크기, 메모리 트래픽, 주의 비용을 줄이기 위한 다양한 기술이 도입되고 있다. 주요 예로는 Gemma 4의 KV 공유 및 레이어별 임베딩, Laguna XS.2의 레이어별 주의 예산, ZAYA1-8B의 압축 합성곱 주의, DeepSeek V4의 mHC 및 압축 주의가 있다. Gemma 4는 E2B 및 E4B 모델에서 공유 KV 캐시 방식을 채택하여 메모리와 계산을 줄이고 있으며, 이는 긴 컨텍스트 작업을 가능하게 한다.

Ahead of AI (Sebastian Raschka)원문
NewsAI 리서치·논문·

Google DeepMind와 싱가포르, AI를 활용한 복합 문제 해결 파트너십 체결

Google DeepMind와 싱가포르가 건강, 교육, 지속 가능성 등 복합적인 문제를 해결하기 위해 최첨단 AI를 적용하는 파트너십을 체결했다.

Google DeepMind Blog원문
NewsAI 리서치·논문·

Filippo Menolascina, Co-Scientist로 간 질환 치료법 발견

Filippo Menolascina는 Co-Scientist를 사용하여 새로운 간 질환 치료법을 식별하고, 기존 약물이 특정 환자에게만 효과적인 이유를 설명하고 있다.

Co-Scientist의 활용은 간 질환 연구에 대한 새로운 접근 방식을 제시할 수 있다.

Google DeepMind Blog원문