본문으로 건너뛰기

News

AI 뉴스

매일 수집·정리하는 전세계 AI 소식을 최신순으로

NewsAI 리서치·논문·

IBM Granite Libraries와 Project Granite Switch 소개

IBM은 LLMs에 소프트웨어 공학의 엄격성과 모듈성을 도입하기 위해 IBM Granite Libraries와 Project Granite Switch를 발표했다.

IBM Research Blog원문
NewsAI 툴·

Canvas의 Design Mode와 Context Usage Report 기능 추가

Canvas를 통해 대시보드, 보고서, 내부 도구를 만들 수 있으며, 이번 릴리스에서는 빠른 편집을 위한 Design Mode와 컨텍스트 사용을 이해하는 새로운 방법이 추가되었다. Design Mode에서는 UI 요소를 직접 선택하고 주석을 달아 Cursor의 편집을 안내할 수 있으며, 텍스트로 설명하는 대신 직접 지적하고 피드백을 제공할 수 있다. 또한, Cursor는 에이전트의 컨텍스트 사용을 인터랙티브한 보고서로 표시할 수 있으며, 컨텍스트 탐색기를 통해 시스템 프롬프트, 도구 정의, 규칙, 기술 등에서 토큰의 흐름을 분석할 수 있다. 공유된 Canvas는 브라우저에서 전체 화면으로 열 수 있으며, 에이전트가 클릭 시 특정 프롬프트를 실행하는 버튼을 삽입할 수 있는 기능도 추가되었다.

이 기능들은 개발자가 Canvas를 통해 더 효율적으로 팀과 협업하고, 에이전트의 성능을 최적화하는 데 도움을 줄 수 있다.

Cursor (Anysphere) Changelog원문
NewsAI 툴·

Cursor SDK의 TypeScript 및 Python SDK 기능 업데이트

Cursor SDK는 TypeScript 및 Python SDK에 새로운 기능을 추가했다. 이제 사용자는 에이전트와 실행 메타데이터의 저장 방식을 선택할 수 있으며, 사용자 정의 함수를 도구로 에이전트에 노출하고, 자동 검토를 통해 로컬 도구 호출을 라우팅할 수 있다. 또한, 서브 에이전트를 중첩하여 사용할 수 있으며, SQLite 대신 JSONL 저장소를 선택할 수 있다. 이 업데이트는 신뢰성, 성능 및 플랫폼 개선 사항도 포함되어 있다.

Cursor (Anysphere) Changelog원문
NewsAI 리서치·논문·

Ali Behrouz, Cornell 대학원생의 지속적 학습을 위한 새로운 AI 아키텍처 연구

Cornell 대학원생이자 Google 연구원인 Ali Behrouz는 AI의 지속적 학습을 위한 새로운 아키텍처에 대한 연구를 논의했다. 그의 논문 'Nested Learning'은 Jeff Dean에 의해 패러다임 전환 가능성이 있는 작업으로 평가받으며, 모델이 핵심 지식을 보존하면서 새로운 맥락에 적응할 수 있도록 서로 다른 레이어를 서로 다른 주기로 업데이트하는 방식을 제안한다. 이 연구는 인간의 기억 시스템에서 영감을 받았으며, AI의 '수면'을 통한 기억 통합, 모든 딥러닝을 연상 기억으로 보는 관점, 지속적 학습이 프라이버시, 정렬, AGI로 가는 길에 미치는 심오한 함의에 대해서도 다룬다.

The Cognitive Revolution원문
NewsAI 에이전트·

Build 2026: Microsoft Foundry의 AI 에이전트 관찰 가능성 및 ROI 향상

2026년 6월 3일, Microsoft Foundry는 AI 에이전트의 관찰 가능성을 확장하여 모든 프레임워크에서 ROI를 향상시키는 기능을 발표했다. 주요 기능으로는 모든 에이전트를 관찰할 수 있는 상호 운용성, 품질 및 안전 평가, 실시간 문제 감지, 최적화 기능이 포함된다. Foundry의 생산 등급 추적 및 평가 기능은 LangChain, OpenAI SDK 등 다양한 프레임워크에 적용 가능하며, Azure Developer CLI에 통합되어 개발자가 손쉽게 사용할 수 있다. 또한, 사용자 시뮬레이션 기능을 통해 실제 사용자와의 대화를 모사하여 에이전트를 테스트할 수 있다.

Microsoft Foundry Blog (Azure AI)원문
NewsAI 리서치·논문·

Axiom, Putnam 시험에서 12/12 점수 달성

2025년, Axiom은 7개월 된 스타트업으로 Putnam 시험에서 12문제를 모두 해결하며 8/12 점수를 기록했다. 이는 최고의 학부생보다 높은 점수이며, DeepSeek의 103/120보다도 우수하다. Axiom CEO Carina Hong은 코딩 능력이 AGI로 가는 길에서 필요하지만 충분하지 않다고 언급하며, 'Verified AI'의 중요성을 강조했다. Axiom은 Verina 벤치마크에서 99%의 ProofGen 성과를 달성했으며, 이는 OpenAI의 4.9%와 비교해 매우 높은 수치이다.

Latent Space: The AI Engineer Podcast원문
News커리어·채용·

Kelsey Hightower의 경력과 Kubernetes의 발전

Kelsey Hightower는 DSL 모뎀 설치 기술자에서 Google의 저명한 Distinguished Engineer로 성장한 인물이다. 그는 오픈 소스 작업과 강연을 통해 현대 인프라에서 영향력 있는 목소리를 내고 있으며, Kubernetes의 발전과 클라우드 컴퓨팅의 중요한 시기에 Google에서의 경험을 공유했다. Hightower는 기술이 궁극적으로 사람을 위한 것임을 강조하며, 기술을 통해 의미 있는 문제를 해결하는 것이 목표라고 주장했다.

Kubernetes는 클라우드 컴퓨팅에서 중요한 역할을 하며, Hightower의 경험은 개발자들이 기술을 통해 사람들의 문제를 해결하는 데 집중해야 함을 시사한다.

The Pragmatic Engineer (Gergely Orosz)원문
NewsAI 프로덕트·스타트업·

Microsoft Build에서 Satya Nadella의 AI 생태계 플랫폼 전략

Satya Nadella는 Microsoft Build에서 Microsoft를 '프론티어 인텔리전스 플랫폼'으로 포지셔닝하며, 고객이 Microsoft 생태계에서 더 많은 가치를 얻어야 한다고 강조했다. 그는 MAI 모델의 훈련 전략에 대해 언급하며, 데이터 품질과 클린 리니지를 통해 기업들이 AI를 활용할 수 있는 방법을 제시했다. Nadella는 AI 생태계의 복잡성을 인정하며, 기업들이 AI를 통해 가치를 창출할 수 있는 경로를 찾는 것이 중요하다고 말했다.

Latent Space: The AI Engineer Podcast원문
NewsAI 프로덕트·스타트업·

Azure Translator의 문서 번역 기능 확장

Microsoft Build에서 Azure Translator의 Document Translation 기능이 확장되어 이미지 파일의 동기 및 비동기 번역, PDF의 배치 번역 기능이 추가되었다. 동기 이미지 번역 기능은 이미지 파일을 직접 받아 실시간으로 번역된 이미지를 반환하며, 비동기 배치 이미지 번역은 Azure Blob Storage에 저장된 이미지 파일을 처리하여 번역된 이미지를 타겟 컨테이너에 저장한다. PDF의 배치 번역은 Azure AI Document Intelligence를 활용하여 레이아웃 유지 및 복잡한 구조 처리를 개선하였다.

이 업데이트는 기업들이 다양한 형식의 콘텐츠를 보다 효율적으로 번역할 수 있도록 지원하여, 고객 지원 및 현지화 작업의 품질을 향상시킬 수 있다.

Microsoft Foundry Blog (Azure AI)원문
NewsAI 에이전트·

Microsoft Autopilot의 첫 번째 에이전트 Scout 발표

Microsoft는 Autopilot이라는 새로운 에이전트를 소개하며, 첫 번째 에이전트인 Scout를 발표했다. Scout는 사용자의 작업을 이해하고 자동으로 작업을 수행하는 '항상 켜져 있는 에이전트'로, Teams, Outlook, OneDrive, SharePoint와 연결되어 작동한다. Scout는 회의 일정을 자동으로 조정하고, 중요한 회의를 강조하며, 마감일을 인식해 사용자의 캘린더를 관리할 수 있다. 현재 Scout는 제한된 고객 그룹에게만 접근 가능하다.

Scout는 개발자들이 작업을 자동화하고 효율성을 높일 수 있는 새로운 도구를 제공한다.

The Register — AI/ML원문
NewsAI 프로덕트·스타트업·

Microsoft Foundry에서 오픈 모델을 위한 Managed Compute 발표

Microsoft Foundry에서 Managed Compute를 발표했다. 이는 가상 머신, Kubernetes 클러스터, 모델 런타임의 운영 부담 없이 오픈 소스 AI 모델을 커스터마이징하고 제공할 수 있는 관리형 플랫폼이다. 사용자는 Hugging Face 파트너십을 통해 수천 개의 오픈 소스 모델에 접근하고, 감독 학습이나 강화 학습으로 커스터마이즈할 수 있으며, 다른 곳에서 훈련한 모델 가중치를 안전하게 배포할 수 있다. Managed Compute는 Foundry의 세 가지 배포 유형 중 오픈 소스 및 커스터마이즈 모델을 위한 전용 GPU 용량을 갖춘 유형이다.

Microsoft Foundry Blog (Azure AI)원문
NewsAI 에이전트·

Foundry Agent Service의 에이전트 최적화기 소개

Foundry Agent Service에서 에이전트 최적화기를 소개하며, 이는 호스팅된 에이전트를 정의된 기준에 따라 평가하고 더 나은 구성을 생성하여 결과를 순위 매기는 기능을 제공한다. 최적화기는 클라우드에서 실행되며, azd ai agent optimize 명령어로 시작할 수 있다. 에이전트의 성능을 향상시키기 위해 시스템 프롬프트, 기술 및 도구를 자동으로 수정하고, 결과는 점수로 정렬되어 최적의 구성을 배포할 수 있다. 최적화 과정은 몇 분 내에 완료되며, 추가 인프라를 필요로 하지 않는다.

Microsoft Foundry Blog (Azure AI)원문
NewsAI 에이전트·

Foundry Agent Service의 절차적 메모리 기능 및 관리 경험 개선

Foundry Agent Service는 절차적 메모리 기능을 도입하여 에이전트의 신뢰성을 향상시킨다. 이 기능은 성공적인 실행 패턴을 유지하고 재사용하여 복잡한 작업 흐름을 더 신뢰성 있게 수행할 수 있도록 돕는다. 새로운 메모리 관리 경험을 통해 개발자는 저장된 메모리를 직접 확인하고 관리할 수 있으며, 메모리 TTL(Time-to-Live) 설정, 멀티모달 지원, 직접 메모리 명령 기능이 추가되었다. 또한, Microsoft Agent Framework에 파일 기반 메모리 지원이 추가되어 개발자가 간편하게 시작하고 확장할 수 있는 경로를 제공한다.

Microsoft Foundry Blog (Azure AI)원문
NewsAI 툴·

Microsoft Foundry의 Toolboxes 및 Routines에서의 새로운 기능 발표

Microsoft Foundry에서 Toolboxes의 새로운 기능으로 Skills(미리보기), Work IQ(미리보기), Fabric IQ(미리보기), Browser Automation(미리보기), Tool Search(미리보기)가 발표되었다. Skills를 통해 재사용 가능한 기능을 관리하고, Work IQ와 Fabric IQ는 기업 데이터에 대한 접근을 제공하여 실제 비즈니스 컨텍스트에서 작동할 수 있게 한다. Browser Automation은 Playwright 작업 공간을 사용하여 웹 자동화를 지원하며, Tool Search는 런타임에서 가장 관련성 높은 도구만을 검색하여 모델의 컨텍스트를 효율적으로 유지한다. Routines(미리보기)는 Foundry Agent Service의 일부로 에이전트 실행 제어를 담당한다.

Microsoft Foundry Blog (Azure AI)원문
NewsAI 에이전트·

Microsoft Foundry의 에이전트 배포: Microsoft 365 Copilot 및 Teams와의 통합

Microsoft Foundry는 에이전트를 Microsoft 365 Copilot과 Teams에 직접 게시할 수 있는 기능을 제공하며, 이는 다음 달에 일반 제공될 예정이다. Autopilot 에이전트는 자율적으로 작동하며, 사용자 계정을 통해 팀과 협력할 수 있다. Foundry Workstream Manager는 Teams 그룹 채팅에서 작업을 관리하고, 대화 요약, 마감일 추적, 업데이트 조정 등의 기능을 제공하는 에이전트로, 사용자 맞춤형으로 설정할 수 있는 코드 샘플이 제공된다.

Microsoft 365 Copilot과 Teams에 에이전트를 통합함으로써 조직 내에서 일상적인 작업을 보다 효율적으로 수행할 수 있다.

Microsoft Foundry Blog (Azure AI)원문
NewsAI 툴·

Google Search의 AI 도구로 중고 및 빈티지 쇼핑 지원

Google Search와 Shopping에서 AI 도구를 활용하여 중고 상품을 발견할 수 있는 방법을 소개한다.

AI 도구를 통해 중고 쇼핑의 효율성을 높일 수 있는 기회를 제공한다.

Google AI Blog원문
NewsAI 모델·API실전·

DeepSeek V4 Pro, 1M 컨텍스트 오픈웨이트 코딩 모델로 NIST 독립 평가까지

DeepSeek이 4월 24일 V4 프리뷰(deepseek-v4-flash·deepseek-v4-pro)를 공개한 뒤 5월 8일 전면 개정 버전을 출시했고, V4 Pro는 '5월의 가장 화제가 된 AI 릴리스'로 꼽혔다. 가장 큰 변화는 1M 토큰 컨텍스트 윈도로, 거대 코드베이스 전체를 한 번에 처리하도록 코딩 최적화된 라인업을 갖췄다. 주목할 점은 NIST 산하 CAISI(AI 표준·혁신 센터)가 5월 2일 V4-Pro에 대한 독립 평가를 발표했다는 것이다 — 사이버, 소프트웨어 엔지니어링, 자연과학, 추상추론, 수학 전반을 다뤘다. 오픈웨이트 진영에서 미국 정부 기관의 공식 평가 대상이 됐다는 점 자체가 신뢰도·역량 양면의 신호다. V4 Pro는 코딩·시스템 레벨 프로그래밍 벤치마크에서 다른 프론티어 모델과 견줄 만한 성능을 보였고, 공개 가중치 + 1M 컨텍스트 + 낮은 토큰 단가 조합으로 자체 호스팅 코딩 에이전트 구축의 비용 효율을 끌어올렸다.

오픈웨이트 모델이 미국 정부 표준기관(NIST CAISI)의 공식 평가 대상이 됐다는 건 '오픈 = 미검증'이라는 통념이 깨지고 있다는 뜻이다. 한국 팀에게 V4 Pro는 데이터 주권·비용이 중요한 사내 코딩 에이전트를 폐쇄 API 대신 자체 호스팅으로 구축할 수 있는 현실적 선택지가 된다. 1M 컨텍스트로 모노레포 전체를 컨텍스트에 올리는 워크플로가 오픈웨이트에서도 가능해졌다.

SitePoint / NIST CAISI원문
NewsAI 프로덕트·스타트업·

Cursor Enterprise, 다중 팀 관리 기능 제공

Cursor Enterprise 고객은 이제 하나의 장소에서 여러 팀을 관리할 수 있으며, 각 팀에 대해 보안, 거버넌스, 예산 및 기능 제어를 다르게 설정할 수 있다. 조직은 회사의 정체성과 관리, 멤버십을 위한 최상위 컨테이너로, 관리자는 전체 Cursor 설정을 한 곳에서 관리할 수 있다. 팀은 부서, 지역 또는 자회사의 운영 단위로, 사용자는 여러 팀에 속할 수 있으며 각 팀에서 다른 역할을 가질 수 있다. 그룹은 팀 간 또는 팀 내에서 사용자들의 경량 컬렉션으로, 별도의 모델 접근, 지출 한도 및 에이전트 권한을 제공한다.

Enterprise 고객은 이제 조직 수준에서 사용자 관리 및 분석을 통해 팀 간의 이동을 쉽게 할 수 있다.

Cursor (Anysphere) Changelog원문
NewsAI 에이전트·

GitHub의 AI 시대 도전과 변화에 대한 Kyle Daigle 인터뷰

Kyle Daigle는 GitHub의 COO로서 AI가 코드 생성 및 기업 운영 방식에 미치는 영향을 논의하였다. AI 코딩 에이전트의 사용이 2026년까지 1400% 증가할 것으로 예상되며, 이는 GitHub의 인프라에 큰 압박을 가하고 있다. GitHub은 기존의 워크플로우를 통해 AI를 도입하고 있으며, AI가 코드 요약, 커뮤니케이션, 마케팅 및 분석 작업을 변화시키고 있다고 전했다. 또한, GitHub Actions와 Copilot의 발전, AI가 오픈 소스 기여 방식에 미치는 영향에 대해서도 언급하였다.

Latent Space: The AI Engineer Podcast원문
News커리어·채용·

Nathan Lambert, Ai2 퇴사 및 Olmo 모델 작업 회고

Nathan Lambert가 Allen Institute for AI(Ai2)에서 퇴사하며 Olmo 모델 작업에 대한 회고를 남겼다. 그는 Ai2에서의 경험이 자신의 성장에 큰 영향을 미쳤으며, 연구 환경과 팀워크의 중요성을 강조했다. Lambert는 Ai2가 학계와 산업의 중간에서 AI 기술을 탐구하고 영향을 미치는 독립적인 목소리가 필요하다고 언급했다. 그는 앞으로도 이 분야에서 활동할 것이라고 밝혔다.

Interconnects (Nathan Lambert)원문
NewsAI 모델·API·

Claude Opus 4.8 출시, 동적 워크플로우 지원

Claude Opus 4.8이 출시되었으며, 이제 복잡한 작업을 처리하기 위해 하위 에이전트를 병렬로 실행하는 오케스트레이션 스크립트를 작성할 수 있다. Simon Willison은 이 업데이트가 불확실성에 대해 더 솔직해졌고 코드의 결함을 놓칠 가능성이 줄어들었다고 평가했다. 내부 엔지니어 벤치마크에서 GPT-5.5와 경쟁력을 보이며, ARC-AGI-3에서 5.5의 점수를 세 배로 초과했다.

Claude Opus 4.8은 복잡한 작업을 처리하는 데 있어 동적 워크플로우를 지원하여 개발자들이 더 효율적으로 작업을 수행할 수 있게 한다.

Ben's Bites (Ben Tossell)원문
NewsAI 코딩중급·

GitHub Copilot 데스크톱 앱 공개, worktree 격리로 다중 에이전트 병렬 실행

GitHub이 Microsoft Build 2026(6월 2일)에서 Copilot 데스크톱 앱을 테크니컬 프리뷰로 공개했다. Windows 11·macOS·Linux용 독립 앱으로, 여러 AI 에이전트 세션을 동시에 돌리는 '컨트롤 센터'를 표방한다. 핵심은 아키텍처다. 각 에이전트 세션이 자체 git worktree(브랜치 격리 복사본)에서 실행되어, 여러 에이전트가 같은 레포를 병렬로 건드려도 서로의 변경을 덮어쓰지 않는다. worktree 생성·정리는 앱이 자동 관리한다. 단일 'My Work' 뷰에서 활성 세션·이슈·PR·백그라운드 자동화를 한눈에 추적하고, Canvas 인터페이스로 에이전트 작업을 들여다보거나 방향을 재지정할 수 있다. Agent Merge가 CI 상태·리뷰어를 모니터링하며 PR 워크플로를 관리하고, 클라우드/로컬 샌드박스 실행, 커스텀 에이전트 스킬, LaunchDarkly·PagerDuty·Sonar 등 파트너 에이전트 앱 연동도 포함된다. 같은 날 Copilot SDK가 GA로 전환됐고, Copilot CLI는 JetBrains IDE 지원·에이전트 피커·디버그 패널을 추가했다.

병렬 에이전트의 최대 난제였던 '같은 레포 동시 편집 충돌'을 worktree 격리라는 정공법으로 푼 점이 핵심이다. 이는 Claude Code의 멀티 세션, Cursor 클라우드 에이전트와 같은 방향으로, 2026년 코딩 도구 경쟁축이 '단일 에이전트 품질'에서 '다중 에이전트 오케스트레이션'으로 확실히 이동했음을 보여준다. 한국 개발팀은 worktree 기반 격리 패턴을 자체 CI/리뷰 파이프라인에 먼저 도입해 두면, 어느 벤더 앱을 쓰든 병렬 에이전트 전환 비용을 줄일 수 있다.

The GitHub Blog원문
News생성 이미지·영상·음성중급·

Microsoft, 음성·전사·이미지 생성까지 자체 학습한 MAI 7종 일괄 공개

Microsoft AI가 6월 2일 자체 개발한 MAI 모델 7종을 한꺼번에 공개했다. 추론 모델 MAI-Thinking-1(체급 내 SWE·수학 강세), GitHub Copilot·VS Code에 통합되는 50억 파라미터 코딩 모델 MAI-Code-1-Flash, 이미지 생성·편집 모델 MAI-Image-2.5와 초경량 변형 Flash, 43개 언어를 경쟁 모델 대비 5배 빠르게 전사하는 MAI-Transcribe-1.5, 15개 언어 음성 합성·보이스 적응 MAI-Voice-2와 저비용 Flash 변형이 포함된다. Microsoft는 추론 모델을 '처음부터(from scratch)' 학습하며 '다른 랩에서 증류(distill)하지 않는다'고 명시했고, 데이터셋이 '깨끗하고 추적 가능하며 엔터프라이즈 등급'이라고 강조했다. 차세대 GB200 클러스터가 가동 중이라고 밝혔다.

Microsoft AI원문
NewsAI 모델·API실전·

Alibaba Qwen 3.7, 화면 보고 코드 짜는 멀티모달 에이전트 플래그십

Alibaba Qwen 팀이 6월 2일 Qwen3.7-Plus를 Bailian 플랫폼에 출시했다. 텍스트·이미지·비디오를 입력받아 시각 인지와 GUI 조작, 자율 코딩을 하나의 루프에서 결합하는 멀티모달 에이전트 모델로, 비전·심층추론·툴 호출·자율 반복을 갖췄다. 앞서 5월 20일 Alibaba Cloud Summit에서는 Qwen 3.7 Max를 발표했다 — 1M 컨텍스트, 추론 네이티브, 폐쇄 가중치의 DashScope API 전용 에이전트 우선 플래그십이다. 라인업 흐름을 보면 2월 16일 Qwen3.5(397B-A17B MoE, 201개 언어, 이전 세대 대비 8.6~19배 처리량), 4월 Qwen 3.6 두 차례(35B-A3B MoE → 27B 덴스), 5~6월 3.7 Max/Plus로 빠르게 진화했다. 전용 코딩 모델 Qwen3-Coder 480B(480B 총/35B 활성, 7.5조 토큰·70% 코드)는 에이전틱 코딩 벤치마크에서 Claude Sonnet 4와 동급으로 평가됐다. 덴스(0.6B~32B)와 MoE를 Apache 2.0로 폭넓게 오픈하면서, 플래그십(3.7 Max)은 폐쇄·API 전용으로 분리하는 하이브리드 전략을 굳혔다.

MarkTechPost / Alibaba원문