본문으로 건너뛰기

News

AI 뉴스

매일 수집·정리하는 전세계 AI 소식을 최신순으로

NewsAI 코딩·

GitHub Copilot 런타임을 Rust로 마이그레이션

GitHub Copilot CLI, GitHub Copilot 앱, GitHub Copilot SDK는 Copilot 에이전트 런타임에 의해 지원된다. 이 런타임은 원래 TypeScript로 작성되었으나, 이제 Rust로 800,000줄 이상으로 재작성되었다. AI 에이전트가 대부분의 코드를 작성하였으며, 성능이 크게 향상되었다. Copilot 런타임은 Microsoft, GitHub 및 생태계 솔루션을 지원하며, GitHub Copilot SDK를 통해 다양한 제품들이 공통된 런타임을 활용하고 있다.

Copilot 런타임의 성능 향상은 GitHub Copilot SDK를 사용하는 다양한 제품의 안정성과 신뢰성을 높인다.

GitHub Blog원문
NewsAI 에이전트·

AI 에이전트를 활용한 3D 씬 준비 및 검증 방법

Agentic AI 워크플로우는 물리적 AI 시스템을 위한 디지털 트윈을 준비하고 검증하는 데 사용될 수 있다. 에이전트는 3D 씬을 검사하고, OpenUSD에서 시뮬레이션 관련 데이터를 작성하며, 물리적 속성을 추가하고, 사전 비행 뷰를 렌더링하며, 결과를 시뮬레이션 준비(SimReady) 요구 사항에 맞게 검증한다. 이 워크플로우는 Blender의 씬에서 NVIDIA를 위한 시뮬레이션 준비 완료된 OpenUSD로의 전환 과정을 따른다.

NVIDIA Technical Blog원문

Apple, M-series Ultra 칩을 탑재한 AI 서버 개발 중

Apple은 Mac 데스크탑에 사용되는 M-series Ultra 칩을 활용한 AI 서버를 개발하고 있다. 이 서버는 2029년에 출시될 것으로 예상되며, 20년 만에 시장에 출시되는 Apple의 첫 서버가 될 것이다. 이 서버는 두 가지 구성으로 제공될 예정이며, 각각 두 개 또는 네 개의 M8 Ultra 칩을 포함할 것이다. 이 프로젝트는 Apple의 CEO인 John Ternus의 지원을 받으며 시작되었고, AI 개발자들 사이에서 Apple 하드웨어의 인기가 급증하고 있다.

M-series Ultra 칩을 사용하는 AI 서버는 AI 워크로드를 처리하는 데 적합할 것으로 보인다.

Ars Technica — AI원문
NewsAI 툴·

구글의 영상 분석, 이미지 디자인, 시계열 예측 도구 업데이트

구글은 8월 말부터 9월 첫째 주 사이에 영상 분석, 이미지 디자인, 시계열 예측 도구를 업데이트했다. 이 세 가지 도구는 각각의 기능을 단독으로 사용할 수 있지만, 통합하여 활용할 경우 1인 사업의 비용 구조에 영향을 줄 수 있다. 관련 영상은 iampauljames 채널에서 9월 15일에 업로드되었다.

이 세 가지 도구를 통합하여 활용하면 1인 사업의 비용 구조를 변화시킬 수 있다.

AI 코리아 커뮤니티 뉴스레터원문

AI로 제작된 영화 Odysseus: The Fall의 실패

AI 회사 Fountain 0가 제작한 영화 Odysseus: The Fall은 Ash Koosha가 각본과 감독을 맡았으며, 주인공의 모습과 음악도 그가 만들었다. 이 영화는 크리스토퍼 놀란의 오디세이에 대한 관심을 불러일으킨 반면, AI로 제작된 이 새로운 영화는 원작에 대한 부정적인 반응을 초래할 정도로 질이 낮다. Fountain 0의 이전 작품은 올해 트라이베카 영화제에 출품된 Dreams of Violets이다.

The Verge — AI원문
NewsAI 리서치·논문·

Qwen 3.8 27B가 RTX 3090에서 63시간 동안 리만 가설 해결 시도

Qwen 3.8 27B 모델이 100K 컨텍스트 윈도우로 63시간 동안 자율적으로 실행되어 리만 가설을 해결하려고 시도했다. 이 과정에서 5000만 개 이상의 토큰을 처리했으며, 답을 찾지는 못했지만 내부 작업, 메모리 조직, 사용된 전략 등을 보여주었다. 모델은 답을 환각하지 않았고, 여러 번 스스로의 실수를 수정했다. 실험 결과는 Hugging Face에 공개되었다.

r/LocalLLaMA원문

Cloudflare Client-Side Security의 Page Shield ML로 악성 JavaScript 탐지

Cloudflare의 Client-Side Security는 악성 JavaScript를 탐지하기 위해 머신러닝 모델인 Page Shield ML을 사용한다. 이 모델은 실제 트래픽에서 8개의 악성 페이로드를 자동으로 탐지했으며, VirusTotal에서는 7개가 발견되지 않았다. Page Shield ML은 JavaScript를 그래프 구조로 분석하여 의심스러운 패턴을 인식하고, 경량 대형 언어 모델(LLM)을 통해 잘못된 긍정 반응을 줄인다. 또한, 여러 모델을 조합하여 복잡한 스크립트를 분석하고, 결과를 GNN 훈련에 피드백하여 탐지 성능을 향상시킨다.

Page Shield ML은 악성 JavaScript를 실시간으로 탐지하여 보안 위협을 줄이는 데 기여한다.

Cloudflare Blog — AI원문
NewsAI 에이전트·

HCLS 분야의 AI 에이전트 기술 개선을 위한 오픈소스 스킬

AI 에이전트는 헬스케어 및 생명과학(HCLS) 결정 프레임워크를 잘못 적용하는 경우가 많으며, 이는 변이 해석, 청구 심사, 임상 시험 설계 등에 문제를 일으킬 수 있다. 이를 해결하기 위해 11개 HCLS 분야에서 38개의 오픈소스 에이전트 스킬이 제공되며, 이 스킬들은 의사 결정 절차를 구조화된 마크다운 문서 형식으로 인코딩한다. 이 스킬을 활용한 에이전트는 스킬이 없는 에이전트에 비해 70-86%의 승률을 기록하며, 특히 비판적 사고에서 78-85%의 승률을 보인다.

이 스킬들은 HCLS 분야의 의사 결정 절차를 구조화하여 AI 에이전트가 보다 정확한 판단을 내릴 수 있도록 돕는다.

AWS Machine Learning Blog원문
NewsAI 개발·

Amazon EKS에서 NVRx를 이용한 내결함성 분산 훈련

대규모 분산 훈련 작업은 여러 노드에서 수 시간 또는 수일 동안 실행되며, 이 과정에서 네트워크 분할, 메모리 오류, 소프트웨어 예외 등이 발생할 수 있다. NVIDIA Resiliency Extension (NVRx)을 PyTorch Fully Sharded Data Parallel (FSDP) 훈련에 통합하여 비동기 체크포인팅, 프로세스 내 재시작, 작업 내 재시작 기능을 제공한다. Amazon EKS는 관리형 Kubernetes 서비스로, p5.48xlarge 인스턴스에서 NVIDIA H100 GPU를 사용하여 훈련 작업을 수행한다.

NVRx는 PyTorch에 내결함성 기능을 추가하여 훈련 중 발생할 수 있는 오류를 효과적으로 처리할 수 있다.

AWS Machine Learning Blog원문

상원, 양당 AI 안전 법안 논의 진전

상원에서 양당의 AI 안전 법안이 논의되고 있으며, 상원 상무위원회에서 투표가 이루어질 가능성이 제기되고 있다. 상무위원회 의장인 테드 크루즈는 양당 합의가 이루어질 경우 이달 중 법안을 마크업할 수 있다고 밝혔다. 에이미 클로부차 상원의원은 법안의 텍스트를 동료들과 협의 중이며, AI 모델을 정부 전문가에게 제출하고 긴급 위험을 알리는 내용이 포함될 것이라고 말했다. 그러나 법안 통과를 위한 내부 정치와 백악관과의 관계, AI 안전 커뮤니티의 지지가 필요하다는 의견도 있다.

법안은 AI 모델을 정부 전문가에게 제출하고 긴급 위험을 알리는 기능을 포함하고 있다.

Semafor Technology원문

Claude Cowork와 채팅 기능 통합

Claude Cowork와 채팅 기능이 하나의 Claude로 통합되었다. 사용자는 간단한 질문이나 보고서를 전달하면 Claude가 이를 처리한다. 이 통합 기능은 Pro 및 Max 플랜 사용자에게 먼저 제공되며, 웹, 데스크탑, 모바일에서 사용할 수 있다.

Claude가 일반 에이전트로 발전하고 있으며, 이는 사용자 경험을 개선할 수 있다.

Simon Willison's Weblog원문
NewsAI 에이전트·

AIUC, 4000만 달러 시리즈 A 투자 유치 및 AI 채택의 신뢰 문제

AIUC는 4000만 달러의 시리즈 A 투자를 유치했다고 발표했다. AIUC-1은 AI 에이전트의 보안, 안전성 및 신뢰성을 위한 표준으로, AI 에이전트가 탈옥, 환각 및 데이터 유출에 대해 스트레스 테스트를 받는 방식을 설명했다. Rune Kvist는 AI 채택의 주요 제약이 능력이 아닌 신뢰가 될 것이라고 강조하며, AI 시스템에 대한 보험과 표준이 중요해질 것이라고 언급했다.

AIUC-1은 AI 에이전트의 보안 및 신뢰성을 위한 새로운 표준으로, AI 시스템의 보험 가능성을 높일 수 있다.

Latent Space (swyx & Alessio)원문

AI 시대의 로봇 안전 재고

로봇 안전은 전통적으로 기계가 문제가 발생했을 때 안전을 유지할 수 있는지를 질문해왔다. 그러나 물리적 AI는 공격자가 기계의 시각, 결정 또는 행동을 변경했을 때 안전을 유지할 수 있는지를 묻는다. 최근 연구에 따르면, 로봇이 보는 것, 듣는 것, 해석하는 것을 조작함으로써 직접적인 제어 없이도 행동에 영향을 줄 수 있다. 예를 들어, BadVLA는 비전-언어-행동 모델을 겨냥한 백도어 공격으로, 특정 트리거가 있을 때 로봇의 행동 궤적에 조건부 편차를 일으킨다. 또한, UniPwn은 주요 제조업체의 로봇에 영향을 미치는 블루투스 취약점을 공개했다. 이러한 취약점은 로봇의 명령을 조작할 수 있는 기회를 제공한다.

NVIDIA Isaac Sim과 VicOne Radeis를 사용하면 조작된 입력이 로봇 행동에 미치는 영향을 배포 전에 테스트할 수 있다.

IEEE Spectrum — AI원문
NewsAI 에이전트·

Amazon Bedrock AgentCore를 통한 에이전트 시스템 프롬프트 최적화

Amazon Bedrock AgentCore의 최적화 기능을 통해 에이전트의 품질을 개선할 수 있다. 기존의 수동 프로세스 대신, 생산 추적을 사용하여 구성 변경을 제안하고, 오프라인 배치 평가 및 온라인 A/B 테스트를 통해 검증할 수 있다. 시스템 프롬프트 최적화기는 에이전트의 행동을 분석하고 성공적인 실행과 실패를 구분하는 패턴을 찾아 에이전트 구성의 변경을 제안한다.

AgentCore 최적화 기능을 활용하면 에이전트의 품질을 개선하기 위한 데이터 기반의 접근 방식을 적용할 수 있다.

AWS Machine Learning Blog원문

트럼프, AI 위험에 대한 입장 변화

트럼프는 AI와 관련된 발언에서 강력한 대통령의 필요성을 강조하며, AI에 대한 규제가 필요하다고 주장했다. 그는 AI와 데이터 센터에 대한 음모론을 언급하며, 미국이 AI 분야에서 중국을 선도하고 있다고 말했다. 그러나 그의 발언은 상황에 따라 변동성이 크며, AI 모델에 대한 접근 권한이 백악관에 의해 임의로 결정될 수 있음을 시사한다.

트럼프는 AI에 대한 규제를 강조하며, 이는 AI 모델의 시장 접근에 영향을 미칠 수 있다.

Don't Worry About the Vase (Zvi Mowshowitz)원문

NVIDIA Vera Rubin NVL72, MLPerf Inference v6.1에서 우수한 성능 기록

NVIDIA Vera Rubin NVL72는 MLPerf Inference v6.1에서 GB300 NVL72보다 최대 3.7배 높은 처리량을 기록하며 데뷔했다. 288-GPU로 구성된 GB300 NVL72는 99%의 스케일링 효율을 달성했으며, NVIDIA의 소프트웨어 최적화는 v6.0 대비 최대 1.6배 높은 성능을 제공했다. Vera Rubin NVL72는 DeepSeek-R1 및 Qwen3-VL 벤치마크에서 각각 최대 2.5배와 3.7배 높은 처리량을 보였다.

Vera Rubin NVL72는 더 높은 처리량을 통해 더 많은 사용자에게 서비스를 제공하고, 비용 대비 수익을 증가시킬 수 있다.

NVIDIA Blog원문
NewsAI 모델·API·

오픈 웨이트 모델 성능 비교 및 테스트 방법

LLM 제공사의 API 기반 서비스는 개발자가 생성형 AI 애플리케이션을 시작할 때 간단한 방법이지만, 보안 요구가 높은 환경에서는 오픈 웨이트 모델을 직접 구동하는 것이 필요할 수 있다. 테스트는 엔비디아 RTX PRO 6000 GPU 4장을 사용하여 gpt-oss-20b, gpt-oss-120b, Qwen3.8-27B, Gemma4:31b, Mistral-Small-4-119B 모델을 비교하였다. 첫 번째 테스트에서 gpt-oss-20b는 약 250 tokens/s, gpt-oss-120b는 약 184 tokens/s를 기록했으며, Qwen3.8-27B는 약 26 tokens/s, Gemma4:31b는 약 23 tokens/s로 나타났다.

gpt-oss-20b는 단일 요청에서 약 250 tokens/s를 출력하여 성능이 우수함을 보여준다.

요즘IT (Yozm IT)원문
NewsAI 툴·

Sentry와 Grafana를 활용한 사용자 오류 추적 방법

AI로 개발 속도가 빨라지면서 코드와 기능은 증가했지만 안정성은 따라오지 못하고 있다. 이를 해결하기 위해 Sentry와 Grafana를 도입하여 각각 실패와 성공을 체크하고 있다. Sentry는 화면 오류와 서버 5xx 에러를 모니터링하며, Grafana는 API 요청의 성공률과 핵심 시나리오의 전환율을 확인한다. 이 두 도구를 통해 사용자 경험을 개선하고 문제의 원인을 파악하는 데 도움을 주고 있다.

Sentry는 화면 오류와 서버 에러를 추적하고, Grafana는 API 요청의 성공률을 모니터링하여 사용자 경험을 향상시킨다.

요즘IT (Yozm IT)원문
NewsAI 리서치·논문·

Emerald AI, Google, NVIDIA가 전력 유연성을 위한 AI 에너지 관리 동맹(AEMA) 출범

Emerald AI, Google, NVIDIA는 AI 에너지 관리 동맹(AEMA)을 출범했다. AEMA는 데이터 센터가 전력망 조건에 따라 전력 사용을 동적으로 관리할 수 있도록 지원하는 첫 번째 연합이다. 이 동맹은 전력 유연성을 통해 AI 인프라의 연결 속도와 규모를 확대하고, 기존 인프라에서 더 많은 전력을 효율적으로 사용할 수 있도록 하여 환경 영향을 줄이는 것을 목표로 한다. AEMA는 기술 중립적이며 성과 기반의 요구 사항을 설정하고, 전력망과의 협력을 통해 AI 인프라의 신뢰성을 높이는 데 중점을 둔다.

AEMA는 데이터 센터가 전력망과 협력하여 전력 사용을 조정할 수 있는 능력을 통해 AI 인프라의 효율성을 높일 수 있다.

NVIDIA Blog원문
NewsAI 리서치·논문·

AI 발전을 위한 소재 혁신의 중요성

AI의 발전은 반도체와 데이터 센터의 물리적 한계에 도달하고 있으며, 이에 따라 고급 소재의 수요가 증가하고 있다. Syensqo는 고전압 데이터 센터 아키텍처와 반도체 제조를 위한 고급 밀봉 소재, 직접 침수 냉각을 위한 열 관리 솔루션을 개발하고 있다. AI는 소재 과학자들이 수백만 개의 분자 조합을 디지털 합성하고, 성능과 지속 가능성을 예측하여 실험실 테스트를 위한 소규모 그룹으로 좁히는 데 사용되고 있다. 이러한 과정은 소재 혁신의 사이클을 가속화하고 있다.

Syensqo는 AI 인프라를 개선하는 소재를 개발하고 있으며, 이는 AI의 발전을 가속화할 수 있다.

MIT Technology Review — AI원문
NewsAI 모델·API·

TypeSafe의 System One 모델, 기존 LLM보다 100배 빠르고 200배 저렴

TypeSafe가 발표한 System One 모델은 기존의 작은 최전선 LLM보다 100배 더 빠르고 200배 더 저렴하다고 전해진다. 이 모델은 코드 작성이나 추론을 하지 않지만, 병렬 샘플링, 환각 없음, 보정 기능을 제공하며, RLCD(보정된 결정) 방식으로 훈련되었다.

System One 모델은 기존 LLM과의 보완성을 강조하며, 빠른 결정 및 분류 기능을 통해 특정 작업에서 효율성을 높일 수 있다.

Latent Space (swyx & Alessio)원문

AI 네이티브 세계를 위한 CRM 재구성

a16z의 Alex Rampell과 Joe Schmidt는 Lightfield의 공동 창립자이자 CEO인 Keith Peiris와 AI 네이티브 세계를 위한 CRM 재구성에 대해 논의했다. Keith는 이전에 2,500만 사용자를 보유한 Tome을 개발했으나, 기술이 발표자와 청중 간의 관계를 충분히 포착하지 못한다고 판단하고 제품에서 물러났다. 이후 그의 팀은 AI 프레젠테이션에서 영업 워크플로우로 고객을 추적하며 회사의 이메일, 통화, CRM 등에서 분산되고 상충하는 데이터를 이해하는 문제를 발견했다. 이들은 Lightfield의 '비즈니스 세계 모델' 개념과 AI가 충분한 맥락을 가질 때 전통 소프트웨어의 경직된 스키마를 대체할 수 있다는 Keith의 신념에 대해 이야기했다.

AI + a16z원문
NewsAI 에이전트·

SpaceX AI의 Grok Bot과 Meta의 Muse가 ChatGPT 시장 점유율에 미치는 영향

SpaceX는 2026년 8월 14일 Cursor를 600억 달러에 인수하였고, Grok Bot이라는 자율 AI 에이전트 플랫폼을 개발하였다. Grok Bot은 Cursor의 유료 구독 계획에 포함되어 있으며, Meta의 Muse와 함께 ChatGPT의 사용량을 감소시킬 가능성이 있다. Muse는 2026년 9월 8일에 출시되었고, 초기 채택이 빠르게 이루어지고 있다. Grok Bot은 B2C와 B2B 모두에서 강력한 지원을 제공하며, AI가 유틸리티와 도우미 역할을 수행하는 방향으로 발전하고 있다.

Grok Bot은 Cursor의 유료 구독 계획에 포함되어 있어, 사용자들이 ChatGPT 대신 Grok Bot을 선택할 가능성이 있다.

AI Supremacy (Michael Spencer)원문

미국 의회 의원들, AI 규제 필요성 인식하지만 사용 경험 부족

미국 의회 의원들과 주지사들은 AI 규제의 필요성을 느끼고 있으나, 2십여 명의 의원들은 AI를 사용해본 경험이 거의 없다고 밝혔다. 특히, 고령의 영향력 있는 의원들이 이러한 입장을 보이고 있으며, 이로 인해 AI의 빠른 변화와 그에 따른 위협을 이해하는 데 어려움이 있다는 비판이 제기되고 있다. 일부 의원들은 AI 사용 경험이 없다고 답변했으며, 일부는 팀원들이 AI를 사용하지만 자신은 사용하지 않는다고 말했다. 반면, 일부 의원들은 매일 AI를 사용한다고 밝혔다.

AI 규제에 대한 논의가 활발해지고 있으나, 실제로 AI를 사용해본 경험이 부족한 의원들이 많아 규제의 실효성에 의문이 제기된다.

Axios — Technology원문