본문으로 건너뛰기

News

AI 뉴스

매일 수집·정리하는 전세계 AI 소식을 최신순으로

NewsAI 프로덕트·스타트업·

Apple, 유럽에서 Siri AI 출시하지 않기로 결정

Apple은 WWDC에서 발표한 바와 같이, 유럽에서 Siri AI를 출시하지 않을 것이라고 밝혔다. 이는 유럽 규제 기관과의 갈등, 특히 디지털 시장 법안과 관련된 문제 때문이다. 또한, 메모리 칩 시장과 중국의 관계에 대한 우려가 제기되고 있으며, Microsoft는 중국 모델을 사용하는 데에 큰 유인이 있다고 전해졌다.

Stratechery (Ben Thompson)원문
News보안·규제·저작권·

가나 디지털 전환을 위한 GitHub와 UNDP의 오픈소스 평가

가나의 통신부(MoCDTI)는 디지털 전환을 위해 오픈소스 소프트웨어를 채택하고 있으며, 이를 위해 UNDP와 GitHub 정책팀이 OSPORA 평가를 실시했다. 이 과정에서 MoCDTI, 국가 IT 기관, Kofi Annan-India Center of Excellence 등 다양한 이해관계자와 인터뷰 및 워크숍을 진행했다. 가나는 디지털화에 대한 정치적 의지와 오픈소스 경험이 풍부한 주체들이 있으나, 오픈소스에 대한 중앙집중적 정책 부족, 부처 간 조정 문제, 자원이 부족한 IT 팀 등의 과제가 남아 있다.

가나의 오픈소스 채택 사례는 한국 정부와 기업이 오픈소스를 효과적으로 도입하기 위한 정책 및 협력 체계를 구축하는 데 참고할 수 있다.

GitHub Blog원문
NewsAI 프로덕트·스타트업·

월스트리트가 Intel을 AI 데이터 센터에 투자하는 이유

발췌에서는 Intel의 Xeon 프로세서와 메모리 대역폭, 저렴한 GPU를 언급하며, 월스트리트 투자자들이 Intel을 'AI의 도구'로 고려하는 이유에 대한 의문을 제기하고 있다. 누가 Intel을 AI 데이터 센터에 구매하고 있는지에 대한 질문도 포함되어 있다.

r/LocalLLaMA원문
NewsAI 코딩·

MirrorCode 출시 및 AI 연구 동향

MirrorCode가 METR와 공동 개발되어 출시되었으며, 이는 AI의 자율 코딩 능력을 측정하기 위한 장기 벤치마크이다. MirrorCode는 25개의 실제 프로그램을 재구성하는 작업을 AI 모델에 부여하며, 이 작업은 소스 코드 접근 없이 진행된다. 가장 어려운 프로그램은 인간 엔지니어가 AI 도움 없이 완료하는 데 몇 주에서 몇 달이 걸릴 것으로 예상된다. MirrorCode의 한 작업은 19일 동안 AI가 인간 개입 없이 작업을 수행하며 2,600달러의 비용이 소요되었다. 또한, 1,604개의 중국 AI 기업의 채용 공고 분석 결과, 이들 기업은 서로 다른 전략을 가지고 있는 것으로 나타났다.

MirrorCode는 AI 모델이 실제 소프트웨어 엔지니어링 작업을 수행할 수 있는 능력을 평가하는 중요한 도구가 될 것이다.

Epoch AI — Benchmarking Hub원문
NewsAI 모델·API·

NVIDIA Nemotron 3 Ultra NVFP4 체크포인트 생성과 모델 최적화

모델의 컨텍스트 윈도우가 길어짐에 따라 대형 모델 가중치를 효율적으로 이동하는 것이 성능에 중요해졌다. 이를 해결하기 위한 일반적인 방법은 양자화로, 이는 모델 가중치를 더 작은 데이터 형식으로 압축하는 최적화 기법이다. NVFP4는 NVIDIA Blackwell 아키텍처에서 도입된 혁신적인 4비트 부동 소수점 양자화 형식이다.

NVIDIA Technical Blog원문
News업무 자동화·

Mercury의 자동 청구서 처리 기능 소개

Mercury는 비즈니스의 청구서 처리 과정을 자동화하여 사용자가 계약자에게 전용 이메일 주소를 제공하면, 계약자가 송장을 보내는 즉시 자동으로 초안 결제를 생성한다. 이를 통해 사용자는 이메일함에서 송장을 찾거나 복잡한 스프레드시트를 관리할 필요가 없다.

Dwarkesh Podcast원문
NewsAI 리서치·논문·

rewardspy: RL 보상 함수의 보상 해킹 탐지 라이브러리

GRPO 훈련 실험 중 보상이 증가할 때 정책이 실제로 개선되고 있는지 아니면 보상 함수를 악용하고 있는지 판단하기 어려운 문제를 해결하기 위해 'rewardspy'라는 라이브러리를 개발했다. 이 라이브러리는 기존의 보상 함수를 감싸고 보상 해킹을 선행하는 지표를 지속적으로 모니터링한다. 현재 추적하는 요소로는 롤링 보상 통계, 보상 분산 붕괴, 보상 구성 요소 불균형, 응답 길이 드리프트, 보상 기울기 변화, GRPO 그룹 붕괴 등이 있다.

r/MachineLearning원문
News보안·규제·저작권·

백악관, GPT-5.6 접근 권한 개별 결정

백악관이 GPT-5.6의 접근 권한을 고객별로 승인하는 비공식적이고 불투명한 방식을 채택했다. 이는 보안 우려로 인해 OpenAI가 GPT-5.6의 출시를 단계적으로 진행하도록 요청받은 결과이다. 이로 인해 공개된 모델과 내부에서 개발 중인 모델 간의 격차가 점점 더 커질 것으로 예상된다. 또한, 중국 모델의 서방에서의 사용이 제한되거나 금지될 가능성이 높아졌다.

Don't Worry About the Vase (Zvi Mowshowitz)원문
NewsAI 툴·

Amazon S3에서 실시간 PDF 텍스트 추출 서버 구축

이 글에서는 Amazon S3에서 PDF 파일의 텍스트를 실시간으로 추출하는 서버를 구축하는 방법을 설명한다. 이 프로토콜 기반 접근 방식은 문서에 대한 프로그래밍적 접근을 제공하며, 아키텍처 설정, 서버 구축 및 인터랙티브 문서 쿼리 실행 과정을 안내한다. 또한, 이 방법을 Amazon Textract와 비교하여 어떤 도구가 작업에 적합한지 결정할 수 있도록 한다. 이 솔루션은 텍스트 기반 PDF에 적합하며, 복잡한 문서 처리에는 Amazon Textract가 권장된다.

이 접근 방식은 법률, 금융 서비스 및 경영진 팀이 실시간으로 문서 정보를 필요로 할 때 유용하다.

AWS Machine Learning Blog원문
News업무 자동화·

Cara, AWS 기반 보험 중개업체를 위한 도메인 특화 AI 솔루션 제공

Cara는 AWS에서 제공하는 AI 솔루션으로, 보험 중개업체의 백오피스 프로세스를 자동화한다. 보험 중개업체는 반복적인 작업에 많은 시간을 소모하며, Cara는 이러한 문제를 해결하기 위해 설계되었다. Cara는 Amazon Elastic Kubernetes Service(Amazon EKS)에서 운영되며, Amazon Bedrock을 통해 LLM 기반 AI 기능을 제공한다. 주요 기능으로는 보험 견적 비교, 신청서 자동화, 제안서 및 갱신 생성, 지식 기반 워크플로우가 있다. 또한, 각 중개업체의 데이터와 워크플로우는 안전한 작업 공간에서 분리되어 관리된다.

보험 산업의 복잡한 요구사항을 충족하는 AI 솔루션 개발은 한국의 보험 중개업체에도 적용 가능성이 있다.

AWS Machine Learning Blog원문
NewsAI 에이전트·

Stripe의 금융 컴플라이언스를 위한 생산급 AI 에이전트 시스템

Stripe는 연간 1.4조 달러의 결제량을 처리하며, 50개국에서 수천 건의 거래를 검토하는 컴플라이언스 팀을 운영하고 있다. Stripe는 AWS의 Amazon Bedrock을 사용하여 생산급 AI 에이전트 시스템을 구축하여 검토 처리 시간을 26% 단축하고, 96% 이상의 유용성 평가를 달성했다. 이 시스템은 작업 분해, 오케스트레이션 패턴, 프롬프트 캐싱을 통한 비용 최적화 등의 기술 아키텍처를 포함하며, 인간의 감독을 통해 품질과 감사 가능성을 유지한다.

AWS Machine Learning Blog원문
News커리어·채용·

GitHub에서의 성전환 경험 공유

GitHub의 직원 Arthur는 성전환을 하면서 원활한 경험을 했다고 전했다. 원격 근무 환경 덕분에 복장이나 외모에 대한 걱정 없이 일할 수 있었고, 성별 확인을 위한 다양한 지원을 받았다. 그는 IT 엔지니어링 팀에서 시작해 6개월 만에 기업 보안 팀으로 전환되었으며, SaaS 플랫폼을 코드 기반 인프라로 마이그레이션하는 작업에 참여했다. GitHub은 성별 확인 치료와 관련된 의료비를 지원하며, 내부 시스템에서 이름과 대명사를 쉽게 업데이트할 수 있었다고 밝혔다.

GitHub의 포용적인 문화는 성전환 과정에서의 어려움을 줄이고, 개발자들이 자신을 표현할 수 있는 안전한 환경을 제공한다.

GitHub Blog원문
News업무 자동화·

자율주행 실험실: 다음 실험을 선택하는 실험실

일반 실험실은 인간 과학자가 운영 체제로 작동하며, 실험을 결정하고 샘플을 이동시키고 결과를 검사한다. 자율주행 실험실은 이 과정의 일부를 소프트웨어로 이동시켜 AI를 자동화된 실험 장비에 연결하고, 각 실험의 결과가 시스템의 다음 행동에 영향을 미치도록 한다. 이는 단순한 자동화와 자율성의 차이를 보여준다. 자동화는 스크립트를 실행하지만, 자율주행 실험실은 실험을 통해 학습하고 더 나은 후보로 방향을 전환할 수 있다.

자율주행 실험실의 개념은 실험 자동화의 효율성을 높이고, AI를 활용한 데이터 기반 의사결정의 중요성을 강조한다.

TheSequence (Jesus Rodriguez)원문
NewsAI 리서치·논문·

Kevin Weil, AI의 과학적 발견 가속화에 대한 논의

Kevin Weil은 Speedrun에서 AI의 미래, 과학적 발견, 스타트업 구축에 대해 논의했다. 그는 AI 모델이 기존 인간 지식의 경계를 넘는 문제를 해결하기 시작하고 있으며, 추론, 코딩, 자율 연구의 발전이 수학에서 의학에 이르기까지 다양한 분야를 재편할 수 있다고 설명했다. 또한, AI의 현재 물결이 완전히 새로운 기업 카테고리를 창출할 수 있는 이유와 AI 기능이 전례 없는 속도로 향상되는 세계에서 창립자들이 이해해야 할 점을 공유했다.

AI 모델이 기존 인간 지식의 경계를 넘어 문제를 해결하는 것은 과학적 발견의 방식을 혁신할 수 있다.

AI + a16z원문
News생성 이미지·영상·음성·

카타르, FIFA의 차세대 축구 기술 실험 장소로 자리잡다

카타르는 FIFA가 차세대 축구 기술을 실험하는 장소가 되었으며, 그 결과는 올해 월드컵에서 이미 확인할 수 있다.

WIRED — AI원문
NewsAI 모델·API·

OpenAI, GPT-5.6 Sol 모델 미리보기

OpenAI는 GPT-5.6 Sol을 미리 공개했다. 이 모델은 코딩, 과학, 사이버 보안 분야에서 더 강력한 기능을 갖추고 있으며, 가장 진보된 안전 시스템과 함께 제공된다.

OpenAI News원문
NewsAI 리서치·논문·

OpenAI Codex 사용량, 부서별로 56배 증가

OpenAI의 내부 Codex 사용량이 2025년 11월 이후 Research 부서에서 56배, Customer Support에서 32배, Engineering에서 27배, Legal에서 13배 증가했다. 2025년 8월까지 OpenAI 직원들은 Codex에 10% 미만의 토큰을 사용했으나, 최근 6개월간 Codex 사용이 심화되었다. 이는 OpenAI 직원들이 AI를 충분히 활용하지 못했던 상황에서의 변화로, 각 부서에서의 토큰 사용량 증가가 두드러진다.

Latent Space (swyx & Alessio)원문
News업무 자동화·

토스 QA Platform 팀의 릴리즈 품질 관리 및 AI 활용

토스는 매주 300~400건의 코드 변경을 포함한 새로운 버전을 배포하며, 품질을 유지하기 위해 토스닥터(Toss Doctor)와 토스체커(Toss Checker)를 활용한 테스트를 수행한다. QA Platform 팀은 핫픽스 대응과 크래시 모니터링을 통해 품질을 보장하며, 테스트 케이스 자동 생성 도구인 tcgen과 PR 분석기(PRCheck)를 개발하여 효율성을 높이고 있다. 또한, QA 프로세스를 개선하기 위해 토션(Tossion) 플랫폼을 구축하여 기존 도구의 한계를 극복하고 있다.

토스 테크 (Toss Tech)원문
NewsAI 리서치·논문·

Anthropic, AI 안전성을 위한 책임 있는 개발 강조

Anthropic의 비판자들은 이 회사가 빠르게 권력을 축적하고 있다고 주장하고 있다. 그러나 Anthropic은 이것이 책임 있는 AI 개발의 모습이라고 설명하고 있다.

AI 개발 과정에서 권력의 집중이 안전성과 책임 있는 개발에 미치는 영향을 고려해야 한다.

WIRED — AI원문
News생성 이미지·영상·음성·

2026년 아마존 프라임 데이 할인 상품 실시간 추적

2026년 아마존 프라임 데이 할인 상품이 진행 중이다. 실시간 블로그를 통해 TV, MacBook, 삼성 기기, SSD 등 편집자가 승인한 제품의 할인 정보를 확인할 수 있다. 세일은 내일 종료된다.

개발자들은 할인된 기술 제품을 통해 비용을 절감하고 최신 장비를 확보할 기회를 가질 수 있다.

ZDNET — Artificial Intelligence원문
NewsAI 코딩·

GitHub Copilot agentic harness의 성능 및 효율성 평가

GitHub Copilot agentic harness는 GitHub Copilot SDK의 공유 구성 요소로, GitHub Copilot CLI, GitHub Copilot 앱, Copilot 코드 리뷰 등 다양한 경험을 지원한다. 이 하네스는 빠르고, 토큰 효율적이며, 개발자에게 예측 가능하도록 설계되었다. 최근 벤치마크를 통해 GitHub Copilot CLI는 Claude Sonnet 4.6, Claude Opus 4.7, GPT-5.4, GPT-5.5와 같은 모델 벤더 하네스와 비교하여 유사한 작업 완료율을 보이며, 대부분의 구성에서 낮은 토큰 소비를 기록했다. 또한, TerminalBench 2.0을 통해 작업 완료 및 토큰 효율성에 대한 분석을 지속적으로 수행하고 있다.

이 정보는 GitHub Copilot의 성능 최적화가 개발자 작업 흐름에 미치는 영향을 이해하는 데 도움이 된다.

GitHub Blog원문
News보안·규제·저작권·

Windows 10의 무료 Extended Security Update 프로그램 1년 연장

Microsoft는 Windows 10 사용자에게 무료 Extended Security Update 프로그램을 1년 더 연장한다고 발표했다.

이 연장은 Windows 10을 사용하는 개발자들이 보안 업데이트를 추가 비용 없이 계속 받을 수 있게 해준다.

ZDNET — Artificial Intelligence원문
News보안·규제·저작권·

독일 법원, 구글 AI 요약의 오류에 대한 책임 인정

브루스 슈나이어는 최근 독일 법원이 구글이 AI 요약에서 발생한 오류에 대해 책임을 져야 한다고 판결한 내용을 언급했다. AI 에이전트는 이를 배포하는 개인이나 조직의 대리인으로 간주되어야 하며, 기업이 인적 작가를 고용하여 요약을 작성했다면 그 기업은 부정확성에 대해 책임을 져야 한다고 주장했다. AI의 오류를 기업이 변명으로 삼는 것은 기업의 잘못된 행동을 조장할 수 있다는 경고도 포함되어 있다.

이 판결은 AI를 활용하는 기업들이 법적 책임을 명확히 인식해야 함을 시사하며, 개발자들은 AI 시스템의 정확성을 더욱 중요하게 고려해야 한다.

Simon Willison's Weblog원문
NewsAI 툴·

Vulkan Descriptor Heaps를 통한 리소스 바인딩 간소화

셰이더는 광선, 픽셀, 기하학, 텍스처와 같은 시각적 데이터를 처리하여 특정 렌더링 효과를 생성하는 GPU 프로그램이다. 셰이더는 리소스 바인딩이라는 과정을 통해 필요한 데이터를 찾는다. CPU 코드는 텍스처와 메모리 버퍼와 같은 GPU 리소스를 생성하고, 셰이더 코드가 이를 바인딩 프로토콜을 통해 접근할 수 있도록 정렬한다.

이 기술은 Vulkan API를 사용하는 그래픽스 프로그래밍에서 리소스 관리의 효율성을 높일 수 있다.

NVIDIA Technical Blog원문