본문으로 건너뛰기

News

AI 뉴스

매일 수집·정리하는 전세계 AI 소식을 최신순으로

NewsAI 리서치·논문·

PhiCalNet을 통한 단일 샷 프린지 프로젝션 프로파일로메트리의 깊이 회복 개선

단일 샷 프린지 프로젝션 프로파일로메트리(FPP) 네트워크는 객체 경계에서 깊이를 회복하는 형태 우선 단축을 활용할 수 있다. PhiCalNet은 감싸진 위상 표현 $( ext{sin} heta, ext{cos} heta)$을 출력하고 이를 고정된 미분 가능 보정 레이어를 통해 깊이로 매핑하여 형태 우선 솔루션을 제거한다. PhiCalNet은 객체 평균 절대 오차(MAE)를 3.3배 줄여 4.46mm로 개선하며, 잔여 오차는 $ ext{0.103 ext{%}}$의 픽셀에 국한된다. 세 프레임 확장을 통해 1.16mm까지 도달할 수 있다.

PhiCalNet은 객체 MAE를 4.46mm로 줄여 깊이 회복의 정확성을 높인다.

arXiv cs.LG (머신러닝)원문
NewsAI 리서치·논문·

G-SHARE: 인적 요인 사건 진단을 위한 가이드라인 기반 구조적 추론 프레임워크

G-SHARE는 원자력 발전소의 인적 요인 사건 진단을 위한 가이드라인 기반 구조적 추론 프레임워크로, CNNP의 아홉 단계 진단 가이드를 다단계 진단 파이프라인으로 구현한다. 이 프레임워크는 증거 추출, 단계별 진단 추론, 사후 일관성 수정을 포함하여 보고서 증거의 명시적 사용과 논리적 검증을 가능하게 한다. 중국 원자력 산업 소스에서 실제 인적 요인 사건 보고서 데이터셋이 구축되었으며, 도메인 전문가에 의해 주석이 달린 금표준 하위 집합이 평가에 사용되었다. G-SHARE는 기존의 일회성 프롬프트 및 전통적인 머신러닝 기준을 크게 능가하며, 가장 강력한 버전이 최고의 정확도와 매크로-F1 점수를 기록하였다. 구조적 추론과 일관성 강제는 약한 프롬프트 조건에서 강력한 진단을 위해 중요하다는 결과도 나타났다.

G-SHARE는 인적 요인 사건 진단을 위한 구조적 추론을 통해 안전-critical 산업에서의 지능형 분석을 위한 실용적인 경로를 제공한다.

arXiv cs.CL (계산언어학·NLP)원문
NewsAI 리서치·논문·

Mirror Theory와 유효 경로 엔트로피(VPE) 개념 소개

Mirror Theory는 지능형 시스템을 반복적인 반사를 통해 지속할 수 있는 일관된 연속성으로 연구해야 한다고 주장한다. 유효 경로 엔트로피(VPE)는 검증된 연속성 용량을 측정하는 유한 예산 지표로, 미러 상태, 롤아웃 프로토콜, 검증자, 모드 맵을 기반으로 한다. VPE는 성공적인 롤아웃에서 도달 가능한 연속성의 확률과 검증된 연속성 모드의 다양성을 두 부분으로 분해한다. Qwen2.5-1.5B 모델은 160 토큰에서 가장 강력한 미러 호라이즌을 실현했으며, 이는 미러 호라이즌이 단순한 매개변수 수가 아니라 제한된 반사 프로토콜 하에서 접근 가능한 검증된 연속성 용량임을 보여준다.

Qwen2.5-1.5B 모델은 160 토큰에서 가장 강력한 미러 호라이즌을 실현하여, 제한된 반사 프로토콜 하에서의 검증된 연속성 용량의 중요성을 강조한다.

arXiv cs.LG (머신러닝)원문
NewsAI 리서치·논문·

UAE, AI 기반 정부 앱 TAMM 도입 및 AI 전략 발표

아부다비에서 AI는 일상 생활의 일부로 자리잡고 있으며, 'TAMM'이라는 앱이 국가 ID, 건강 보험, 차량 등록 갱신 등을 자동으로 처리한다. UAE는 2017년에 세계 최초의 AI 장관을 임명하고, 2019년에는 세계 최초의 AI 전공 대학인 모하메드 빈 자이드 인공지능 대학(MBZUAI)을 설립했다. UAE의 국가 AI 전략은 2031년까지 AI 중심의 명성을 구축하고, 2030년까지 AI가 GDP의 11%를 기여할 것으로 예상하고 있다.

Axios — Technology원문
NewsAI 개발·

2026년 AI 엔지니어링의 주요 트렌드

2023년 6월 swyx가 'AI 엔지니어'라는 용어를 만든 이후 AI 엔지니어링은 크게 발전했다. 2026년 AI 엔지니어 월드 페어에서는 AI 시스템 주변의 엔지니어링이 중요해졌으며, 자동화된 에이전트보다 시스템 설계가 강조되었다. 특히, OpenAI의 Codex와 같은 도구를 활용하여 AI 엔지니어와 에이전트 간의 협업이 용이해졌고, '루프' 개념이 AI 엔지니어링의 새로운 제어 계층으로 부각되었다.

AI 엔지니어링은 이제 단순한 모델 프롬프트를 넘어서, 신뢰할 수 있는 시스템을 구축하는 방향으로 발전하고 있다.

Latent Space (swyx & Alessio)원문
NewsAI 툴·

Codex Desktop에서 사용자 맞춤형 애니메이션 로봇 생성

Codex Desktop에서 사용자는 GPT-5.6 Sol을 이용해 자신만의 애니메이션 로봇인 'Pedalican'을 만들 수 있다. 이 로봇은 자전거를 타고 움직이며 Codex 작업에 대한 업데이트를 제공한다. 사용자는 gpt-image-2를 통해 필요한 스프라이트 자산을 생성하고, GitHub 리포지토리에는 생성된 이미지와 애니메이션 GIF가 포함되어 있다.

GPT-5.6 Sol을 활용하여 사용자 맞춤형 애니메이션 캐릭터를 생성하는 과정은 게임-ready 스프라이트 제작에 유용한 방법을 제시한다.

Simon Willison's Weblog원문

OpenAI, ChatGPT 스마트 스피커 출시 예정

OpenAI의 첫 번째 기기는 ChatGPT와 대화할 수 있는 스마트 스피커로, 화면은 없지만 카메라와 추가 센서를 사용해 주변 환경을 이해할 수 있는 기능을 갖춘다. 이 기기는 재충전 가능한 배터리를 탑재해 휴대가 가능하며, 스마트 홈 제어 기능도 제공할 예정이다. 이 보도는 Apple이 OpenAI를 상대로 하드웨어 비밀을 훔쳤다고 주장하는 소송을 제기한 직후에 나왔다.

OpenAI의 스마트 스피커는 ChatGPT와의 상호작용을 통해 사용자 경험을 향상시킬 수 있다.

The Verge — AI원문

Breadcromb: 모든 것을 기억하고 행동하는 브라우저

Breadcromb는 모든 정보를 기억하고, 사용자가 원하는 행동을 수행할 수 있는 브라우저이다.

Product Hunt — Artificial Intelligence원문
NewsAI 에이전트·

ChikitAI: 의료 분류 및 관리 자동화를 위한 에이전틱 AI

ChikitAI는 의료 분야에서 분류 및 관리 자동화를 위한 에이전틱 AI 솔루션이다. 이 제품은 의료 서비스의 효율성을 높이고, 환자 관리 과정을 개선하는 데 중점을 두고 있다.

ChikitAI는 의료 분야에서의 AI 활용을 통해 환자 관리의 효율성을 향상시킬 수 있다.

Product Hunt — Artificial Intelligence원문

메타, AI 도구로 8,000명 해고 결정

메타가 8,000명의 직원을 해고하는 과정에서 AI 도구를 사용했다는 주장이 제기됐다. 캘리포니아 북부 지방법원에 제출된 소송에 따르면, 메타는 'Metamate'라는 시스템과 직원 훈련을 받은 '두 번째 두뇌' 에이전트, 키 입력 및 활동 모니터링 데이터 등을 활용해 해고 대상을 선정했다. 직원들은 메타의 AI 도구 사용량에 따라 평가받았으며, 내부 대시보드는 직원들을 'AI Native', 'AI First', 'AI Enabled' 등의 카테고리로 분류했다.

메타는 내부 AI 시스템을 통해 직원의 해고를 결정했으며, 이는 AI 도구 사용량이 평가 기준이 됐다는 점에서 인사 관리에 AI가 미치는 영향을 보여준다.

Ars Technica — AI원문
NewsAI 에이전트·

Strands Agents와 Amazon Bedrock을 활용한 다중 에이전트 사회적 지능 시스템

Thrad.ai는 Strands Agents와 Amazon Bedrock AgentCore를 사용하여 다중 에이전트 시스템을 배포하고, 이를 통해 잠재 고객 발견부터 개인화된 이메일 생성까지의 파이프라인을 자동화하였다. 이 시스템은 다양한 출처에서 수집된 신호를 분석하여 구매 준비가 된 고객을 식별하는 데 도움을 준다. 또한, Swarm과 Graph 두 가지 오케스트레이션 패턴을 비교하고, 고객 점수를 매기는 방법과 생산 배포를 위한 거버넌스 제어를 설명한다.

Strands Agents와 Amazon Bedrock AgentCore를 통해 다중 에이전트 시스템을 활용하면 고객 발굴과 이메일 생성 과정을 자동화할 수 있다.

AWS Machine Learning Blog원문
NewsAI 리서치·논문·

NVIDIA Nemotron 모델 추론 챌린지와 5,000명 이상의 Kaggle 참가자

NVIDIA Nemotron 모델 추론 챌린지는 Kaggle 커뮤니티에 동일한 공개 모델, 벤치마크, 인프라 및 평가 제약 조건에서 추론 정확도를 개선할 수 있는 기술을 탐구하도록 초대했다. 이 대회에는 4,000개 팀의 5,000명 이상의 참가자가 참여하여 수천 개의 결과를 생성했다.

NVIDIA Nemotron 모델 추론 챌린지는 AI 추론 정확도를 개선하기 위한 다양한 기술을 탐구하는 기회를 제공한다.

NVIDIA Technical Blog원문
NewsAI 코딩·

소프트웨어 프로젝트의 공유 언어와 이해의 중요성

소프트웨어 프로젝트에서 공유되는 언어는 영어 또는 파이썬이 아니라 개념의 의미, 경계, 중요 불변량, 소유권, 시스템 구조의 이유에 대한 공통 이해이다. 이러한 이해는 문서와 코드, 코드 리뷰, 대화, 논쟁, 변경 사항을 설명하는 경험 속에 존재한다. 에이전트 이전에는 이러한 공유 이해가 마찰을 통해 유지되었으며, 이는 느린 과정이었지만 서로의 이해를 동기화하는 역할을 했다.

Simon Willison's Weblog원문

2026년 Twitter 사용법 및 알고리즘 변화

2026년 Twitter 사용법에 대한 업데이트가 포함되어 있으며, 'For You' 피드가 다시 주목받고 있다. 사용자는 이제 세 가지 피드 중 하나를 선택할 수 있으며, 시간순 피드를 사용하려면 수동으로 클릭해야 한다. 사용자는 리스트를 통해 피드를 방어하고, 차단 기능을 적극적으로 활용해야 하며, 새로운 팔로워의 트윗을 보기 위해서는 'All' 리스트에 추가해야 한다. AI 관련 콘텐츠는 흥미롭지 않으면 차단하는 것이 좋다.

Twitter의 알고리즘 변화에 따라 사용자는 리스트를 통해 피드를 관리하고, 'All' 리스트를 통해 중요한 정보를 놓치지 않아야 한다.

Don't Worry About the Vase (Zvi Mowshowitz)원문
NewsAI 코딩·

루프 엔지니어링의 개념과 활용

‘루프 엔지니어링’은 Anthropic과 OpenAI의 개발자들이 프롬프트 작성을 중단하고 루프 설계로 전환하면서 주목받고 있다. Anthropic의 Boris Cherny는 Claude를 프롬프트하는 대신 루프를 작성한다고 밝혔다. 루프는 이벤트에 반응하거나 예약된 작업을 실행하는 데 사용되며, OpenAI의 API 가격이 비쌀 경우 비용이 빠르게 증가할 수 있다. Geoffrey Huntley는 'Ralph Wiggum' 루프라는 개념을 제안하며, 이를 통해 작업을 지속적으로 유도할 수 있다고 설명했다. 이 방법은 엔지니어의 전문성이 여전히 필요하다고 강조한다.

루프 엔지니어링은 개발자들이 이벤트에 반응하거나 예약된 작업을 자동으로 실행하는 데 유용한 방법이다.

The Pragmatic Engineer (Gergely Orosz)원문
News업무 자동화·

QA Studio를 활용한 배치 회귀 테스트 및 CI/CD 통합

QA Studio는 개별 사용 사례를 그룹화하여 테스트 스위트를 생성하고, 이를 통해 구조화된 회귀 테스트를 지원한다. 각 테스트 스위트는 Amazon ECS의 Fargate 작업에서 독립적으로 실행되어 병렬 처리로 수행된다. QA Studio CLI는 CI/CD 파이프라인과 통합되어 명령줄에서 테스트를 실행하고 결과를 보고할 수 있다.

QA Studio는 테스트 스위트를 통해 20개의 테스트를 동시에 실행할 수 있어 전체 소요 시간을 단축시킨다.

AWS Machine Learning Blog원문
NewsAI 모델·API·

Nemotron Labs: 기업과 국가를 위한 신뢰할 수 있고 맞춤형 AI 구축

Nemotron Labs 블로그 시리즈는 최신 오픈 모델과 데이터셋, 훈련 기법이 기업들이 NVIDIA 플랫폼에서 전문화된 AI 시스템과 애플리케이션을 구축하는 데 어떻게 도움이 되는지를 탐구한다. 오픈 모델은 기업들이 AI를 맞춤화하고 통제할 수 있도록 하며, Nemotron과 같은 모델을 통해 특정 비즈니스 요구에 맞는 AI를 구축할 수 있다. 예를 들어, Abridge는 임상 대화를 위한 최초의 기초 모델을 구축하고, H Company는 Nemotron 3 Nano Omni를 사용해 76% 이상의 정확도를 달성했다. 또한, LangChain은 Nemotron 3 Ultra를 조정하여 약 10배 낮은 비용으로 최상위 에이전트 정확도를 기록했다.

Nemotron과 같은 오픈 모델은 기업들이 AI를 맞춤화하고 비즈니스 요구에 맞게 개선할 수 있는 완전한 통제를 제공한다.

NVIDIA Blog원문

구글, 25주년 기념 이미지 검색 리뉴얼 및 AI 기능 확대

구글은 이미지 검색 출시 25주년을 맞아 사용자 경험을 새롭게 개선하고 AI 기능을 확대한다고 발표했다. 이미지 검색은 2001년 7월에 처음 출시되었으며, 당시 제니퍼 로페즈의 그린 베르사체 드레스가 검색의 계기가 되었다. 현재 구글 이미지 검색 사이트는 간결한 검색 바를 제공하며, 새로운 구글 이미지가 출시될 예정이다.

구글은 이미지 검색에서 AI 기능을 확대하여 사용자 경험을 개선할 계획이다.

Ars Technica — AI원문
NewsAI 에이전트·

NVIDIA NeMo와 RL 에이전트 기술을 활용한 자동 연구 워크플로우 실행 방법

코딩 AI 에이전트는 장기적인 머신러닝(ML) 워크플로우에서 실용적인 운영자로 자리잡고 있다. 이들은 저장소를 검사하고, 런타임을 설정하며, 빌드 문제를 해결하고, 실험을 시작하고, 실행을 모니터링하며, 메트릭을 분석하고, 결과를 요약하는 등의 작업을 수행할 수 있다. 강화 학습(RL) 연구에서 이러한 기능은 필수 실험 인프라가 갖춰진 후에만 의미 있는 메트릭이 나타나기 때문에 중요하다.

NVIDIA Technical Blog원문

Dave Kuszmar, LLM 안전성 취약점 발견 및 개선 촉구

연구자 Dave Kuszmar는 여러 시스템적 취약점을 발견하여 LLM 안전성을 우회하고 위험한 지침을 얻을 수 있음을 밝혔다. 이 취약점은 주요 LLM 전반에 걸쳐 작동하며, 산업 전반의 보안 문제를 드러낸다. Kuszmar는 LLM을 사회에 통합하기 전에 배포 속도를 늦추고 투명성을 높이며 대규모 연구를 촉구하고 있다.

Kuszmar의 연구는 LLM의 보안 취약점이 실제로 존재하며, 이를 해결하기 위한 조치가 필요하다는 점을 강조한다.

IEEE Spectrum — AI원문

뉴욕, 데이터 센터 건설 1년 중단

뉴욕주가 민주당 주지사 캐시 호컬의 발표에 따라 50메가와트 이상의 대규모 데이터 센터 건설을 1년간 중단하기로 했다. 이 주 전역의 금지는 뉴욕에서 책임 있는 데이터 센터 개발을 위한 '일관된 기준'이 마련될 때까지 해제되지 않는다. 미국 전역에서 데이터 센터 건설 중단 요구가 증가하고 있으며, 연방 차원에서는 버니 샌더스와 알렉산드리아 오카시오-코르테즈가 전국적인 건설 금지 법안을 제안했다. 그러나 공화당은 이러한 법안에 반대하는 입장이다.

50메가와트 이상의 데이터 센터 건설이 중단됨에 따라, 뉴욕에서의 데이터 센터 개발 기준이 어떻게 설정될지 주목할 필요가 있다.

Ars Technica — AI원문
NewsAI 리서치·논문·

AI 인프라 효율성을 위한 성능 대비 전력 소비의 중요성

AI 인프라에서 전력은 필수적인 제약 조건이다. AI 공장이 고정된 전력 예산 내에서 생성할 수 있는 토큰 수는 수익성과 직결된다. NVIDIA Blackwell NVL72 플랫폼은 최고 성능 대비 전력 소비를 제공하며, 72-GPU 도메인에서 MoE 아키텍처를 효율적으로 지원한다. NVIDIA GB300 NVL72 시스템은 NVIDIA Hopper 세대에 비해 최대 25배의 성능 대비 전력 소비를 제공하며, 이는 AI 추론 작업의 토큰 처리량을 극대화하기 위해 설계된 코드 디자인의 결과이다. 또한, NVIDIA DSX MaxLPS는 전력과 효율성을 개선하여 동일한 전력 예산 내에서 최대 40% 더 많은 GPU를 운영할 수 있게 한다.

NVIDIA GB300 NVL72 시스템은 NVIDIA Hopper에 비해 최대 25배의 성능 대비 전력 소비를 제공하여 AI 인프라의 수익성을 극대화한다.

NVIDIA Blog원문

OpenAI, GPT-5.6 모델 출시 및 ChatGPT Work 모드 통합

OpenAI는 GPT-5.6 모델을 출시했으며, ChatGPT의 macOS 앱과 Codex 앱이 통합되어 ChatGPT Work 모드가 추가되었다. GPT-5.6 시리즈는 Luna, Terra, Sol 세 가지 모델로 구성되며, 각 모델은 5단계의 사고 수준과 새로운 Ultra 모드를 제공한다. 사용자는 Sol 모델을 통해 UI 작업을 효과적으로 수행할 수 있으며, Codex 앱에서 컴퓨터 사용을 자동화하는 기능도 지원한다.

GPT-5.6 모델은 Sol 모델을 통해 UI 작업을 효과적으로 수행할 수 있어, 개발자들이 더 효율적으로 작업할 수 있는 기회를 제공한다.

Ben's Bites (Ben Tossell)원문
NewsAI 리서치·논문·

Gavin Baker가 말하는 AI 투자 사이클과 데이터 센터, GPU의 경제적 의미

Gavin Baker, Atreides Management의 매니징 파트너가 AI 투자 사이클에 대한 주요 질문을 다루며, 데이터 센터와 GPU의 전례 없는 구축이 경제에 미치는 영향을 논의했다. 그는 오늘날의 AI 투자 사이클이 2000년대 초 인터넷 버블과 근본적으로 다르다고 주장하며, Nvidia, Google, 맞춤형 실리콘, AI 인프라, 응용 소프트웨어, 로봇 공학에 대해 이야기했다. 또한 GPU 경제학, 기업 소프트웨어, AI 비즈니스 모델에 대해서도 논의하였다.

Nvidia와 같은 기업들이 AI 인프라를 구축하는 방식은 향후 AI의 경제적 영향을 결정짓는 중요한 요소가 될 것이다.

AI + a16z원문