News
AI 뉴스
매일 수집·정리하는 전세계 AI 소식을 최신순으로
AWS를 위한 Claude 앱 게이트웨이 소개
Claude Code와 Claude Desktop을 사용하는 기업은 접근, 비용 및 정책에 대한 중앙 집중식 제어가 필요하다. 이를 위해 AWS용 Claude 앱 게이트웨이가 발표되었으며, 이는 개발자마다 개별 자격 증명을 제공할 필요 없이 중앙에서 관리할 수 있도록 한다. 이 게이트웨이는 Amazon Bedrock 또는 Claude Platform을 통해 배포할 수 있으며, OpenID Connect(OIDC)와 호환되는 아이덴티티 제공자와 연결된다. 또한, 정책을 중앙에서 정의하고 관리할 수 있으며, 사용량 메트릭을 수집하여 Amazon CloudWatch와 같은 플랫폼으로 전송할 수 있다.
Claude 앱 게이트웨이는 개발자 접근을 중앙에서 관리하고, 비용 한도를 설정할 수 있는 기능을 제공한다.
i-Ready 소프트웨어가 학생들에게 미치는 부정적 영향
Ryan Moulton은 i-Ready 소프트웨어가 자신의 자녀에게 수학에 대한 혐오감을 유발했다고 언급하며, 이 소프트웨어가 학생들에게 비효율적이고 고통스러운 경험을 제공한다고 주장한다. 그는 i-Ready 사용이 학생들의 행복에 부정적인 영향을 미쳤으며, 많은 부모들이 비슷한 경험을 공유했다고 설명한다. Kelsey Piper는 i-Ready의 문제점이 특정 학교 시스템에 국한되지 않으며, 교육 기술 전반에서 발생하는 문제라고 지적한다.
i-Ready는 학생들이 읽을 수 없다고 가정하고, 반복적인 지시를 강요하는 방식으로 작동하여 학생들에게 스트레스를 유발한다.
Osmo의 알렉스 윌츠코가 설명하는 AI의 후각 지능 구축
알렉스 윌츠코는 Osmo의 CEO로서 컴퓨터에 후각을 부여하는 목표와 이를 위한 과학적 접근을 설명한다. 인간의 코에 있는 수백 개의 후각 수용체와 분자 구조와 냄새 간의 관계를 매핑하는 도전 과제를 다룬다. AI는 그래프 신경망과 고급 임베딩 공간을 통해 냄새의 다차원 구조를 포착하고, 이를 통해 분자의 냄새를 예측하는 기계 학습 표현을 생성한다. Osmo는 예측 모델을 훈련시키기 위해 가장 큰 독점 후각 데이터셋을 구축했으며, 후각 지능은 질병 탐지, 감정 감지, 소비자 기기 등 다양한 분야에 응용될 수 있다.
GitHub 2026년 6월 가용성 보고서
2026년 6월 GitHub의 가용성 보고서에 따르면, Azure의 Monolith 트래픽은 중앙 미국에서 45%로 정점에 달했으나, 안정성 사건으로 인해 한 달간 증가를 중단했다. Git은 30%에서 43%로 증가했으나 목표인 50%에는 미치지 못했다. 새로운 서비스인 pullsd는 익명 풀 리퀘스트 읽기를 100% 처리하고 있으며, reposd는 Azure에서 REST 트래픽의 50%를 처리했다. 사용자 서비스는 초당 약 500,000 쿼리를 처리하고 있으며, API 속도 제한은 97%가 게이트웨이에서 처리되고 있다. 6월에는 6건의 사건이 발생했으며, 그 중 하나는 Copilot 코드 리뷰에서 81.6%의 실패율을 기록했다.
Copilot 코드 리뷰에서 93.9%의 실패율을 기록한 사건은 새로운 종속성의 호환성 문제로 발생했으며, 이는 향후 종속성 버전 고정 및 호환성 검사를 강화해야 함을 시사한다.
Skyrim에서 LLM을 활용한 NPC 대화 시스템의 발전
Nvidia는 2024년에 클라우드 LLM 서버를 기반으로 한 NPC인 ACE를 선보였다. Skyrim은 LLM을 NPC에 통합하기 위한 첫 번째 테스트베드 중 하나로, Mantella와 Herika 모드가 개발되었다. Herika 모드는 NPC의 행동과 대화, 세계 사건을 인식하여 LLM의 능력을 확장하고, 이후 'AI Follower Framework'로 이름이 변경되었다. 사용자는 SkyrimNet 모드를 통해 NPC의 개성을 만들고 역할을 수행할 수 있으며, 이를 통해 새로운 스토리라인을 생성할 수 있다.
SkyrimNet을 통해 사용자는 NPC의 개성을 창조하고 실시간으로 스토리라인을 생성할 수 있다.
TypeScript 7.0 RC 및 AI 도구 관련 소식
TypeScript 7.0의 릴리스 후보(RC)가 공개되었으며, Go로 재작성된 네이티브 컴파일러를 탑재하여 6.0보다 약 10배 빠른 성능을 제공한다. React 코드 품질 문제를 자동으로 검사하는 도구인 React Doctor는 상태 관리, 성능, 보안 등을 검사하며, Vercel이 공개한 파일시스템 기반의 AI 에이전트 프레임워크인 vercel/eve는 코드가 아닌 디렉터리 구조로 구성 요소를 관리할 수 있다.
TypeScript 7.0 RC는 대규모 코드베이스에서 타입 체크와 빌드 속도를 개선할 수 있는 기회를 제공한다.
Simba 3.2 기반 음성 에이전트
Simba 3.2는 세계 1위의 음성 모델로, 이를 기반으로 한 음성 에이전트가 제공된다.
GraphRAG와 BYOKG를 통한 제약 연구의 데이터 통합
제약 연구에서 연구자들은 분산된 시스템에 흩어져 있는 방대한 과학 지식에 접근하고 연결하는 데 어려움을 겪고 있다. 초기 약물 발견에서 전통적인 방법의 성공률은 5%에 불과하며, 초기 스크리닝에는 6개월 이상 소요된다. Amazon Neptune Analytics를 활용한 GraphRAG는 연구자들이 자연어로 복잡한 질문을 하고 통합된 지식 그래프에서 즉각적인 증거 기반 통찰을 얻을 수 있도록 지원한다. 이 접근 방식은 연구자들이 정보 검색을 넘어 추론을 증폭하고, 기관의 기억을 보존하며, 숨겨진 통찰을 드러내는 데 도움을 준다.
GraphRAG는 연구자들이 복잡한 과학적 관계를 이해하고 연결할 수 있도록 하여 데이터 기반 결정을 보다 효율적으로 내릴 수 있게 한다.
Amazon Bedrock을 활용한 공공 부문 이메일 관리 자동화
AI 기반 이메일 관리 시스템은 공공 부문에서 유권자와의 소통 방식을 변화시킬 수 있다. 이 시스템은 이메일을 긴급성과 부서 관련성에 따라 자동으로 분류하고 전송하며, 특히 지방 정부에서 유용하다. Amazon Bedrock과 AWS 서비스를 활용하여 이메일을 자동으로 분류하고, 적절한 부서로 라우팅하며, 긴급성을 평가하여 직원의 수작업 부담을 줄인다.
Amazon Bedrock을 사용하여 이메일을 자동으로 분류하고 전송함으로써, 공공 부문에서의 응답 시간을 개선할 수 있다.
Google, Android Bench에 새로운 LLM 추가 및 업데이트
Google은 Android 앱 개발에서 LLM의 성능을 평가하기 위해 만든 Android Bench를 업데이트했다. 이번 업데이트에는 Claude Fable 5, Claude Sonnet 5, Claude Opus 4.8, GLM 5.2, Kimi K2.7 Code, MiniMax M3, Qwen 3.7 Plus, Qwen 3.7 Max 등 8개의 새로운 모델이 추가되었다. 개발자들은 자신의 테스트를 실행하고 피드백을 제출할 수 있으며, Android Bench는 100개의 Android 개발 작업에서 LLM의 성능을 평가하는 것을 목표로 한다.
Android Bench는 LLM의 비용과 효율성을 평가하는 새로운 메트릭을 추가하여 개발자들이 적합한 도구를 선택하는 데 도움을 줄 수 있다.
Antithesis의 디버깅 도구와 Pragmatic Engineer 팟캐스트 에피소드
Pragmatic Engineer의 최신 에피소드에서는 Antithesis의 디버깅 도구에 대해 다루고 있다. Antithesis는 전체 시스템을 적대적인 시뮬레이션에서 실행하여 버그를 찾는 기능을 제공하며, 버그 발생 확률 분석을 통해 문제를 추적할 수 있다. 또한, 팟캐스트에서는 소프트웨어 산업, AI, 채용, 경력 성장 등에 대한 질문에 답변하고 있다.
Antithesis의 디버깅 도구는 버그 발생 확률 분석 기능을 통해 개발자들이 시스템의 문제를 효과적으로 추적하고 해결할 수 있도록 돕는다.
GitHub Copilot을 통한 GitHub Pages의 제로 DNS 설정 방법
GitHub Copilot CLI를 사용하여 DNS 레코드를 수동으로 편집하지 않고도 약 14분 만에 HTTPS로 보호된 커스텀 도메인에서 웹사이트를 배포하는 방법을 설명한다. 이 과정에서는 GitHub Pages에 사이트를 게시하고, 저렴한 도메인을 등록하며, Namecheap API를 활성화하고 Copilot CLI와 연결하는 단계가 포함된다. 최종적으로 Copilot CLI가 DNS 구성을 자동으로 처리하고, 도메인이 정상적으로 작동하는지 확인한다.
GitHub Copilot CLI를 활용하면 DNS 전문 지식 없이도 쉽게 GitHub Pages에 커스텀 도메인을 설정할 수 있다.
Flint: AI 시대를 위한 시각화 언어
Flint는 간단한 인간 편집 가능 사양에서 신뢰성 있게 표현력 있고 시각적으로 정교한 차트를 생성할 수 있도록 AI 에이전트를 지원하는 시각화 중간 언어이다. Flint는 의미론적 데이터 유형을 활용하여 데이터의 의미를 표현하고, 차트의 크기, 간격, 레이블 및 레이아웃을 자동으로 관리하여 가독성을 유지한다. 하나의 Flint 사양은 Vega-Lite, Apache ECharts, Chart.js 등 여러 백엔드로 컴파일할 수 있으며, flint-chart 라이브러리와 flint-chart-mcp 서버를 포함하여 에이전트가 채팅이나 코딩 환경에서 직접 차트를 생성하고 검증할 수 있도록 설계되었다.
Flint는 AI 에이전트가 간단한 사양으로부터 정교한 차트를 생성할 수 있도록 하여, 복잡한 세부 사항 관리로 인한 오류를 줄이고 사용자에게 더 나은 시각화 경험을 제공한다.
Academic Humanizer, AI 작성 논문을 인간처럼 보이게 하는 도구
스타트업 MorphMind가 개발한 Academic Humanizer는 AI가 작성한 논문과 보조금 제안서에서 AI의 흔적을 제거하는 도구이다. 이 도구는 AI 보조 초안이 일반적이고 장황하게 작성되는 문제를 해결하기 위해 설계되었으며, 사용자의 이전 작업을 기반으로 더 인간적인 목소리로 수정할 수 있다. 그러나 Academic Humanizer는 새로운 내용을 생성하지 않으며, AI가 작성한 논문의 기초적인 주장을 검증하는 기능은 없다. 사용자는 여전히 AI의 도움을 받았음을 공개해야 한다.
Academic Humanizer는 AI 보조 초안을 명확하게 표현하는 도구로, 연구자들이 자신의 아이디어를 보다 정확하게 전달할 수 있도록 돕는다.
NVIDIA Nemotron 3 Ultra, LangChain Deep Agents와 함께 성능 향상
NVIDIA Nemotron 3 Ultra는 LangChain의 Deep Agents 하네스를 조정하여 최고 정확도를 달성하고, 더 많은 작업을 높은 처리량으로 수행하며, 선도적인 폐쇄형 모델보다 10배 낮은 추론 비용으로 운영된다. Nemotron 3 Ultra는 LangChain의 Deep Agents 벤치마크에서 비즈니스 작업 동등성을 달성했으며, 모델 재훈련 없이 환경 조정을 통해 성능을 개선하였다. LangChain의 에이전트 엔지니어링 플랫폼은 매달 2억 회 이상 다운로드되고 있다.
NVIDIA Nemotron 3 Ultra는 LangChain Deep Agents와 함께 사용하여 기업들이 자신만의 전문화된 AI 시스템을 구축하고 운영할 수 있는 완전한 오픈 스택을 제공한다.
Robostral Navigate 소개
Robostral Navigate는 8B 모델로, 단일 RGB 카메라만으로 R2R-CE에서 76.6%의 성능을 달성하였다. 이 모델은 깊이 센서, LiDAR, 또는 여러 카메라가 필요하지 않다.
단일 RGB 카메라로 높은 성능을 달성함으로써 비용 효율적인 로봇 내비게이션 솔루션을 제공할 수 있다.
Obsidian과 Claude Code로 개인 루틴 관리 도구 개발하기
유료 루틴 관리 앱을 사용하던 사용자가 루틴 체크에 가중치를 두고, 개인의 방식으로 데이터를 관리할 수 있는 도구를 만들기로 결심했다. Obsidian과 Claude Code를 활용하여, 필요한 기능을 빠르게 구현하고, 개인용 도구로서의 만족도를 높였다. Git 플러그인, Templater, Dataview를 사용하여 데이터 관리와 반복 입력을 효율적으로 처리했다.
Obsidian은 텍스트 기반 데이터 관리를 지원하여 개인의 생활 데이터를 원하는 구조로 쌓을 수 있게 한다.
클로드 코드로 1인 빌더가 9개 프로젝트 동시 운영한 사례
김상욱 발표자는 클로드 코드(Claude Code)를 사용하여 1인으로 9개 프로젝트를 동시에 운영한 경험을 공유했다. 그는 지난해 1월 스타트업에서 백엔드 개발자로 일하다가 해고된 후 클로드 코드를 처음 사용하기 시작했으며, MVP 개발 속도가 빨라져 단 몇 시간 만에 결과물을 만들 수 있었다. 그러나 프로젝트 운영 시 고도화 작업이 필요해지는 문제를 겪었다. 주요 프로젝트로는 클래스코인(ClassCoin), 패티션(petition), 던전 버디(dungeon-buddy), 바바리안(barbarian) 등이 있다.
클로드 코드를 사용하면 MVP 개발 속도를 단 몇 시간으로 단축할 수 있지만, 프로젝트 운영의 복잡성은 증가한다.
이벤트 기반 MSA에서 AI 에이전트의 유지보수 비용 증가
이벤트 기반 MSA(Microservice Architecture)는 주문, 결제, 재고, 알림 서비스가 각자의 역할을 수행하며 장애 격리를 제공하지만, AI 에이전트가 유지보수를 맡기 시작하면 이벤트 흐름을 다시 이해하고 검증하는 데 드는 비용이 증가한다. AI는 현재 저장소 내에서만 수정안을 만들 수 있어, 다른 서비스의 이벤트 소비 방식을 고려하지 않으면 이벤트 계약을 깨뜨릴 수 있다. 따라서 AI와 함께 이벤트 기반 MSA를 운영하려면 변경 전후를 확인할 수 있는 절차가 필요하다.
AI 에이전트는 코드 수정 속도를 높이지만, 이벤트 흐름의 안전성을 검증하는 데는 여전히 사람이 개입해야 한다.
구글의 TabFM: 표 형식 AI를 위한 기초 모델
구글 리서치가 최근 발표한 TabFM은 표 형식 분류 및 회귀를 위한 기초 모델로, 이전에 본 적이 없는 테이블에 대한 예측을 단일 전방 패스에서 수행할 수 있다. 이 모델은 훈련, 조정, 특징 엔지니어링 없이 전체 문제를 하나의 거대한 프롬프트로 제공하면 답변을 생성한다. TabFM은 TimesFM의 개발 팀이 만든 것으로, 시간 시계열 데이터에 대한 예측을 위한 모델이다.
TabFM은 훈련 없이도 예측을 수행할 수 있어, 기존의 데이터 처리 방식을 혁신할 가능성이 있다.
AI 모델의 과도한 사고가 보안 위험을 초래한다
대형 언어 모델(LLMs)은 문제를 단계별로 사고하는 능력 덕분에 더 복잡한 작업을 수행할 수 있게 되었지만, 이로 인해 공격자가 시스템을 느리게 만들 수 있는 취약점이 생겼다. 연구자들은 비논리적인 프롬프트를 사용해 모델이 과도하게 사고하도록 유도할 수 있는 방법을 개발했으며, 이로 인해 상업적 AI 모델에 대한 서비스 거부 공격이 가능해졌다. 이 연구는 DeepSeek-R1, Alibaba의 Qwen3-Thinking, OpenAI의 GPT-o3, Google의 Gemini 2.5 Flash 모델에서 효과적이었으며, 출력 길이가 최대 26배 증가하는 결과를 보였다.
DeepSeek-R1 모델은 MATH 데이터셋에서 수정되지 않은 질문에 대한 응답보다 최대 26.1배 긴 출력을 생성했다.
Graham Platner의 정치적 스캔들과 민주당의 대응
Graham Platner는 성폭행 혐의를 부인했지만, 민주당 지도자들은 그의 과거와 관련된 문제들에 대해 우려를 표명했다. Platner의 캠페인은 2025년 8월에 시작되었고, 그는 1400만 달러 이상을 지출했다. 그의 정치 자문사인 Fight Agency는 Platner의 과거 문제를 알고 있었지만, 이를 공개하지 않았다. Platner는 소셜 미디어에서 논란이 되는 게시물을 올렸고, 나치와 관련된 문신을 가지고 있으며, 성적 메시지를 보낸 사실도 보도되었다.
Platner의 캠페인은 2025년 5월까지 1400만 달러 이상을 지출했다.
Adam Neumann, Flow와 주택 문제에 대한 대화
Adam Neumann은 Marc Andreessen, Ben Horowitz, Erik Torenberg과 함께 기업가 정신, 실패, Flow 구축에 대한 대화를 나누었다. Neumann은 자신의 어린 시절, 군 복무, 미국 이민, WeWork의 흥망성쇠, 그리고 기술 분야에서 가장 많은 조사를 받은 창립자 여정에서 배운 점을 반영했다. 그는 Flow가 주택, 공동체, 소속감을 재고하는 데 집중하고 있으며, 기술이 사람들의 생활 방식을 근본적으로 개선할 수 있다고 믿는 이유를 설명했다. 대화는 회복력, 회사 구축, 리더십, 부동산, 소프트웨어, 유연한 생활, 글로벌 주택 위기를 탐구했다.
Flow는 주택 문제를 해결하기 위한 기술적 접근 방식을 모색하고 있다.
Claude Fable 5 모델을 활용한 주식 분석 가이드
Claude Fable 5 모델은 투자 목적으로 사용될 수 있으며, 유료 사용자에게는 7월 12일부터 토큰 기반 요금제로 전환된다. 이 모델은 주식 연구에 적합하며, 사용자가 어떻게 설정할 수 있는지에 대한 단계별 가이드를 제공한다. Claude Fable 5는 2026년 6월 12일 미국 상무부의 명령으로 일시적으로 사용이 중단되었으나, 6월 30일 이후 다시 온라인으로 제공된다.
Claude Fable 5는 투자 분석에 있어 가장 강력한 AI 모델로, 사용자들이 이를 통해 보다 효과적인 주식 분석을 수행할 수 있다.