본문으로 건너뛰기

News

AI 뉴스

매일 수집·정리하는 전세계 AI 소식을 최신순으로

NewsAI 리서치·논문·

Thinking Machines Lab의 Inkling 모델과 Moonshot AI의 Kimi K3 모델 발표

Thinking Machines Lab은 9750억 개의 파라미터를 가진 Inkling 모델을 발표했다. 이 모델은 41억 개의 활성 파라미터와 텍스트, 이미지, 오디오 입력을 지원하며, 100만 토큰의 컨텍스트 윈도우를 갖추고 있다. Moonshot AI는 2.8조 개의 파라미터를 가진 Kimi K3 모델을 소개했으며, 이는 896명의 전문가 중 16명을 활성화하고, 비전과 100만 토큰의 컨텍스트를 지원한다. PrismML은 5.9GB의 크기를 가진 Bonsai 27B 모델을 발표했으며, 이는 현대 스마트폰의 메모리에 적합하다고 주장하고 있다. OpenAI는 GPT-Red라는 내부 자동화된 레드팀 시스템을 도입하여 다른 모델의 취약점을 발견하고 공격하는 데 사용하고 있다.

TheSequence (Jesus Rodriguez)원문

AI에 기반한 기술 전략을 수립한 경영진의 경험

Nik Suresh의 관점에서 AI 열풍이 대기업의 의사결정을 어떻게 압도하고 있는지를 다루고 있다. 한 경영진은 20억 달러 이상의 매출을 올리는 조직을 위해 AI 중심의 기술 전략을 수립했지만, 실제로 ChatGPT나 다른 AI 도구를 사용해본 적이 없다고 고백했다. 또 다른 사례로, 한 엔지니어는 자신의 직업을 유지하기 위해 AI에게 Go 저장소를 Zig로 재작성하도록 지시하는 상황을 언급했다. 고객의 경영진이 100배 생산성을 주장하는 상황에서, 공급업체의 경영진이 이를 반박하면 신뢰성에 타격을 줄 수 있다는 우려도 제기되었다.

AI 중심의 기술 전략을 수립하는 경영진이 실제 도구를 사용해본 경험이 없다는 점은 기업의 의사결정 과정에서의 신뢰성 문제를 시사한다.

Simon Willison's Weblog원문
NewsAI 코딩·

Claude Code v2.1.181에서 Rust로 작성된 Bun 사용

Claude Code v2.1.181(2023년 6월 17일 출시)부터 Rust 포트의 Bun을 사용하며, 리눅스에서 시작 속도가 10% 빨라졌지만 다른 변화는 거의 없었다. Claude Code 설치에서 Bun v1.4.0이 사용되고 있는 것을 확인할 수 있었으며, 이는 아직 출시되지 않은 Bun 버전의 미리보기를 지원한다. Rust 버전은 현재 Bun canary로 제공되며, 'bun upgrade --canary' 명령어로 설치할 수 있다.

Claude Code는 Rust로 작성된 Bun을 사용하여 성능 개선을 이루었다.

Simon Willison's Weblog원문

Mamdani 시장, 집주인이 AI 이미지를 사용해 광고할 수 없다고 발표

Mamdani 시장은 집주인들이 AI 이미지를 사용하여 부동산을 광고하는 것을 비밀리에 할 수 없다고 밝혔다. 이와 관련된 논의는 Hacker News에서 이루어졌으며, 해당 기사에는 28개의 댓글이 달렸다.

Hacker News (Front Page)원문

Dave Eggers, OpenAI 직원들에게 ChatGPT의 교육계에 미치는 영향 비판

작가 Dave Eggers는 Sam Altman의 초청으로 OpenAI 직원 약 200명에게 강연을 하였으며, 이 자리에서 ChatGPT가 교육자들에게 미치는 영향이 재앙적이라고 언급했다. 그는 ChatGPT가 의도했든 아니든 교육계에 부정적인 영향을 미쳤다고 주장했다.

The Verge — AI원문
NewsAI 툴·

SQLite Query Explainer: SQLite 쿼리 계획을 설명하는 도구

SQLite Query Explainer는 Python에서 Pyodide를 통해 웹 브라우저에서 SQLite를 실행하고, EXPLAIN 및 EXPLAIN QUERY PLAN의 결과에 대한 설명을 추가하는 인터랙티브 도구이다. 이 도구는 Julia Evans의 블로그에서 영감을 받아 개발되었으며, SQLite 쿼리 계획을 읽는 데 도움을 줄 수 있다.

Simon Willison's Weblog원문
NewsAI 모델·API·

catmind-1.2b 모델 소개

catmind-1.2b는 LFM2.5-1.2B-thinking 모델을 기반으로 한 고양이 관련 이야기 생성 모델이다. 이 모델은 사용자의 질문에 대해 관련 없는 고양이 이야기를 생성하며, 정확도는 24.3%로 LFM2.5-1.2B-Thinking의 75.6%와 LFM2.5-1.2B-Instruct의 49.2%에 비해 낮다. 이 모델은 진지한 작업에 사용하지 않는 것이 권장된다.

catmind-1.2b의 정확도는 24.3%로, 기존의 LFM2.5-1.2B-Thinking 모델보다 성능이 떨어진다.

r/LocalLLaMA원문
NewsAI 모델·API·

Basalt Labs, HLE에서 99.44% 주장과 DeepSeek 모델 제공

Basalt Labs는 HLE에서 99.44%의 성능을 주장하며, 그들이 공개한 모델은 Qwen2.5-7B-Instruct 기반이다. 또한, 그들이 웹사이트에서 제공하는 모델은 DeepSeek이다.

99.44%의 성능 주장은 모델의 신뢰성을 검증하는 데 중요한 요소가 될 수 있다.

r/LocalLLaMA원문
NewsAI 툴·

AI가 의료 사전 승인 절차를 개선할 수 있을까?

의료 사전 승인(prior authorization) 절차는 환자가 의사가 추천한 치료를 받기 위해 건강 보험사의 승인을 받는 과정이다. 이 과정은 비용 절감의 역할을 하지만, 많은 의사들은 승인 지연으로 인해 환자가 치료를 포기할 수 있다고 우려하고 있다. AI는 방대한 정보를 효율적으로 처리하여 명확한 청구의 승인을 신속하게 할 수 있는 가능성이 있지만, AI 기반의 사전 승인은 잘못된 보험 청구 거부를 증가시킬 수 있다는 저항에 직면해 있다. 2025년 미국의사협회 조사에 따르면, 61%의 의사가 AI가 필요한 치료의 거부를 악화시킬 것이라고 우려하고 있다.

2025년 미국의사협회 조사에서 61%의 의사가 AI가 필요한 치료의 거부를 악화시킬 것이라고 우려하고 있다.

Ars Technica — AI원문
NewsAI 리서치·논문·

OpenAI의 GPT-5.6 모델과 DeepSeek-R1의 추론 모델

OpenAI는 최근 GPT-5.6 모델 패밀리를 출시했으며, 이 모델은 세 가지 크기로 제공되고 각기 다섯 또는 여섯 가지 추론 노력 설정을 포함한다. DeepSeek-R1은 강화 학습을 통한 검증 가능한 보상(RLVR) 기법을 사용하여 LLM을 추론 모델로 전환하는 방법을 제안했다. RLVR은 수학과 코드와 같은 검증 가능한 데이터 도메인에서 보상 신호를 제공한다. 이 과정에서 중간 추론 흔적은 모델 훈련에 사용되지 않았다.

GPT-5.6 모델은 다양한 추론 노력 설정을 통해 복잡한 문제 해결 능력을 향상시킬 수 있다.

Ahead of AI (Sebastian Raschka)원문
NewsAI 코딩·

바이브 코딩 전에 알아야 할 7가지 기본 개념

바이브 코딩을 할 때 발생할 수 있는 문제는 기본 개념 부족에서 비롯된다. AI는 확률 기반 생성으로 항상 옳지 않으며, 결과를 직접 실행하고 검증해야 한다. 프롬프트를 구체적으로 나누어 요청하고, HTML, CSS, JavaScript, 터미널, 컨텍스트를 이해하면 문제 해결이 쉬워진다. Git을 사용해 저장 지점을 만들고 로컬과 배포의 차이를 이해해야 안정적인 결과물을 공유할 수 있다.

AI는 확률 기반 생성으로 항상 정확하지 않으므로, 결과를 검증하는 습관이 필요하다.

요즘IT (Yozm IT)원문
NewsAI 코딩·

AI와 200만 줄의 코드 작성 경험에서 얻은 교훈

25년 경력의 소프트웨어 아키텍트가 AI와 함께 200만 줄의 코드를 작성했으나, 실제로는 단 5분도 자율적으로 작동하지 않는 결과물을 경험했다. AI에게 ‘무엇을(what)’과 ‘어떻게(how)’만 주면 작동하지 않는 코드가 생성되며, 빠진 변수는 ‘왜(why)’라는 점을 강조했다. AI의 속도는 빠르지만, 엔지니어링의 완성도는 부족하다는 문제를 지적하며, AI의 결과물이 껍데기에 불과할 수 있음을 경고했다.

AI에게 ‘왜(why)’를 명확히 제시하지 않으면, 기능적으로 텅 빈 코드가 생성될 수 있다.

요즘IT (Yozm IT)원문
NewsAI 툴·

클로드 코드, 휴대폰에서 로컬 세션 이어가기 기능 출시

지난 2월 클로드 코드에 '리모트 컨트롤(Remote Control)' 기능이 출시되어 VPN이나 SSH 세팅 없이도 휴대폰에서 로컬 세션을 이어갈 수 있게 되었다. 6월에는 이 기능이 모든 요금제로 확대 적용되었다. 웨비나에서는 클로드 코드 외 다른 AI CLI와의 연동 및 여러 세션을 동시에 볼 수 있는 '세션 캐스트' 도구에 대한 발표가 있었다.

클로드 코드의 '리모트 컨트롤' 기능을 통해 개발자는 휴대폰에서도 로컬 세션을 쉽게 이어갈 수 있다.

요즘IT (Yozm IT)원문

미국 법원에서 AI 사용에 대한 판사들의 우려와 대응

미국의 판사들은 법정에 들어오는 변호사와 소송 당사자들에게 AI 사용에 대한 지침을 설정하고 있으며, AI를 잘못 사용한 변호사들에게 제재를 가하고 있다. Northwestern 연구진의 조사에 따르면 112명의 판사 중 60%가 최소한 하나의 AI 도구를 사용하고 있으며, 22%는 매주 또는 매일 AI 도구를 사용하고 있다. 그러나 판사들은 AI의 신뢰성에 대해 의구심을 가지고 있으며, AI가 생성한 허위 사례를 인용한 변호사들에게 제재가 가해진 사례도 있다. 이를 해결하기 위해 Judicial AI Consortium (JAIC)이 설립되었고, 교육이 필요하다는 의견이 제기되었다.

60%의 판사들이 AI 도구를 사용하고 있다는 점은 법률 분야에서 AI의 활용이 증가하고 있음을 나타낸다.

Axios — Technology원문
NewsAI 모델·API·

Deepseek의 가격 대비 성능 분석

Deepseek는 가격 대비 성능에서 항상 우수한 평가를 받아왔으며, 최근 Kimi K3 점수에 대한 인공지능 분석 리더보드에서 놀라운 차트를 보여주었다. 이는 API 보조금 때문인지, 아니면 모델 최적화가 이뤄졌기 때문인지에 대한 의문을 불러일으킨다.

Deepseek의 가격 대비 성능 우수성은 인공지능 모델 최적화의 가능성을 시사한다.

r/LocalLLaMA원문
NewsAI 툴·

BaseRT는 llama.cpp보다 6.4배, MLX보다 3.9배 빠름

BaseRT는 llama.cpp보다 6.4배, MLX보다 3.9배 더 빠른 성능을 제공한다.

BaseRT의 성능 개선은 AI 모델의 처리 속도를 향상시킬 수 있다.

Product Hunt — Artificial Intelligence원문

Claude Fable 5, Max 및 Team Premium 플랜에 포함

2023년 7월 20일부터 Claude Fable 5가 모든 Max 및 Team Premium 플랜에 포함되며, 사용 한도의 50%로 제공된다. Pro 및 Team Standard 사용자들은 사용 크레딧을 통해 Fable에 계속 접근할 수 있으며, 일회성 $100 크레딧을 받는다. $20/month 플랜 사용자들은 여전히 Fable 5에 접근할 수 없다.

Max 플랜은 월 $100 및 $200로 제공되며, Fable 5의 포함 여부가 사용자 선택에 영향을 미칠 수 있다.

Simon Willison's Weblog원문

챗GPT SOL 5.6로 영상 편집 시간 단축하기

챗GPT의 SOL 5.6 버전을 사용하여 유튜브 영상 편집 시간을 최소 5시간 이상 절약한 경험을 공유하며, ChatCut이라는 서비스로 컷편집과 하이라이트 클립 작업을 무료로 진행할 수 있다고 설명한다. ChatCut은 영상의 음성을 분석하여 편집 방향을 제시하고, 사용자가 요청한 내용을 바탕으로 필요한 구간을 찾아 편집한다. 또한, 자동 자막 생성 기능도 제공하여 편집 시간을 단축할 수 있다.

ChatCut을 통해 영상 편집을 자동화하면 수작업으로 편집하는 것보다 시간을 크게 절약할 수 있다.

AI 코리아 커뮤니티 뉴스레터원문

Google 지원 FireSat 프로그램의 첫 번째 위성 발사

Google 지원 FireSat 프로그램의 첫 세 개의 운영 위성이 2026년 7월 7일 캘리포니아 반덴버그 우주군 기지에서 SpaceX Falcon 9 로켓에 의해 발사되었다. 이 위성들은 미국, 호주, 유럽에서 작은 화재까지 감지할 수 있는 능력을 갖추고 있으며, 연말까지 화재 감지를 시작할 예정이다. FireSat는 화재 감지를 위해 특별히 설계된 첫 번째 위성 군으로, 지구의 화재 위험 지역을 하루에 최소 두 번 모니터링할 수 있다. 이 프로젝트는 비영리 단체 Earth Fire Alliance가 관리하며, Google로부터 1,500만 달러 이상의 지원을 받았다.

FireSat는 화재 감지를 위해 특별히 설계된 첫 번째 위성 군으로, 작은 화재까지 감지할 수 있는 기능을 제공한다.

Ars Technica — AI원문
NewsAI 툴·

TikTok, AI 유사성 탐지 도구 테스트 시작

TikTok은 AI 유사성을 탐지하는 선택적 도구를 테스트 중이며, 일부 미국 크리에이터가 참여하고 있다. 이 도구를 사용하려는 크리에이터는 Jumio라는 회사와 함께 신원 확인을 해야 하며, 실시간 셀카 스캔과 신분증 확인을 거쳐야 한다. TikTok은 신분증 문서를 보관하지 않으며, 얼굴 정보도 저장하지 않는다고 밝혔다.

TikTok의 새로운 도구는 AI 유사성을 탐지하여 크리에이터가 이를 신고할 수 있도록 하며, 이는 콘텐츠 관리에 중요한 역할을 할 수 있다.

The Verge — AI원문
NewsAI 에이전트·

Amazon Quick: 판매 조직을 위한 AI 어시스턴트

Amazon Quick은 판매 팀이 행정 업무에 소요되는 시간을 줄이고 판매에 더 집중할 수 있도록 돕는 AI 어시스턴트이다. Quick은 CRM, 이메일, 웹 분석 및 지원 시스템과 연결하여 구매 의도가 높은 잠재 고객을 자동으로 식별하고 우선 순위를 매긴다. 이를 통해 판매 팀은 더 많은 지역을 커버하고, 거래를 더 빠르게 성사시키며, 고객 충성도를 높일 수 있다.

Amazon Quick은 CRM과 통합하여 구매 의도가 높은 잠재 고객을 자동으로 식별하고 우선 순위를 매김으로써 판매 팀의 효율성을 높인다.

AWS Machine Learning Blog원문

Apple, OpenAI에 대한 영업비밀 소송 제기

Apple은 OpenAI에 대해 영업비밀 소송을 제기했다. 이 소송은 OpenAI의 최고 하드웨어 책임자까지 포함된 일련의 위법 행위를 주장하며, OpenAI에는 400명 이상의 전 Apple 직원이 근무하고 있다고 한다. OpenAI는 현재 IPO를 계획하고 있는 상황에서 이 소송에 대한 신중한 대응을 하고 있다.

OpenAI의 IPO 계획에 중대한 영향을 미칠 수 있는 소송이다.

TechCrunch — AI원문

Apple, OpenAI를 상대로 소송 제기

Apple이 OpenAI를 상대로 소송을 제기했다. 이 소송은 전문가들에 의해 많은 주장들이 일반적인 관행에 불과하다는 의견이 제기되고 있다. Apple은 새로운 Siri AI 소프트웨어의 공개 베타를 출시하는 시점에 OpenAI와의 공개적인 갈등을 선택한 이유에 대해 논의되고 있다.

Apple의 새로운 Siri AI 소프트웨어 출시와 관련하여 OpenAI와의 법적 분쟁이 업계에 미치는 영향이 주목된다.

The Verge — AI원문

AI 기업들이 청소년 보호를 위한 조치 시행

OpenAI는 청소년들이 AI에 접근할 수 있도록 안전장치를 마련해야 한다고 주장하며, 부모가 설정한 시간 제한과 휴식 알림 기능을 제안했다. Anthropic은 사용자가 18세 이상임을 확인하기 위해 생년월일을 입력해야 하는 정책을 시행하고 있다. Meta는 자사의 챗봇과 대화 중 자해 언급이 있을 경우 부모에게 알리겠다고 발표했다. 주요 AI 기업들은 사용자의 쿼리를 기반으로 연령을 예측하는 머신러닝을 활용하여 추가 검증이 필요한 계정을 표시하고 있다. 그러나 청소년 안전은 제품 업데이트 이상의 지원이 필요하다고 강조되었다.

OpenAI는 청소년들이 AI를 사용할 때 부모의 시간 제한과 휴식 알림 기능을 통해 안전성을 높이려 하고 있다.

Semafor Technology원문