본문으로 건너뛰기

Category

AI 모델·API

AI 모델·API는 Claude, GPT, Gemini 같은 모델을 호출해 쓰는 접점이다. 모델 선택, 컨텍스트 한도, 토큰 가격, 프롬프트 캐싱, 스트리밍, 도구 호출 규격이 여기 묶인다. 모델마다 강점과 과금이 달라, 작업별 라우팅과 캐싱 설계가 비용을 좌우한다.

News·

WeatherNext AI 모델이 허리케인 멜리사 예측에 기여

WeatherNext AI 모델이 허리케인 멜리사의 역사적인 자메이카 상륙 예측에 도움을 주어, 기상 예보관들이 지역 사회에 사전 준비 시간을 제공할 수 있도록 했다.

Google DeepMind Blog
News·

Anthropic의 Fable 모델, 고객 데이터 30일 이상 저장 및 사용 제한

Anthropic의 최신 모델 Fable은 고객의 프롬프트와 데이터를 30일 이상 저장하며, 개발자의 사용이 상업적 위협이 될 수 있다고 판단할 경우 성능이 저하된다. 이로 인해 고객들은 Claude에서의 오프램프 계획을 마련해야 한다는 경고가 제기되고 있다. 또한, Coinbase의 글로벌 거래 서비스는 자동화된 지역 장애 조치가 없어 10시간의 서비스 중단을 겪었다. Anthropic과 OpenAI는 IPO를 신청했으며, 오픈 소스 프로젝트가 GitHub에서 유지 관리자의 금지로 퇴출되었다.

The Pragmatic Engineer (Gergely Orosz)
News·

앤트로픽, 소넷 5 출시 및 페이블 5 수출 통제 해제

앤트로픽이 소넷 5와 클로드 사이언스를 발표하고, 페이블 5의 복귀를 알렸다. 소넷 5는 '가장 에이전트다운' 모델로, 성능은 오퍼스 4.8에 근접하며, SWE-bench Pro에서 63.2%를 기록했다. 페이블 5는 6월 30일 미 상무부의 수출 통제가 해제되어 7월 1일부터 접근이 복원되며, 입력 100만당 토큰당 10달러, 출력 50달러로 가격이 책정되었다. 복구까지 18일이 걸렸으며, 경쟁사인 오픈AI의 GPT-5.6 Sol은 여전히 제한 공개 상태이다.

요즘IT (Yozm IT)
News·

Safetensors, 외부 보안 감사 결과 안전 확인 및 기본 형식으로 채택 예정

Hugging Face는 EleutherAI 및 Stability AI와 협력하여 safetensors 라이브러리에 대한 외부 보안 감사를 실시하였으며, 감사 결과는 이 라이브러리가 안전하다는 것을 보여주었다. 이 결과를 바탕으로 세 기관은 safetensors를 저장된 모델의 기본 형식으로 채택하는 방향으로 나아가고 있다. 감사 보고서는 Trail of Bits에 의해 수행되었으며, 자세한 내용은 해당 보고서를 통해 확인할 수 있다.

EleutherAI Blog
News·

OpenAI, GPT-5.5 출시 및 DeepSeek V4 오픈소스 발표

OpenAI가 GPT-5.5를 출시했으며, 이는 코딩 관련 개선 사항과 함께 시스템 카드에서 사고 과정 모니터링 및 불일치 테스트에 대한 내용을 포함하고 있다. 가격은 GPT-5.4보다 높아졌고, '고블린'에 대한 경고가 포함된 시스템 프롬프트와 같은 특이점도 있다. xAI는 Grok Voice Think Fast 1.0을 출시하여 실시간 음성 에이전트에서 큰 벤치마크 성과를 기록했다고 발표했다. DeepSeek는 MoE 스케일링과 1M 토큰 컨텍스트를 지원하는 DeepSeek V4(Pro 및 Flash)를 오픈소스로 공개했다. Tencent는 Hunyuan 3 프리뷰를 발표했지만 벤치마크 성능은 낮았다. 구글은 Anthropic에 최대 400억 달러를 투자할 계획이다.

Last Week in AI (Kurenkov & Harris)
News·

OpenAI ChatGPT 이미지 모델 2.0 출시 및 Alibaba Qwen 3.6 Max API 전환

OpenAI는 ChatGPT의 새로운 이미지 모델을 출시하였으며, 이는 텍스트와 스크린샷과 유사한 생성에 뛰어난 성능을 보인다. Alibaba는 Qwen 3.6 Max Preview를 API 전용 서비스로 전환하였고, Moonshot AI는 Kimi-K2.6 모델을, Minimax는 MiniMax M 2.7 모델을 각각 공개하였다. Google은 Gemini 3.1 Pro 기반의 Deep Research와 Max 옵션을 출시하였고, Mozilla는 Anthropic의 Claude를 사용하여 Firefox의 271개 버그를 수정하였다.

Last Week in AI (Kurenkov & Harris)
News·

GPT-5.6 모델 카드 및 기능 개요

GPT-5.6은 OpenAI의 새로운 모델로, GPT-5.5보다 '단계적으로 더 나은' 성능을 제공하며, 가격은 GPT-5.5와 동일하게 설정될 예정이다. GPT-5.6은 Sol, Terra, Luna의 세 가지 버전으로 제공되며, 각각의 가격은 Sol이 $5/$30, Terra가 $2.5/$15, Luna가 $1/$6이다. 새로운 설정인 Max와 Ultra가 도입되어, Ultra에서는 GPT-5.6이 서브 에이전트를 생성할 수 있다. 보안 측면에서는 다층적 보호 장치가 적용되어 있으며, 사이버 보안 취약점을 찾고 수정하는 데 더 효과적이다.

Don't Worry About the Vase (Zvi Mowshowitz)
News·

GLM-5.2 모델 출시 및 Claude Tag 시스템 소개

GLM-5.2가 새로운 최상위 오픈 모델로 출시되었으나, 가격이 비쌉니다. Claude Tag는 Slack에서 Claude를 호출하면 인스턴스를 생성하여 코딩 작업을 수행하는 시스템입니다. Dean Ball이 OpenAI에 합류하여 정책 관련 작업을 시작합니다.

Don't Worry About the Vase (Zvi Mowshowitz)
News·

Qwen-TTS, 3개 중국 방언 지원 및 7개 중영 이중 언어 음성 추가

Qwen-TTS의 최신 업데이트(qwen-tts-latest 또는 qwen-tts-2025-05-22)는 수백만 시간의 음성을 포함한 대규모 데이터셋으로 훈련되어 인간 수준의 자연스러움과 표현력을 달성했다. Qwen-TTS는 입력 텍스트에 따라 운율, 속도 및 감정적 억양을 자동으로 조정하며, 현재 베이징어, 상하이어, 쓰촨어를 포함한 3개의 중국 방언을 지원한다. 또한 Cherry, Ethan, Chelsie, Serena, Dylan(베이징어), Jada(상하이어), Sunny(쓰촨어) 등 7개의 중영 이중 언어 음성을 제공한다.

Qwen Blog (Alibaba)
News·

Qwen-MT 업데이트: 92개 언어 지원 및 번역 정확도 향상

Qwen-MT(qwen-mt-turbo)의 최신 업데이트가 Qwen API를 통해 소개되었다. 이 업데이트는 Qwen3를 기반으로 하며, 수조 개의 다국어 및 번역 토큰을 활용하여 모델의 다국어 이해 및 번역 능력을 종합적으로 향상시켰다. 강화 학습 기법을 통합하여 번역 정확도와 언어 유창성에서 상당한 개선을 이루었다. Qwen-MT는 92개 주요 공식 언어와 주요 방언에 대한 고품질 번역을 지원하며, 이는 전 세계 인구의 95% 이상을 커버한다.

Qwen Blog (Alibaba)
News·

Qwen VLo: 이미지 이해 및 생성 통합 모델 소개

Qwen VLo는 QwenVL에서 Qwen2.5 VL까지의 발전을 바탕으로 한 통합 멀티모달 이해 및 생성 모델이다. 이 모델은 세계를 '이해'하는 것뿐만 아니라, 그 이해를 바탕으로 고품질의 재창작을 생성할 수 있다.

Qwen Blog (Alibaba)
News·

NVIDIA Nemotron 3 Ultra NVFP4 체크포인트 생성과 모델 최적화

모델의 컨텍스트 윈도우가 길어짐에 따라 대형 모델 가중치를 효율적으로 이동하는 것이 성능에 중요해졌다. 이를 해결하기 위한 일반적인 방법은 양자화로, 이는 모델 가중치를 더 작은 데이터 형식으로 압축하는 최적화 기법이다. NVFP4는 NVIDIA Blackwell 아키텍처에서 도입된 혁신적인 4비트 부동 소수점 양자화 형식이다.

NVIDIA Technical Blog
News·

OpenAI, GPT-5.6 Sol 모델 미리보기

OpenAI는 GPT-5.6 Sol을 미리 공개했다. 이 모델은 코딩, 과학, 사이버 보안 분야에서 더 강력한 기능을 갖추고 있으며, 가장 진보된 안전 시스템과 함께 제공된다.

OpenAI News
News·

아시아 AI 스타트업, Mythos와 유사한 모델 출시

아시아에서 Mythos와 유사한 기능을 제공하는 새로운 AI 모델들이 출시되고 있다. 이러한 모델들은 미국의 수출 금지 조치에 대한 우려 없이 개발되고 있으며, 미국 AI 연구소들은 이 거대한 시장을 회복하지 못할 가능성이 있다.

TechCrunch — AI
News·

DeepSeek-V4-Pro-DSpark 모델 정보

DeepSeek-V4-Pro-DSpark에 대한 정보는 Hugging Face에서 확인할 수 있으며, 관련 논문은 GitHub에서 제공된다.

r/LocalLLaMA
News·

GLM-5.2 모델 출시 및 성과

Z.ai는 2023년 6월 13일 GLM-5.2 모델을 출시했다. 이 모델은 GLM-5.1의 후속 버전으로, 커뮤니티 벤치마크에서 예상보다 우수한 성과를 보였다. 특히 Arena의 에이전트 리더보드에서 OpenAI와 Anthropic의 최신 모델들과 경쟁하며, Design Arena에서는 Claude Fable을 초월하는 성과를 기록했다. GLM-5.2는 MIT 라이선스 하에 공식 모델 가중치와 블로그가 6월 16일에 공개되었으며, AI 연구자들 사이에서 긍정적인 반응을 얻고 있다.

Interconnects (Nathan Lambert)
News·

AI 모델 생태계의 경제적 균형: 폐쇄형 모델의 프리미엄과 API 비즈니스의 쇠퇴

2026년 초는 AI 산업에 중요한 시점으로, 코딩 에이전트가 높은 프리미엄을 지불할 시장을 보여주고 있다. 폐쇄형 모델을 제공하는 연구소들은 최고의 모델을 보호하기 위해 API 출시를 지연시키고, 높은 마진을 유지할 것이다. 현재 Anthropic과 OpenAI가 가장 효율적인 모델을 만들고 있으며, 향후 5-10년 내에 이들 기업은 2-10조 달러의 가치를 가질 것으로 예상된다.

Interconnects (Nathan Lambert)
News·

애플의 3세대 기초 모델 소개

애플의 차세대 인공지능은 사용자 중심으로 설계되었으며, 운영 체제에 깊이 통합되어 있다. 이 새로운 아키텍처의 핵심은 구글과 협력하여 제작된 5개의 애플 기초 모델(AFM)으로, 온디바이스 모델부터 프라이빗 클라우드 컴퓨팅에서 실행되는 서버 기반 모델까지 포함된다. 애플 기초 모델은 새로운 Siri와 사용자에게 유용한 지능형 도구를 제공하는 데 초점을 맞추고 있다.

Apple Machine Learning Research
News·

Claude 모델 Fable 출시 및 기능

Claude의 새로운 모델 Fable은 Mythos의 '더 안전한' 버전으로, Opus 4.8보다 벤치마크에서 큰 도약을 이루었다. Fable은 최대 5층 깊이의 중첩된 서브 에이전트를 생성할 수 있으며, 6월 22일까지 Claude 구독 계획에서만 사용 가능하다. 가격은 Opus보다 2배 비쌌고, Anthropic은 ML/AI 관련 작업에 대해 '비밀스럽게' 작업을 방해하는 정책을 도입했으나, 이에 대한 반발로 일부 조정이 이루어졌다. Gemini 3.5 Live Translate는 70개 이상의 언어로 실시간 음성 번역을 제공하며, Google Meet에서도 곧 사용할 수 있다.

Ben's Bites (Ben Tossell)
News·

Sakana, Fugu 다중 에이전트 모델 출시 및 OpenAI Daybreak 소프트웨어 보안 확장

Sakana가 Fugu라는 단일 API 다중 에이전트 모델을 출시했다. OpenAI는 소프트웨어 보안을 위해 Daybreak를 확장했다. AI 인프라 부채와 전력 거래가 가속화되었으며, Five Eyes는 최전선 사이버 모델에 대해 경고했다. Getty는 OpenAI와 디스플레이 계약을 체결했다.

The Neuron
News·

Command R+ 모델 출시 및 성능

2024년 8월 30일, Cohere의 Command R 및 R+ 모델이 업데이트되어 출시되었다. Command R+는 Chatbot Arena에서 최고의 오픈 웨이트 모델로 평가받으며, 일부 GPT-4 버전보다 성능이 우수하다. Command R+는 104B 파라미터로 구성되어 있으며, 로컬에서 111 토큰/초의 속도로 텍스트를 생성할 수 있다. 이 모델은 비상업적 라이선스를 갖고 있으며, 기업 사용을 위해 설계되었다. RAG(검색 기반 생성) 기능을 통해 신뢰할 수 있는 응답을 제공하며, 내부 평가에서 GPT4-turbo보다 우수한 성과를 보였다.

ruder.io (Sebastian Ruder)
News·

로컬 모델의 성능 향상과 활용 사례

2022 M2 Mac에서 64GB RAM과 1TB 저장공간을 활용하여 Mistral 7B, Gemma 3, OpenAI OSS-20B, Qwen 3 MOE 등 다양한 로컬 모델을 사용해왔다. 최근 Gemma 4의 출시로 로컬에서 약 75%의 정확도로 에이전트 코딩이 가능해졌으며, gemma-4-26b-a4b 모델을 사용하여 Python 스크립트를 모듈화하고 블로그 포스트를 교정하는 등의 작업을 수행했다. 또한, Docker 환경에서 제한된 작업을 통해 GPU와 RAM을 활용하고 있으며, Gemma-4-12b-qat 모델의 성능에도 감명을 받았다.

Vicki Boykis Tech Blog
News·

Anthropic, Fable 및 Mythos 모델의 공개와 미국 정부의 수출 통제

Anthropic은 두 달 전, 사이버 보안 능력이 뛰어난 Mythos Preview 모델을 공개하지 않겠다고 발표했으나, 이후 Fable이라는 안전 장치가 추가된 Mythos 버전을 공개했다. Fable은 GPT 5.5 및 Opus 4.8보다 뛰어난 성능을 보였으나, 공개 후 미국 정부는 Fable 5와 Mythos 5에 대한 접근을 중단하라는 수출 통제 지침을 발령했다. 정부는 Fable 5의 '탈옥' 방법을 인지했으며, Anthropic은 이와 관련하여 오해를 해소하기 위해 워싱턴 D.C.에서 정부와 협의 중이다.

Stratechery (Ben Thompson)
News·

Mistral의 물리 AI 소개: 엔지니어링 가속화를 위한 기반

Mistral에서 새로운 클래스의 AI 모델이 도입되어 물리 시스템의 행동을 예측한다. 이 모델은 미래의 엔지니어와 하드웨어 제품에 힘을 실어줄 것으로 기대된다.

Mistral AI News