Category
AI 툴
코딩 보조, 이미지·영상 생성, RAG 구축, 에이전트 프레임워크 등 실무에 바로 붙이는 AI 도구를 다룬다. 출시 소식보다 가격 정책, API 한도, 한국어 처리 품질, 기존 스택과의 연동성에 초점을 둔다. 비슷한 도구 사이에서 무엇을 골라야 하는지가 핵심이다.
Codex와 함께 개인 웹사이트 프로토타입 구축하기
Ben Tossell은 개인 웹사이트를 재구성하기 위해 Codex를 사용하여 프로토타입을 만들었다. 그는 BB 앱의 이미지를 Codex에 제공하고, 초기 디자인을 바탕으로 피드백을 주며 반복적으로 수정 작업을 진행했다. 최종적으로 각 스레드의 콘텐츠를 개별 Markdown 파일에서 가져오도록 설정하고, 사이트를 배포하기 위해 here.now를 사용했다. 또한, 사이트의 복잡성을 줄이기 위해 애니메이션과 인터랙션을 추가하는 아이디어를 검토했으나, 개인 사이트의 복잡함을 우려하여 이를 포기했다.
Federated Kubernetes와 AI 플랫폼에서 사용자 신원 관리
현대 AI 플랫폼은 더 이상 단일 로그인 화면 뒤에 있는 단일 애플리케이션이 아니다. 사용자는 중앙 포털에서 시작하여 관리되는 데이터 세트를 열고, 해당 데이터가 있는 노트북을 실행하며, 다른 클러스터의 서비스를 호출하는 어시스턴트를 사용할 수 있다. 이 과정에서 사용자 신원은 제어 평면과 데이터 평면의 경계를 넘나든다.
Microsoft의 Project Zenith, 개발자 최적화된 Windows 경험 제공
Microsoft는 개발자 최적화된 Windows 경험을 Project Zenith라는 이름으로 발표했다. 이 프로젝트는 64GB 이상의 통합 메모리를 갖춘 새로운 개발자 중심 장치를 위해 설계되었으며, 사전 구성된 Windows 설정과 개발자가 자주 사용하는 도구 세트를 제공한다. 이러한 장치에서 개발자는 30B 이상의 파라미터 모델을 로컬에서 무제한으로 실행할 수 있어 실험을 가속화할 수 있다.
sanoTTS: 294k 파라미터로 구성된 가장 작은 TTS 스택
sanoTTS는 294k 파라미터(337 KB)로 구성되어 있으며, $3 마이크로컨트롤러에서 실행될 수 있다. 이 모델은 11개의 음성과 6개 언어를 지원하며, kokoro보다 244배, voxtral TTS보다 9000배 작다. 1.5m 모델의 SCOREQ는 4.13이며, esp32 마이크로컨트롤러에서 RTF 0.225를 기록하여 4초의 오디오를 1초 만에 생성할 수 있다.
챗GPT 무료 계정 텍스트 대화 무제한 제공 및 AI 서비스 정리
2026년 8월 6일부터 챗GPT 무료 계정의 텍스트 채팅이 무제한으로 제공된다. 기본 모델은 GPT-5.6 Luna이며, 다양한 작업을 수행할 수 있다. 이 외에도 클로드와 제미나이 등 다른 무료 AI 서비스의 특성과 한도 구조가 다르므로, 작업에 따라 적절한 서비스를 선택할 수 있다.
Fable 5.1 출시, 성능 개선 및 새로운 기능 추가
Fable 5.1이 출시되었으며, 사용자가 더 빠르고 쉽게 대화할 수 있도록 개선되었다. 새로운 시스템 프롬프트가 추가되어 노래 가사와 저작권이 있는 로고를 반복하지 않도록 설정되었다. 또한, Anthropic은 Fable의 입력 캐싱 비용을 75% 줄여 API 사용 비용을 약 25% 낮췄다. Gemini 모델은 비디오의 중요한 순간을 검색하여 88% 적은 토큰을 사용하고, 정확도를 소폭 향상시켰다.
Cursor의 Self-hosted Machines 기능 소개
Cursor는 **self-hosted machines** 기능을 지원하여 도구 실행을 완전히 내부 네트워크에서 수행할 수 있게 한다. 코드베이스, 빌드 출력 및 비밀 정보는 모두 내부 인프라에서 실행되는 머신에 저장되며, 에이전트는 로컬에서 도구 호출을 처리한다. **My Machines** 기능을 통해 개인 워크플로우를 위한 단일 노트북이나 VM을 계정에 연결할 수 있으며, **Team pools**는 팀이나 기업을 위한 작업자 대기열을 제공한다. 이러한 풀은 요청이 들어올 때 용량을 늘리고 작업자가 연결 해제될 때 줄어들 수 있어 수요에 따라 확장 가능하다. 또한, 풀은 유휴 머신을 하이버네이트하고 후속 요청이 들어오면 복원할 수 있다. Self-hosted workers는 Linux와 Mac에서 컴퓨터 사용을 지원하며, 적절한 데스크탑 패키지를 통해 클릭, 입력, 스크린샷 촬영 및 브라우저 조작이 가능하다.
AI 용어 해독: 루프, 하네스, 스쿼드, 힐 클라이밍
AI 도구의 발전으로 소프트웨어 개발에서 새로운 용어들이 등장하고 있다. 루프 엔지니어링은 반복 가능한 시스템을 설계하는 방법으로, 매일 수동으로 작업을 요청하는 대신 정해진 일정에 따라 작업을 수행하도록 한다. Ralph 루프는 세부 작업을 반복적으로 수행하게 하는 방법으로, 대규모 작업을 작은 사이클로 나누는 데 유용하나 비용이 많이 든다. 스쿼드는 다양한 역할을 가진 에이전트 그룹을 의미하며, 플릿은 동시에 작업하는 에이전트를 지칭한다. 하네스는 모델을 둘러싼 시스템으로, GitHub Copilot이 좋은 예시이다. 힐 클라이밍은 에이전트와 하네스를 개선하는 과정을 설명한다.
Jamf의 Amazon Bedrock 실시간 비용 집행 시스템 구축
Jamf는 Amazon Bedrock에 대한 엔지니어의 일일 지출을 추적하고 예산에 근접할 때 모델 제한을 적용하는 시스템을 구축했다. 예를 들어, 일일 예산의 80%에 도달하면 Anthropic Claude Opus 접근을 차단하고, 100%에 도달하면 Anthropic Claude Sonnet 접근을 차단한다. 이 시스템은 몇 분 내에 제한을 적용하며, 재인증 없이 자동으로 다음 일일 리셋 시 복구된다.
OpenAI Codex에 LibreOffice 포함
OpenAI Codex의 데스크톱 앱은 1.7GB의 데이터가 포함된 'codex-primary-runtime' 폴더를 가지고 있으며, 이 폴더에는 Python, Node.js 설치와 함께 LibreOffice 오픈 소스 오피스 제품군이 포함되어 있다. 또한, Codex가 이러한 바이너리를 찾고 사용하는 방법을 알려주는 스킬이 포함된 폴더도 존재한다.
디자인 시스템을 AI에 적용했을 때의 문제점
AI에 디자인 시스템을 적용했지만, 결과물의 품질이 기대에 미치지 못하는 사례가 소개되었다. AI는 색상이나 폰트 스타일을 임의로 조합하고, 기존 컴포넌트를 무시하며 새로운 요소를 생성하는 경향이 있다. 또한, 디자인 시스템이 단어장 수준에 그치고, 문맥이나 규칙을 이해하지 못해 결과물이 어색하게 나타나는 문제도 지적되었다.
OpenAI의 Jalapeño 칩 성능 개선 및 Gemini 3.7 출시
2026년 8월 26일 방송된 LWiAI Podcast 255회에서는 AI 관련 주요 뉴스가 다뤄졌다. OpenAI는 Jalapeño 추론 칩의 초기 결과를 발표하며, 업계 최고의 속도와 효율성을 보여주고 연말까지 내부 배포를 계획하고 있다. Google은 Gemini 3.7을 출시했으며, SpaceXAI는 Grok 4.6을 발표했다. OpenAI는 Hugging Face 해킹 사건 이후 보안 강화를 위한 조치를 발표했다.
Meta의 Pocket 앱, 사용자 친화적인 AI 기반 게임 프로토타입 제작 가능
Meta는 2023년 8월 21일에 Pocket이라는 모바일 앱을 출시했다. 이 앱은 사용자가 텍스트 박스에 프롬프트를 입력하기만 하면 복잡한 코드 없이도 완전한 인터랙티브 '기즈모'를 만들 수 있게 해준다. Pocket은 TikTok 스타일의 무한 스크롤로 제작한 기즈모를 공유할 수 있는 기능을 제공하며, 사용자는 LLM과 대화하는 방식으로 게임 프로토타입을 쉽게 제작할 수 있다. 그러나 이러한 결과물은 Meta의 생태계 안에 갇혀 있어 독립적으로 활용하기 어렵다.
GLM 5.3과 GLM 5.3 Flash가 RTX PRO 6000 WS에서 로컬 실행
GLM 5.3과 GLM 5.3 Flash 모델이 RTX PRO 6000 WS에서 로컬로 실행되었으며, BlenderMCP를 사용하여 260㎡의 럭셔리 듀플렉스 펜트하우스를 모델링하였다. GLM 5.3은 450-470GB, Flash는 190-200GB의 크기를 가지며, Flash는 811개의 객체를 생성하는 데 38분 52초가 걸린 반면, GLM 5.3은 847개의 객체를 생성하는 데 40분 43초가 걸렸다. GLM 5.3은 객체를 배치하기 전 21분 55초를 소요한 반면, Flash는 10초 만에 작업을 시작하였다.
Graham Dumpleton의 Wrapture 소개
Graham Dumpleton이 개발한 Wrapture는 wrapt의 monkeypatching 아이디어를 확장하여 테스트와 추적을 동시에 적용할 수 있는 기능을 제공한다. 이 라이브러리는 모든 함수나 메서드를 쉽게 감싸서 접근을 추적하거나 다른 값을 반환하도록 오버라이드할 수 있게 해준다. Wrapture는 OpenTelemetry 지원을 포함하며, 기존 Python 프로젝트에 추적을 추가하는 구성 기반 메커니즘을 제공한다.
Google Ads와 Google Analytics의 새로운 AI 도구로 마케팅 워크플로우 간소화
Google Ads와 Google Analytics에서 새로운 AI 및 에이전틱 경험을 통해 마케팅 워크플로우를 간소화할 수 있는 방법을 배울 수 있다.
Sheets canvas로 스프레드시트 데이터를 인터랙티브 대시보드로 변환
Sheets canvas는 데이터를 인터랙티브 대시보드, 맞춤형 학습 추적기, 좌석 배치도 등으로 변환할 수 있는 기능을 제공하며, 간단한 프롬프트로 이러한 작업을 수행할 수 있다.
Adobe가 Photoshop에 AI 중심 업데이트 추가
Adobe는 Photoshop에 AI 도구 전용 인터페이스인 'AI Assisted Editor' 뷰를 포함한 업데이트를 베타로 출시하고 있다. 이 뷰는 Photoshop의 모든 AI 기능을 단일 툴바에 보여주며, 프롬프트 기반 이미지 편집기, 배경 제거기, AI 이미지 확장기 등을 포함한다. 또한, AI를 활용한 편집 정교화 방법으로 이미지에 직접 그려서 변경 사항을 표시하는 'markup' 기능이 추가되어, 색상 변경 영역 선택, 위치 표시 화살표 스케치, 새로운 요소 제안을 위한 대략적인 형태 브러시 사용 등이 가능하다.
GLM 5.3 Flash와 Qwen 3.8 Flash Next 비교
GLM 5.3 Flash(oQ4e MLX)와 Qwen 3.8 Flash Next(q4 K XL)가 각각 약 1시간 30분 동안 주어진 참조 이미지를 기반으로 '비디오 게임 또는 기술 데모'를 재현하는 실험이 진행되었다. GLM은 참조 이미지의 스케일에서 더 가까웠고, 초기부터 더 많은 세부사항을 포함했다. Qwen은 10분 만에 애니메이션 픽셀 아트 도시를 생성했지만, 주어진 지시사항을 잘 이해하지 못하고 결과에 만족한 것으로 보였다. GLM은 238k 토큰을 사용하여 플레이 가능한 픽셀 아트 '걷기 시뮬레이터'를 만들었다.
Twine을 활용한 인터랙티브 회고 도구 개발
‘메모어’라는 모임에서 회고를 하던 중 권태를 느낀 작성자가 AI를 활용한 인터랙티브 회고 도구를 개발했다. 이 도구는 사용자가 작성한 회고 초안을 AI가 읽고 질문을 던져 내용을 구체화한 후, 최종적으로 회고를 완성한다. 또한, Twine이라는 오픈 소스 도구를 사용하여 비선형적인 이야기를 시각적으로 구성할 수 있도록 했다. 사용자는 선택의 순간을 탐색하며 자신의 선택을 되짚어볼 수 있다.
StemDeck, 무료 오픈소스 로컬 AI 줄기 분리기
StemDeck은 무료이며 오픈소스인 로컬 AI 줄기 분리기이다. 관련 정보는 GitHub에서 확인할 수 있다.
llm 0.33 버전 출시 및 주요 변경 사항
llm 0.33 버전이 출시되었으며, OpenAI Python 라이브러리 3.x로 업그레이드되고 HTTP 클라이언트 의존성이 httpx에서 httpx2로 변경되었습니다. llm embed 및 llm embed-multi 명령어는 --key 옵션을 지원하며, Python의 여러 embed 관련 메서드도 key= 옵션을 받아들입니다. llm prompt -t/--template 명령어는 여러 템플릿을 결합할 수 있도록 반복 사용이 가능해졌습니다. 또한, Reasoning-capable Responses API 모델은 reasoning_summary 옵션을 지원합니다.
eli5: 어려운 주제를 쉽게 설명하는 AI 도구
eli5는 복잡한 주제를 쉽게 설명해주는 도구로, 앤트로픽의 클로드 코드에서 사용할 수 있다. 사용자는 /eli5 명령어 뒤에 주제를 입력하면, 큰 그림과 짧은 글로 구성된 설명을 받을 수 있다. 이 도구는 기획서나 발표 자료의 밑그림을 잡는 데 유용하며, 복잡한 개념을 빠르게 이해하는 데 도움을 준다.
Goodfire의 Silico 플랫폼, AI 해석 도구 공개
Goodfire는 AI 모델의 행동을 해석하기 위한 도구를 제공하는 Silico 플랫폼을 일반에 공개했다. 이 플랫폼은 사용자가 AI 모델의 작동 방식을 이해할 수 있도록 돕는 다양한 해석 도구를 포함하고 있으며, 사용자가 원하는 조사를 자연어로 설명하면 실험 계획을 자동으로 수립하여 작업을 수행한다. Goodfire는 또한 학술 및 비영리 해석 연구자에게 100만 달러의 무료 Silico 사용을 제공하는 보조금 프로그램을 발표했다.