Category
AI 코딩
AI 코딩은 LLM이 코드를 직접 작성·수정·리뷰하는 작업 방식이다. 자동완성을 넘어 에이전트가 레포 전체를 읽고 파일을 고치고 테스트를 돌린다. 생산성은 오르지만 환각·미묘한 버그·보안 노출이 함께 따라오므로 사람의 검수 루프 설계가 관건이다.
Anthropic, Fable 5 및 Mythos 5 접근 차단; SpaceX, AI 스타트업 Cursor 인수
Anthropic은 미국 정부의 명령에 따라 Fable 5와 Mythos 5에 대한 접근을 차단했다. SpaceX는 약 60억 달러에 AI 코딩 스타트업 Cursor를 인수하며, xAI와 Cursor의 인재 및 데이터를 활용해 코딩 경쟁력을 강화할 예정이다. OpenAI는 연간 수십억 달러의 손실을 보고하고 있으며, ChatGPT의 시장 점유율이 처음으로 50% 아래로 떨어졌다.
GitHub Copilot과 Raw API 접근 방식의 차이
GitHub Copilot은 모델 접근과 함께 개발 도구를 제공하며, 월별 GitHub AI 크레딧이 포함된다. Copilot은 GitHub Issue에서부터 풀 리퀘스트까지의 워크플로우를 연결하고, 사용자는 코드 완성과 Next Edit Suggestions를 포함한 유료 플랜을 통해 더 많은 리소스를 소모하는 작업에 AI 크레딧을 사용할 수 있다. Raw API 접근은 사용자가 직접 시스템을 구축할 때 적합하며, 프롬프트, 라우팅, 보안 모델 등을 제어할 수 있다. Bring Your Own Key(BYOK) 기능은 개발자가 Copilot에서 지원되는 다양한 모델을 사용할 수 있게 한다.
Amazon Bedrock Guardrails를 코드 생성 워크플로우에 적용하는 모범 사례
Amazon Bedrock Guardrails는 AI 기반 코딩 도우미와 코드 생성 워크플로우에서 안전하지 않은 코드 패턴을 탐지하고 차단하는 데 도움을 준다. 이 도구는 콘텐츠 필터, 민감한 정보 필터 등 다양한 안전 장치를 제공하여 악성 코드 생성을 방지한다. 그러나 코딩 워크플로우의 특성에 따라 적절한 구성 없이 사용할 경우, 스로틀링 오류나 비용 증가 등의 제약이 발생할 수 있다.
Z.ai의 GLM 5.2 모델, 오픈 웨이트로 무료 제공 및 비용 절감 가능
Z.ai가 2023년 6월 16일에 출시한 GLM 5.2는 7530억 개의 파라미터를 가진 AI 대형 언어 모델로, MIT 오픈 소스 라이선스 하에 제공된다. 이 모델은 Anthropic의 Opus 4.8 모델에 비해 API 비용이 1백만 출력 토큰당 4.40달러로 저렴하다. GLM 5.2는 코딩 벤치마크에서 우수한 성능을 보이며, 자가 호스팅이 가능해 데이터 보안 우려를 덜 수 있다.
TypeScript 7.0 RC 및 AI 도구 관련 소식
TypeScript 7.0의 릴리스 후보(RC)가 공개되었으며, Go로 재작성된 네이티브 컴파일러를 탑재하여 6.0보다 약 10배 빠른 성능을 제공한다. React 코드 품질 문제를 자동으로 검사하는 도구인 React Doctor는 상태 관리, 성능, 보안 등을 검사하며, Vercel이 공개한 파일시스템 기반의 AI 에이전트 프레임워크인 vercel/eve는 코드가 아닌 디렉터리 구조로 구성 요소를 관리할 수 있다.
코딩 에이전트로 가정용 기기 리버스 엔지니어링 용이해짐
코딩 에이전트를 사용하여 가정용 기기를 리버스 엔지니어링하고 자동화하는 사례가 증가하고 있다. 이전에는 리버스 엔지니어링이 가능했지만, 투자 대비 수익(ROI) 문제와 불안정한 API로 인해 유지보수의 부담이 컸다. 그러나 코딩 에이전트 덕분에 자동화 작업의 비용과 시도가 줄어들어 유지보수에 대한 심리적 부담이 경감되었다.
Claude Code 팀과의 대화: 기능 및 변화
AI Engineer World's Fair에서 Cat Wu와 Thariq Shihipar가 Claude Code, Claude Tag, Fable, 코딩 에이전트 보안, 평가, 도구 설계에 대해 논의했다. Claude Tag는 현재 Claude Code 팀의 제품 엔지니어링 PR의 65%를 차지하며, Claude Code는 Anthropic 직원에게 먼저 기능을 제공하고 사용자 유지가 입증된 기능만 배포한다. 최근 Claude Code 시스템 프롬프트는 80% 축소되었고, Fable은 비디오 편집에 능숙하다.
NVIDIA CUDA에서 커널 융합을 통한 메모리 트래픽 최적화
GPU 코드를 최적화하는 방법 중 하나로 커널 융합이 소개되었다. 커널 융합은 메모리 대역폭을 개선하고 커널 실행 오버헤드를 줄이는 데 도움을 준다. 이 글에서는 NVIDIA CUDA 코드에서 커널 융합을 적용하는 여러 방법을 설명한다.
GitHub 초보자를 위한 가이드: GitHub의 기본 이해하기
이 가이드는 GitHub의 기본 개념을 소개하며, 버전 관리 시스템인 Git의 중요성과 사용 방법을 설명한다. Git은 파일 변경 사항을 추적하고, 작업 디렉토리, 스테이징 영역, 로컬 저장소의 세 가지 영역을 통해 작동한다. GitHub 계정을 설정하고 2단계 인증을 활성화하여 보안을 강화하는 방법도 안내한다. 또한, 기본적인 Git 명령어(예: git init, git clone, git commit 등)와 첫 번째 저장소를 만드는 방법, Markdown 사용법에 대해서도 다룬다.
Claude Code v2.1.181에서 Rust로 작성된 Bun 사용
Claude Code v2.1.181(2023년 6월 17일 출시)부터 Rust 포트의 Bun을 사용하며, 리눅스에서 시작 속도가 10% 빨라졌지만 다른 변화는 거의 없었다. Claude Code 설치에서 Bun v1.4.0이 사용되고 있는 것을 확인할 수 있었으며, 이는 아직 출시되지 않은 Bun 버전의 미리보기를 지원한다. Rust 버전은 현재 Bun canary로 제공되며, 'bun upgrade --canary' 명령어로 설치할 수 있다.
리누스 토발즈, 리눅스에서 AI 코딩 도구 사용 지지
AI 기반 코딩 도구의 도입이 진행됨에 따라, 리눅스 커널의 창시자 리누스 토발즈는 AI 도구 사용을 지지한다고 밝혔다. 그는 리눅스가 반AI 프로젝트가 아니며, 이에 불만이 있는 사람은 오픈 소스 방식으로 포크하거나 떠날 수 있다고 말했다. 또한, Sashiko라는 리눅스 커널 코드 리뷰 시스템이 테스트에서 53.6%의 버그를 독립적으로 찾아낼 수 있다고 주장했지만, 20%의 비율로 잘못된 버그 보고도 발생할 수 있다고 덧붙였다.
바이브 코딩 전에 알아야 할 7가지 기본 개념
바이브 코딩을 할 때 발생할 수 있는 문제는 기본 개념 부족에서 비롯된다. AI는 확률 기반 생성으로 항상 옳지 않으며, 결과를 직접 실행하고 검증해야 한다. 프롬프트를 구체적으로 나누어 요청하고, HTML, CSS, JavaScript, 터미널, 컨텍스트를 이해하면 문제 해결이 쉬워진다. Git을 사용해 저장 지점을 만들고 로컬과 배포의 차이를 이해해야 안정적인 결과물을 공유할 수 있다.
AI와 200만 줄의 코드 작성 경험에서 얻은 교훈
25년 경력의 소프트웨어 아키텍트가 AI와 함께 200만 줄의 코드를 작성했으나, 실제로는 단 5분도 자율적으로 작동하지 않는 결과물을 경험했다. AI에게 ‘무엇을(what)’과 ‘어떻게(how)’만 주면 작동하지 않는 코드가 생성되며, 빠진 변수는 ‘왜(why)’라는 점을 강조했다. AI의 속도는 빠르지만, 엔지니어링의 완성도는 부족하다는 문제를 지적하며, AI의 결과물이 껍데기에 불과할 수 있음을 경고했다.
OpenAI의 SWE-Bench Pro 감사 결과와 코딩 평가의 한계
OpenAI의 SWE-Bench Pro 감사 결과, 정밀한 점수가 코딩 능력을 제대로 측정하지 못할 수 있음을 보여주었다. SWE-Bench Pro는 이전 코딩 평가의 약점을 해결하기 위해 설계되었으며, 731개 과제에서 모델 성능이 23.3%에서 80.3%로 증가했지만, OpenAI는 결과의 30%가 결함이 있다고 추정했다. 감사 결과, 200개 과제(27.4%)가 결함으로 분류되었고, 소프트웨어 엔지니어들이 평가한 결과 249개 과제(34.1%)가 결함으로 나타났다. OpenAI는 SWE-Bench Pro의 채택을 권장하지 않기로 했다.
루프 엔지니어링의 개념과 활용
‘루프 엔지니어링’은 Anthropic과 OpenAI의 개발자들이 프롬프트 작성을 중단하고 루프 설계로 전환하면서 주목받고 있다. Anthropic의 Boris Cherny는 Claude를 프롬프트하는 대신 루프를 작성한다고 밝혔다. 루프는 이벤트에 반응하거나 예약된 작업을 실행하는 데 사용되며, OpenAI의 API 가격이 비쌀 경우 비용이 빠르게 증가할 수 있다. Geoffrey Huntley는 'Ralph Wiggum' 루프라는 개념을 제안하며, 이를 통해 작업을 지속적으로 유도할 수 있다고 설명했다. 이 방법은 엔지니어의 전문성이 여전히 필요하다고 강조한다.
소프트웨어 프로젝트의 공유 언어와 이해의 중요성
소프트웨어 프로젝트에서 공유되는 언어는 영어 또는 파이썬이 아니라 개념의 의미, 경계, 중요 불변량, 소유권, 시스템 구조의 이유에 대한 공통 이해이다. 이러한 이해는 문서와 코드, 코드 리뷰, 대화, 논쟁, 변경 사항을 설명하는 경험 속에 존재한다. 에이전트 이전에는 이러한 공유 이해가 마찰을 통해 유지되었으며, 이는 느린 과정이었지만 서로의 이해를 동기화하는 역할을 했다.
Codex 사용자 수 6개월 만에 10배 증가, 700만 명 도달
Codex의 사용자 수가 6개월 만에 10배 증가하여 현재 700만 명에 도달했다. Codex는 올해 초 약 55만에서 70만 명의 사용자로 시작했으며, Claude Code는 약 200만 명의 사용자와 25억 달러의 ARR을 기록하고 있다. Prime Intellect는 에이전트 RL 및 평가를 위한 환경 스택을 재설계한 verifiers v1을 출시했다.
Bun의 Zig에서 Rust로의 재작성과 Fable의 활용
Bun의 Rust로의 재작성에 165K 달러가 소요되었으나, 이로 인해 1-2년 걸릴 작업이 11일로 단축되었다. 이 과정에서 사용된 도구는 Fable로, 현재는 전 세계적으로 사용 가능하다. Anthropic의 Fable, OpenAI의 GPT-5.6 Sol, Cursor의 Grok 4.5, Meta의 Muse와 같은 코딩 LLM 모델들이 경쟁 중이다.
DOOMQL: SQLite를 게임 엔진으로 활용한 도스 스타일 게임
Peter Gostev가 GPT-5.6 Sol을 사용해 개발한 DOOMQL은 SQLite를 게임 엔진으로 활용한 작은 도스 스타일 게임이다. 이 게임은 SQL을 통해 이동, 충돌, 적, 전투, 진행 및 화면의 모든 RGB 픽셀을 제어한다. Python 터미널 스크립트로 구현되어 있으며, 사용자는 GitHub에서 코드를 클론하여 실행할 수 있다. 또한, Datasette 앱을 통해 SQL 쿼리를 실행하고 게임 상태를 실시간으로 반영하는 HTML+JavaScript 앱을 만들 수 있다.
Google, Android Bench에 새로운 LLM 추가 및 업데이트
Google은 Android 앱 개발에서 LLM의 성능을 평가하기 위해 만든 Android Bench를 업데이트했다. 이번 업데이트에는 Claude Fable 5, Claude Sonnet 5, Claude Opus 4.8, GLM 5.2, Kimi K2.7 Code, MiniMax M3, Qwen 3.7 Plus, Qwen 3.7 Max 등 8개의 새로운 모델이 추가되었다. 개발자들은 자신의 테스트를 실행하고 피드백을 제출할 수 있으며, Android Bench는 100개의 Android 개발 작업에서 LLM의 성능을 평가하는 것을 목표로 한다.
llama.cpp의 P100 GPU 성능 개선을 위한 패치 배포
turboquant v0.3.0이 배포되었으며, CUDA 코드의 패치로 P100 GPU가 fp16 연산을 수행할 수 있게 되었다. 이 패치는 3줄로 구성되어 있으며, 성능 측정 결과 P100에서의 디코드 속도가 약 1.4% 빨라졌다. P100은 현재 약 80달러에 판매되고 있으며, 16GB HBM2 메모리를 갖추고 있다.
Kenton Varda, AI 작성 변경 설명 중단 선언
Kenton Varda는 자신의 팀에서 AI가 작성한 변경 설명(예: PR 및 커밋 메시지, 이슈/티켓)에 대한 중단을 선언했다. 그는 AI가 작성한 설명이 코드의 세부 사항은 잘 설명하지만, 코드의 전반적인 의미를 이해하는 데 필요한 고차원적인 프레임을 생략하여 리뷰에 도움이 되지 않았다고 밝혔다.
Warp의 소프트웨어 팩토리 플랫폼 Oz 소개
Warp는 2021년 중반 Rust 기반 터미널로 시작하여 AI의 발전에 따라 통합 코딩 에이전트를 갖춘 터미널로 발전했다. 최근 CLI 도구 간의 경쟁이 치열해지면서 Warp는 2023년 4월에 핵심 CLI 도구를 오픈소스화했다. Warp의 새로운 에이전트 오케스트레이션 플랫폼인 Oz는 소프트웨어 개발의 자동화를 목표로 하며, 개발자들이 기존 워크플로우에 통합할 수 있도록 설계되었다. Oz는 여러 모델과 코딩 툴을 연결하고, 소프트웨어 변경 사항을 지속적으로 관리하는 자동화된 시스템으로의 전환을 지원한다.
AIEWF 2023: 소프트웨어 공장과 루프의 중요성
AIEWF에서 루프와 소프트웨어 공장에 대한 논의가 활발히 이루어졌다. swyx는 AI 엔지니어링의 발전을 언급하며 자동화와 루프의 중요성을 강조했다. Allie Howe는 소프트웨어 공장을 '자율성을 가진 소프트웨어 개발의 전체 루프'로 정의했으며, Zach Lloyd는 소프트웨어 공학이 공장 공학으로 발전할 것이라고 주장했다. Forward Deployed Engineers(FDE) 역할도 주목받았으며, 이들은 조직이 AI 에이전트를 통합하는 데 도움을 주는 역할을 한다.