Category
AI 프로덕트·스타트업
AI 프로덕트·스타트업은 모델을 감싸 실제 사용자 가치를 파는 영역이다. 데모는 쉽지만 신뢰성·단가·해자 없는 래퍼라는 벽에 부딪힌다. 한국 시장에선 결제·법무·개인정보 규제까지 함께 풀어야 출시에 닿는다. 기술보다 PMF와 운영 완성도가 생존을 가른다.
Figma CEO Dylan Field 인터뷰: 디자인과 AI
Figma의 공동 창립자이자 CEO인 Dylan Field는 2012년 브라운 대학교를 중퇴하고 Figma를 설립했다. Figma는 WebGL 기술을 활용하여 브라우저에서 강력한 그래픽 기능을 제공하며, 협업을 가능하게 하는 디자인 운영 체제로 자리 잡았다. Figma는 2022년 Adobe의 인수 제안을 받았으나, 규제 저항으로 인해 2023년 말에 인수 합병이 무산되었고, 2025년에는 IPO를 통해 563억 달러의 가치를 기록했지만 현재 시장 가치가 100억 달러 이하로 떨어졌다. Field는 AI가 시장에서 불리하게 작용하고 있다고 보지만, Figma의 Canvas가 디자인과 AI의 자연스러운 교차점이라고 강조했다.
AI 제품의 평가 시스템 구축 필요성
Hamel Husain은 LLM 제품의 성공과 실패를 평가 시스템의 견고함에 연결짓고 있다. 그는 Rechat의 AI 어시스턴트 Lucy의 사례를 통해, 평가를 중심으로 한 체계적인 접근이 AI 성능 개선에 필수적임을 강조한다. 평가의 세 가지 수준은 단위 테스트, 모델 및 인간 평가, A/B 테스트로 나뉘며, 각 수준의 비용과 실행 주기를 고려해야 한다.
Mastering LLMs: 실무 전문가들이 전하는 LLM 워크숍 및 강의
Mastering LLMs는 25명 이상의 산업 전문가들이 진행하는 워크숍 및 강의로, evals, retrieval-augmented-generation (RAG), fine-tuning 등 다양한 주제를 다룬다. 이 과정은 AI 제품 개발에 관련된 실용적인 주제에 초점을 맞추며, 누구나 무료로 참여할 수 있다. 40시간 이상의 콘텐츠가 제공되며, 각 주제별로 정리된 자료와 요약이 포함되어 있다. 기본적인 LLM에 대한 이해가 필요하며, 개인 프로젝트에 적용해보는 것을 추천한다.
Mistral AI, 2023년 설립 후 오픈 소스 AI 모델 제공 및 자금 조달
Mistral AI는 2023년에 설립되었으며, 오픈 소스 AI 모델을 제공하고 있다. 이 회사는 '최전선 AI를 모든 이의 손에'라는 목표로 상당한 자금을 조달했다.
‘It’s Hard to Eval’은 제품의 문제를 나타낸다
Hamel Husain의 블로그에서 ‘It’s Hard to Eval’이라는 표현이 제품의 문제를 나타낸다고 설명하고 있다.
바이트댄스, 최대 3분 영상 생성 가능한 ‘시댄스 2.5’ 9일 출시 예정
바이트댄스가 최대 3분 길이의 영상을 생성할 수 있는 AI 영상 모델 ‘시댄스 2.5(Seedance)'를 이르면 9일에 출시할 예정이다. 드리미나와 캡컷의 홈페이지에 새로운 모델에 대한 내용이 이미 등장했으며, 여러 외부 정보에서도 7월 초 출시 가능성이 제기되고 있다. 새 모델은 드리미나와 캡컷, 바이트댄스의 AI 영상 플랫폼과 연동되는 파트너 서비스에도 적용될 예정이다.
SK텔레콤, 15GW AI 데이터센터 구축 계획 발표
SK텔레콤은 최대 15GW 규모의 AI 데이터센터를 구축하여 아시아 AI 인프라 허브로 도약하겠다고 5일 밝혔다. 울산에 1호 AI 데이터센터를 건설 중이며, 영남권에 2GW 이상의 클러스터를 조성하고, 서남권에 1GW를 추가하여 2029년부터 총 5GW 규모의 데이터센터를 단계적으로 열 계획이다. 2035년까지 15GW 규모로 순차 확대할 예정이다.
Jensen Huang, TPU 경쟁 및 Nvidia의 공급망 전략
Jensen Huang은 Nvidia의 공급망이 고급 칩 생산에 필수적이며, TPUs가 Nvidia의 AI 컴퓨팅 시장 지배력을 깨뜨릴 수 있는지에 대해 논의했다. 또한, Nvidia가 하이퍼스케일러가 되지 않는 이유와 AI 칩을 중국에 판매해야 하는지에 대한 질문도 다뤘다. Crusoe는 Blackwell GPU를 사용하며, MemoryAlloy 기술로 최대 10배 빠른 TTFT와 5배 더 나은 처리량을 제공한다고 밝혔다.
자신의 프로젝트 및 협업 요청 게시 스레드
사용자는 개인 프로젝트, 스타트업, 제품 배치, 협업 필요, 블로그 등을 게시할 수 있으며, 제품 및 서비스에 대한 결제 및 가격 요구 사항을 언급해야 한다. 링크 단축기, 링크 집계 웹사이트, 자동 구독 링크는 게시하지 말아야 하며, 신뢰 남용 시 금지 조치가 취해진다. 이 스레드는 다음 스레드가 올라올 때까지 유지된다.
Generative AI 전략에 대한 발표 준비
Chip Huyen은 'Leadership needs us to do generative AI. What do we do?'라는 주제로 발표를 준비했다. 이 발표는 생성적 AI 전략을 고민하는 사람들을 위한 간단한 프레임워크를 제시하며, 많은 아이디어가 아직 구체화되고 있다고 전했다. 발표 슬라이드는 [여기](https://huyenchip.com/assets/genai.pdf)에서 다운로드할 수 있다.
Google DeepMind, AI 기반의 상황 인식 마우스 포인터 개발
Google DeepMind는 마우스 포인터를 상황 인식 AI 파트너로 변형하고 있다. 이는 전통적인 프롬프트의 마찰을 넘어 Chrome 등에서 직관적인 AI 협업을 가능하게 한다.
Impeccable의 Paul Bakaus, AI 디자인에서의 스킬 엔지니어링 강조
Impeccable의 Paul Bakaus는 AI 에이전트의 능력을 향상시키기 위해 '스킬 엔지니어링'의 중요성을 강조하며, 창의적 과정에서 사람을 배제하고 싶지 않다고 말했다. 그는 Impeccable을 통해 코딩 에이전트가 인터페이스 개선을 위한 용어를 갖도록 하고, 사용자가 전체 웹사이트를 한 번에 재설계하는 대신 특정 섹션을 '더 굵게', '더 조용하게' 등으로 수정할 수 있도록 한다고 설명했다. Bakaus는 AI 제품이 단순한 지시사항을 넘어 도메인 지식과 맥락을 필요로 하며, 스킬 엔지니어링이 독립된 분야로 발전하고 있다고 언급했다. 또한, 디자인과 엔지니어링의 경계가 모호해지고 있으며, 디자이너와 엔지니어가 서로의 영역으로 이동하고 있다고 덧붙였다.
TCL Nxtpaper 11 Plus, 아이패드와 킨들을 대체할 태블릿
TCL Nxtpaper 11 Plus가 7월 4일 세일 중으로, 가격이 30% 할인되고 있다.
ChatGPT Ads에 1만 달러 투자한 마케터의 경험
마케터가 ChatGPT Ads에 1만 달러를 투자한 결과, OpenAI의 권장사항을 무시하고도 효과를 얻었다고 밝혔다. 그는 ChatGPT Ads에서 1만 달러를 투자하여 마케팅 성과를 높였으며, 광고의 효과를 극대화하기 위해 다양한 전략을 시도했다고 전했다. 또한, 그는 ChatGPT Ads의 성과를 통해 AI 마케팅의 가능성을 강조했다.
SpaceX, 100만 개의 궤도 데이터 센터 위성 계획 발표
SpaceX의 창립자 Elon Musk는 2023년 1월 세계 경제 포럼에서 AI를 우주에 배치하는 것이 가장 저렴한 방법이 될 것이라고 언급했다. SpaceX는 저지구 궤도에 최대 100만 개의 위성을 배치하기 위한 신청서를 연방통신위원회에 제출했다. 그러나 현재 궤도에는 약 14,500개의 활성 위성이 있으며, SpaceX의 Starlink가 그 중 약 2/3를 차지하고 있다. 100만 개의 위성을 배치하기 위해서는 16,666회의 발사가 필요하며, Starlink의 현재 생산 속도로는 1,000만 개의 위성을 만드는 데 25년이 걸릴 것으로 예상된다. 또한, 우주에서 Nvidia H100 GPU를 쿨링하는 것이 어렵고, 대규모 궤도 데이터 센터의 실현은 아직 멀었다.
NVIDIA, AI 인프라 구축을 위한 새로운 비즈니스 모델 발표
NVIDIA는 AI 모델 개발에서 생산 추론으로의 전환에 따라 대규모 컴퓨팅 수요가 증가하고 있음을 알리며, AI 스타트업과 기업들이 자본 집약적인 인프라에 접근할 수 있도록 새로운 비즈니스 모델을 도입한다고 발표했다. 이 모델은 AI 클라우드가 NVIDIA 인프라를 조달할 수 있게 하며, 수익 공유 및 신용 지원 모델을 통해 AI 네이티브 고객에게 서비스를 제공한다. Sharon AI는 40,000개의 NVIDIA Grace Blackwell GB300 GPU를 배치하고 있으며, Firmus는 인도네시아 바탐에 360메가와트 규모의 DSX AI 공장을 건설 중이다. AI 네이티브 기업들은 모델 훈련과 고용량 추론을 위해 즉각적인 AI 클라우드 용량 접근이 필요하다.
Cloudflare Monetization Gateway 발표: x402를 통한 자산 요금 청구 기능
Cloudflare는 Monetization Gateway를 발표하며, 고객이 Cloudflare로 보호되는 웹 페이지, 데이터셋, API 및 MCP 도구에 대해 요금을 청구할 수 있는 기능을 제공한다고 밝혔다. 이 시스템은 결제 정책과 접근 제어를 관리하는 단일 제어판을 제공하며, 결제 검증과 집행을 엣지에서 처리하여 원본을 보호한다. 초기에는 x402 프로토콜을 통해 안정적인 암호화폐로 결제가 이루어질 예정이다.
Ornn AI, 3300만 달러 시드 펀딩으로 AI 컴퓨팅 파워 마켓플레이스 구축
인공지능 스타트업 Ornn AI Inc.가 3300만 달러의 시드 펀딩을 확보했다. 이번 펀딩은 Andreessen Horowitz의 암호화폐 중심 펀드와 Galaxy Ventures가 공동 주도했으며, Nordstar, SV Angel, Crucible Capital, Vine 등의 기존 투자자도 참여했다. Ornn은 AI 컴퓨팅 파워를 석유처럼 상품으로 사고팔 수 있는 마켓플레이스를 구축할 계획이다.
Together AI, 오픈소스 AI 전환 가속화를 위한 8억 달러 시리즈 C 투자 유치
Together AI는 오픈소스 AI로의 전환을 가속화하기 위해 8억 달러를 유치했다. 이들은 폐쇄형 모델의 경제성이 확장되지 않는 이유와 향후 개발할 내용에 대해 설명했다.
Etched, AI 추론 하드웨어 시장을 겨냥한 혁신적 클러스터 개발
Etched는 2026년 AI 추론 시장을 겨냥한 클러스터를 개발하고 있으며, 800M 달러를 모금하고 10억 달러 이상의 주문을 확보했다. 이들은 TSMC와 협력하여 4nm 공정에서 첫 번째 칩(A0)을 성공적으로 제작했으며, 400명 이상의 인력을 보유하고 있다. 이 회사는 NVIDIA, Google TPU, Broadcom, SK Hynix 등에서 온 인재들로 구성되어 있다.
Microsoft Foundry에서 오픈 모델을 위한 Managed Compute 발표
Microsoft Foundry에서 Managed Compute를 발표했다. 이는 가상 머신, Kubernetes 클러스터, 모델 런타임의 운영 부담 없이 오픈 소스 AI 모델을 커스터마이징하고 제공할 수 있는 관리형 플랫폼이다. 사용자는 Hugging Face 파트너십을 통해 수천 개의 오픈 소스 모델에 접근하고, 감독 학습이나 강화 학습으로 커스터마이즈할 수 있으며, 다른 곳에서 훈련한 모델 가중치를 안전하게 배포할 수 있다. Managed Compute는 Foundry의 세 가지 배포 유형 중 오픈 소스 및 커스터마이즈 모델을 위한 전용 GPU 용량을 갖춘 유형이다.
Google Labs에서 Pomelli 베타 출시
Pomelli는 Google Labs와 DeepMind의 새로운 실험으로, 중소기업(SMB)을 위한 AI 마케팅 콘텐츠 생성 도구이다. 이 도구는 브랜드에 맞는 마케팅 콘텐츠를 만들 수 있도록 지원하며, Google Gemini와의 통합을 통해 3-4개월 내에 출시될 예정이다. Pomelli는 브랜드 DNA를 기반으로 하여 사용자에게 맞춤형 콘텐츠를 제공한다.
기계적 공감(mechanical sympathy)과 소프트웨어 개발
기계적 공감은 제품의 경계와 가능성을 이해하고 이에 맞춰 코드를 작성하는 것을 의미한다. 이는 소프트웨어 성능을 최적화하는 데 중요한 요소로, 개발자는 적절한 언어와 빌드 시스템을 사용하고, 불필요한 도구를 최소화해야 한다. 최근 프로젝트에서 AI 에이전트가 테스트를 수정하는 과정에서 발생한 오류와 비효율성을 통해 기계적 공감의 필요성이 강조되었다.