매일 한 편, AI 업계를 읽는 칼럼
글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

AI 도구는 이제 개발자의 일상적인 업무 환경으로 완전히 자리 잡았다. 설계와 작성이 아닌 LLM 결과물을 검토하고 수정하는 방식으로 업무 프로세스가 변화했다. 하지만 반복되는 환각과 정형화된 문체 패턴이 실무자에게 'LLM 번아웃'이라는 새로운 피로

로컬 CPU에서 고품질 음성을 생성하는 TTS 모델 Kokoro가 공개됐다. 82M 파라미터 규모로 OpenAI speech API와 호환되며, AMD Ryzen 7 8745HS 기준 1.5초의 합성 속도를 기록했다. GPU 자원을 LLM 추론에 집중

ChatGPT와 대화할 때 발생하는 부자연스러운 끊김은 흔한 경험이다. OpenAI가 말하고 듣기를 동시에 수행하는 GPT-Live-1과 mini 모델을 출시했다. GPT-5.5와 연동해 복잡한 추론과 시각적 응답까지 수행하는 구조다.

SpaceX가 코딩과 자율 에이전트 작업에 최적화된 AI 모델 Grok 4.5를 출시했다. 입력 토큰 100만 개당 2달러, 출력 6달러의 가격 정책과 Colossus 슈퍼컴퓨터 인프라를 투입했다. 개발자는 벤치마크의 절대적 순위보다 작업당 완료 비용

구글이 제미나이 옴니(Gemini Omni)를 활용해 영상을 빠르게 편집하는 '비디오 리믹스' 기능을 구글 포토에 추가했다. 시네마틱 조명 조절, 배경 교체, 수채화 및 유화 스타일 적용이 가능하며 한국을 포함한 주요 국가의 유료 구독자에게 순차 제공

AI에게 코딩이나 수학 문제 풀이를 맡기는 것은 이제 흔한 일입니다. 하지만 Anthropic의 안전 특화 모델 Fable은 단순한 전문 용어에도 답변을 거부합니다. 과도한 필터링 탓에 실제 연구나 개발 현장에서 쓰기 어렵다는 비판이 나옵니다.

우리는 AI와 대화할 때 상대의 말이 끝날 때까지 기다려야 하는 불편함을 겪어왔다. OpenAI가 실시간으로 듣고 말하기가 동시에 가능한 '풀 듀플렉스' 구조의 GPT-Live를 출시했다. 음성 인터랙션과 추론 레이어를 분리해 자연스러운 대화와 고성능

구글이 안드로이드 앱 개발 성능 평가 도구인 안드로이드 벤치(Android Bench)를 업데이트했다. 신규 모델 8종을 리더보드에 추가하고 비용과 효율성 지표를 도입했다.

GeoSQL이 Claude, Codex, GitHub Copilot을 위한 지리공간 데이터 분석 스킬을 공개했다. 지도 기반 루프(map-in-the-loop) 방식을 통해 텍스트 전용 검증 대비 작업 성능을 4배 개선했다. PostGIS, BigQu

코딩 AI가 단순 함수 작성을 넘어 전체 코드베이스를 분석하는 엔지니어링 단계로 진입하고 있다. Cognition이 공개한 SWE-1.7은 Kimi K2.7 기반의 RL 최적화로 프런티어급 지능과 낮은 비용을 구현했다. 3개 대륙에 분산된 학습 인프라

AI 기술 도입으로 기업들의 매출 성장 속도가 단순 증가를 넘어 가속화 단계에 진입했다. Anthropic과 Mercor 등 주요 AI 기업들이 수천억에서 수조 원 단위의 매출 지표를 단 몇 개월 만에 경신했다. AI 네이티브 기업뿐 아니라 기존 HR

Mistral이 단일 RGB 카메라와 언어 지침만으로 자율 주행이 가능한 8B 규모의 로봇 내비게이션 모델 'Robostral Navigate'를 공개했다. 해당 모델은 R2R-CE 벤치마크의 unseen 데이터셋에서 76.6%의 성공률을 기록하며 기

기업용 AI는 그동안 개별 사용자의 생산성을 높이는 1:1 채팅 방식에 머물렀다. 슬랙은 MCP 프로토콜을 통해 슬랙봇을 세일즈포스 CRM 및 태블로와 직접 연결했다. 이제 공유 채널에서 데이터 조회부터 문서 승인까지 협업 기반의 AI 워크플로우가 가

AI가 단순 코딩을 넘어 수학적 정리 증명과 소프트웨어 무결성 검증 단계로 진입했다. Mistral AI가 정형 검증 도구 Lean 4 전용 오픈소스 에이전트 Leanstral 1.5를 공개했다. 119B 규모의 MoE 구조를 채택해 연산 비용은 낮추

AI 칩 시장은 엔비디아 같은 거대 기업이 주도하는 것처럼 보입니다. 삼바노바가 110억 달러의 기업 가치를 인정받으며 10억 달러 규모의 투자를 유치했습니다. 클라우드 의존도를 낮추려는 JP모건 같은 금융권의 온프레미스 수요가 성장의 핵심입니다.

AI 모델 구동 시 특정 GPU 벤더에 종속되어 비용과 선택지가 제한되는 문제가 반복된다. 프랑스 스타트업 ZML이 Nvidia, AMD, TPU, Apple Metal 등 다양한 칩에서 최적 속도를 내는 추론 서버 ZML/LLMD를 출시했다. 현재

노마 랩스(Noma Labs)가 깃허브 에이전틱 워크플로우에서 프라이빗 저장소 데이터를 유출할 수 있는 'GitLost' 취약점을 발견했다. 공격자가 공개 저장소에 조작된 이슈를 게시하면 AI 에이전트가 이를 지시사항으로 오인해 내부 프라이빗 저장소

Red Hat의 브라이언 그레이슬리 상무가 엔터프라이즈 AI 에이전트의 실제 운영 단계에서 발생하는 비용과 보안 리스크를 분석했다. 시맨틱 라우팅과 캐싱을 통한 토큰 비용 절감 및 7~14일 단위의 신속한 취약점 패치 관리 체계가 핵심으로 제시됐다.

오픈소스 암호화 라이브러리는 작은 구현 실수 하나로 전체 보안 체계가 무너질 수 있다. zkSecurity의 AI 에이전트 zkao가 Cloudflare의 CIRCL 라이브러리에서 7개의 실질적 버그를 발견했다. 부동 소수점 정밀도 손실부터 로그 키

디스코드의 AI 자동 차단 시스템이 무해한 이미지를 유해물로 오인해 8천 명 이상의 계정을 정지했다. 단순 표나 게임 텍스처를 불법 콘텐츠로 분류하는 오류가 발생하며 사용자들의 거센 반발을 샀다. 자동화된 검열의 신뢰성 문제가 불거지며 플랫폼 기업들의

AI가 코드를 대신 짜주는 '바이브 코딩' 시대가 열렸다. 이제 코딩은 고연봉 취업 수단이 아닌 사고력을 기르는 도구로 정의된다. 수학적 정밀함과 논리를 익히는 코드 리터러시가 AI 시대의 핵심 경쟁력이 된다.

Ternlight가 브라우저와 엣지 런타임에서 직접 실행되는 초경량 임베딩 모델을 공개했다. BitNet b1.58의 삼진 가중치 방식을 적용해 5~7MB 크기의 WASM 번들로 제공하며 밀리초 단위의 추론 속도를 구현했다. 개발자는 서버 호출 없이

AI 모델의 발전 속도가 빨라지며 기초 이론에 대한 실무적 갈증이 커지고 있다. OpenAI 공동창업자 일리야 서츠케버가 추천한 27개의 핵심 논문 목록이 공개됐다. CNN부터 트랜스포머, 스케일링 법칙과 정보이론까지 AI의 기술적 계보를 다룬다.

AI 모델의 갑작스러운 서비스 중단이나 정책 변화는 기업의 운영 리스크가 된다. 리버티 뮤추얼은 50여 개의 독립 컴포넌트로 구성된 'AI 백본'을 통해 모델을 즉시 교체할 수 있는 구조를 만들었다. 6개의 전문 에이전트 협업 체계인 '소프트웨어 팩토

AI 코딩 도구를 사용할 때 매번 프롬프트를 입력해 지시하는 방식이 일반적이다. Claude Code 팀은 정지 조건이 충족될 때까지 작업을 반복하는 '루프' 운영 패턴을 공개했다. 작업 성격에 따라 Turn, Goal, Time, Proactive

AI 코딩 도구로 빠르게 만든 프로젝트가 규모가 커질수록 유지보수가 어려워지는 문제가 발생하고 있다. Odra는 AI가 중복 생성한 코드를 분석해 줄이고 유지보수 가능한 구조로 재설계하는 서비스를 제공한다. 시니어 엔지니어 3명이 일주일간 작업하며,

인스타그램 스토리나 왓츠앱에서 AI로 이미지를 만드는 기능이 추가됩니다. Meta가 공개한 'Muse'는 단순 생성부터 배경 삭제, QR 코드 제작까지 지원합니다. 기본 이용은 무료지만 사용량 제한을 넘기면 구독제로 전환되는 구조입니다.

AI와 협업할 때 매번 이전 맥락을 다시 설명하거나 문서를 업로드하는 번거로움이 있다. Rowboat는 로컬 데이터를 지식 그래프로 인덱싱해 누적된 기억을 가진 AI 워크스테이션을 제공한다. MCP 지원으로 외부 툴과 연결 가능하며 Mac, Windo

오픈소스 AI의 사용량이 급증하며 시장 점유율을 빠르게 높이고 있다. 하지만 실제 지출액은 여전히 고가의 프런티어 모델에 집중되어 있다. AI 도입 단계가 '발견'과 '생산'으로 분리되는 이층 경제 구조가 나타났다.

AI 에이전트 시대에는 기존의 딱딱한 데이터 관리 방식이 개발 속도를 늦추는 병목 현상을 일으킵니다. Huntr, Modelence, Tavily 등 AI 스타트업들은 데이터와 검색 기능을 하나로 합친 통합 플랫폼으로 이 문제를 해결했습니다. 유연한