매일 한 편, AI 업계를 읽는 칼럼
글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

기상 예보는 슈퍼컴퓨터와 물리 모델이 지배하는 영역이었다. 스타트업 윈드본이 공개한 '웨더메시 6'는 유럽 중기예보센터(ECMWF)보다 더 잦고 정확한 예측을 제공한다. 자체 기상 풍선 400개에서 수집한 데이터를 모델에 직접 입력해 예측 정밀도를 높

물리 AI는 현실 세계를 이해하고 다음 상황을 예측해 행동을 생성해야 한다. 엔비디아가 추론, 세계 생성, 행동 생성을 하나로 통합한 코스모스 3를 오픈소스로 공개했다. MoT 아키텍처 기반의 8B, 32B 모델과 학습 레시피, 6종의 합성 데이터셋을

중국 AI 스타트업 MiniMax가 100만 토큰 컨텍스트를 지원하는 M3 모델을 출시했다. GPT-5.5와 Gemini 3.1 Pro의 성능을 일부 추월하며 운영 비용을 8~20% 수준으로 절감했다. 10일 이내에 가중치 공개(Open Weights

구글이 검색 결과 상단에 AI 생성 개요를 배치하는 AI 우선 체제로 전환했다. DuckDuckGo는 AI 답변과 채팅 프롬프트를 제거한 'noai' 전용 페이지를 기본 검색엔진으로 설정하는 확장 프로그램을 출시했다. 출시 후 No-AI 페이지 방문자

AI가 데이터 시각화 라이브러리인 Matplotlib의 잘못된 코드를 생성하며 개발 효율성에 혼선을 빚었습니다. 모델의 환각 현상이 실무 코드 작성에 미치는 영향과 검증의 중요성이 다시금 강조됩니다.

엔비디아가 노트북과 데스크톱 PC를 위한 범용 칩을 공개했습니다. 기존 GPU 중심의 하드웨어 구성을 넘어 PC 시스템의 핵심 연산 영역으로 진출합니다.

LLM 서비스 운영 시 가장 큰 고민은 예상치 못한 비용과 복잡한 디버깅이다. 오픈소스 플랫폼 Spanlens는 baseURL 변경만으로 비용 추적과 에이전트 경로 시각화를 제공한다. LangGraph 토폴로지 뷰와 Critical Path 분석으로

LLM의 생산성 폭발로 인간의 소비 속도가 개발의 새로운 병목이 됐다. 무분별한 AI 생성물인 '슬롭(Slop)'의 악순환을 막기 위해 자동 방어층 구축이 필수적이다. 이제 개발자의 핵심 역량은 단순 구현이 아니라 시스템 아키텍처 설계와 컨텍스트 관리

AI 모델 성능이 올라가며 단순한 앱 서비스들이 거대 랩에 흡수되고 있다. 하지만 복잡한 산업별 워크플로와 규제를 해결하는 버티컬 영역은 여전히 기회다. 모델은 교체 가능하지만 실제 업무가 돌아가는 시스템을 소유한 기업이 살아남는다.

플랫폼과 무관하게 적용 가능한 웹사이트 기술 표준인 'The Website Specification'이 공개되었습니다. SEO, 보안, 성능 등 10개 영역을 다루며 MCP 서버를 통해 AI 에이전트의 접근성을 높였습니다.

AI 구독 비용에 대한 부담과 효용성 고민이 제기되었습니다. 구독 해지를 통해 최적의 도구 조합을 찾는 움직임이 나타나고 있습니다.

ChatGPT와 Claude의 UI 경험을 개인 서버에서 구현하는 셀프 호스팅 워크스페이스 Odysseus 1.0이 공개됐다. ChromaDB, SearXNG, ntfy를 통합해 로컬 데이터 기반의 프라이버시 중심 환경을 제공한다. 셸 접근, 모델 다

AI 에이전트가 단순 대화를 넘어 실제 업무를 수행하는 실행 단계로 진입했다. StepFun이 공개한 Step 3.7 Flash는 초당 최대 400토큰의 처리량을 구현했다. 256k 컨텍스트 윈도우와 3단계 추론 설정을 통해 비용과 성능의 균형을 맞췄

이미지 생성 AI를 쓰려면 비싼 서버 비용과 대기 시간이 필수였다. PrismML이 모델 크기를 획기적으로 줄인 Bonsai Image 4B를 공개했다. 아이폰 17 프로 맥스에서 512px 이미지를 9.4초 만에 생성한다.

최신 GPU의 VRAM 부족 문제를 중고 데이터센터 GPU 조합으로 해결했다. Tesla V100 SXM2와 어댑터를 사용하여 총 32GB VRAM 환경을 구축했다. Qwen3.6-27B 모델을 초당 최대 60토큰 속도로 로컬에서 구동했다.

AI가 알려진 취약점 공격을 넘어 스스로 제로데이 취약점을 발견하는 단계에 진입했다. Claude Mythos는 CyberGym 83.1%를 기록하며 취약점 발견의 '안전 마진'을 제거했다. 기존 CVSS 중심의 패치 우선순위 체계는 AI의 공격 속도

AI와 인간의 능력 격차가 좁아지며 기존의 인간 가치 옹호 논리가 흔들리고 있다. 창작물의 질을 결정하는 '의도'와 '형식' 중 AI는 의도 없는 형식만 빠르게 생성한다. 결과물의 품질이라는 가변적 수치 대신 인간 존재 자체의 가치를 선언하는 논리가

LLM 외부 도구 연결 표준인 MCP가 과도한 토큰 소비와 성능 저하 문제를 드러냈다. 4개 서버 연결 시 컨텍스트의 최대 16.5%가 도구 정의로 낭비되며 호출 속도는 API 대비 3배 느리다. CLI 우선 전략과 필요할 때만 로드하는 '스킬(Ski

코딩 에이전트 사용 시 급증하는 세션 관리의 불편함이 실무적 병목이 된다. pisesh는 즐겨찾기와 검색 기능을 통해 pi의 세션 복구 과정을 효율화한다. npm 설치 후 pi 내부에서 /sesh 명령어로 즉시 호출해 사용할 수 있다.

AI로 인한 일자리 상실이 단순한 경제적 불안을 넘어 심리적 '애도' 단계로 진입했다. 2025년 플로리다대 연구진은 이를 'AI 대체 장애(AIRD)'라는 새로운 임상 개념으로 정의했다. 인지 노동자의 전문성이 곧 정체성인 특성상, 과거 산업혁명보다

AI 에이전트에게 프로덕션 권한을 줬을 때 발생하는 통제 불능 위험을 해결한다. 자격 증명을 분리 보관하고 SQL·k8s 등 와이어 레벨 트래픽을 파싱해 액션을 게이팅한다. LLM 판사와 사람의 승인 절차를 결합해 위험 호출을 실시간으로 차단하는 구조

소프트뱅크가 프랑스 데이터센터 확장에 최대 750억 유로를 투자한다. 2031년까지 3.1GW를 포함해 총 5GW의 전력 용량을 확보할 계획이다. 미국 내 건설 반대 여론을 피해 유럽 AI 인프라 거점을 선점하려는 움직임이다.

생존을 위해 모든 제품을 AI로 피벗해야 한다는 압박이 거세다. 메타 출신 크레이그 캠벨은 2022년 엑싯 후 AI 골드러시를 외면했다. 하이프를 쫓는 대신 기초적인 유틸리티를 확보하는 역발상 전략을 택했다.

Meta가 대화 기록이 가능한 AI 펜던트를 개발해 내년부터 테스트한다. 2025년 말 인수한 Limitless의 기술을 기반으로 웨어러블 라인업을 확장한다. 기업용 구독 서비스 'Wearables for Work'를 통해 리얼리티 랩스의 적자를 상쇄

AI 업계에서 도덕적 관점을 유지하는 것이 직업적 고립으로 이어진다. 성장 지상주의 속에서 윤리적 제동을 거는 실무자의 소외감을 분석한다. 기업의 홍보용 윤리와 실제 개발 현장의 괴리가 만드는 충돌을 다룬다.

개발자들은 코딩 도구를 매달 일정액만 내는 수도세처럼 여겨왔습니다. 깃허브 코파일럿이 토큰 기반 과금으로 전환하며 월 29달러였던 비용이 750달러까지 치솟았습니다. 이제는 생각 없이 코드를 생성하는 대신 가용 자원을 관리하는 전략이 필요합니다.

구글이 클라우드 VM 기반의 상시 구동 에이전트 제미나이 스파크를 공개했다. 기기 전원 상태와 무관하게 백그라운드에서 디지털 할 일을 완수한다. 워크스페이스 연동을 통해 일정 요약, 쇼핑 리서치, 정보 취합을 수행한다.

AI가 정치 공약 분석의 진입장벽을 낮추고 있다. 2006년 이후 지방선거 공약 55만 건을 분석하는 Show GN이 공개됐다. GPT와 Gemini를 활용해 공약-조례-입법의 연속성을 추적할 계획이다.

AI 도입 초기 기대감과 달리 운영 비용이 급격히 상승하고 있다. 미국 기업들이 비용 절감을 위해 AI 사용 권한을 제한하기 시작했다. 무제한 제공에서 효율 중심의 'AI 배분' 체제로 전환하는 추세다.

앤스로픽이 OpenAI를 제치고 세계에서 가장 가치 있는 AI 스타트업이 됐다. 시리즈 H 펀딩으로 650억 달러를 조달하며 기업가치가 1조 달러에 육박했다. 클로드 코드의 흥행과 연 매출 470억 달러 달성이 성장의 핵심 동력이다.