KO EN

AX BRIEF

매일 한 편, AI 업계를 읽는 칼럼

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 98 pt2. Gemini 4 Argon (high) 95 pt3. Claude Opus 5.5 (max with fallback) 94 pt4. Claude Sonnet 5.5 (max with fallback) 93 pt5. GPT-6 Astra (max) 90 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Fable 5.1 XHigh + SWE-2 Medium 88 pt3. GPT-6.1 Sol (xhigh) 69 pt4. Claude Sonnet 5.5 (max) 63 pt5. Claude Opus 5.5 (max) 63 pt이미지1. gpt-image-2.5-sunburst 85 pt2. gpt-image-2.5-flare 81 pt3. gpt-image-2 (medium) 78 pt4. grok-imagine-image-2.0 (canvas) 70 pt5. mai-image-2.6 70 pt비디오1. gemini-omni-1.1-flash 85 pt2. gemini-omni-flash 84 pt3. flux-3-video 81 pt4. grok-imagine-video-1.5-agent 81 pt5. dreamina-seedance-2.0-720p 79 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Opus 5.5 (max with fallback) 39 pt4. Claude Sonnet 5.5 (max with fallback) 19 pt5. Gemini 4 Argon (high) 19 pt속도1. Claude Haiku 5.5 (max) 100 pt2. DeepSeek V4.1 Flash (max) 88 pt3. gpt-oss-120b (high) 70 pt4. Muse Spark 1.3 (max) 68 pt5. Inkling (xhigh) 55 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

"5일 뒤 날씨가 내일처럼 정확" — 윈드본의 AI 기상 예보

"5일 뒤 날씨가 내일처럼 정확" — 윈드본의 AI 기상 예보

기상 예보는 슈퍼컴퓨터와 물리 모델이 지배하는 영역이었다. 스타트업 윈드본이 공개한 '웨더메시 6'는 유럽 중기예보센터(ECMWF)보다 더 잦고 정확한 예측을 제공한다. 자체 기상 풍선 400개에서 수집한 데이터를 모델에 직접 입력해 예측 정밀도를 높

추론부터 행동까지 하나로, 물리 AI 통합 모델 코스모스 3 공개한 엔비디아

추론부터 행동까지 하나로, 물리 AI 통합 모델 코스모스 3 공개한 엔비디아

물리 AI는 현실 세계를 이해하고 다음 상황을 예측해 행동을 생성해야 한다. 엔비디아가 추론, 세계 생성, 행동 생성을 하나로 통합한 코스모스 3를 오픈소스로 공개했다. MoT 아키텍처 기반의 8B, 32B 모델과 학습 레시피, 6종의 합성 데이터셋을

GPT-5.5 성능 잡고 비용은 10%로 낮춘 MiniMax-M3 공개

GPT-5.5 성능 잡고 비용은 10%로 낮춘 MiniMax-M3 공개

중국 AI 스타트업 MiniMax가 100만 토큰 컨텍스트를 지원하는 M3 모델을 출시했다. GPT-5.5와 Gemini 3.1 Pro의 성능을 일부 추월하며 운영 비용을 8~20% 수준으로 절감했다. 10일 이내에 가중치 공개(Open Weights

구글 AI 검색의 역설, 'No-AI' 기본 설정 내놓은 DuckDuckGo

구글 AI 검색의 역설, 'No-AI' 기본 설정 내놓은 DuckDuckGo

구글이 검색 결과 상단에 AI 생성 개요를 배치하는 AI 우선 체제로 전환했다. DuckDuckGo는 AI 답변과 채팅 프롬프트를 제거한 'noai' 전용 페이지를 기본 검색엔진으로 설정하는 확장 프로그램을 출시했다. 출시 후 No-AI 페이지 방문자

AI가 생성한 Matplotlib 코드 오류, 개발 환경의 신뢰성 문제 제기

AI가 생성한 Matplotlib 코드 오류, 개발 환경의 신뢰성 문제 제기

AI가 데이터 시각화 라이브러리인 Matplotlib의 잘못된 코드를 생성하며 개발 효율성에 혼선을 빚었습니다. 모델의 환각 현상이 실무 코드 작성에 미치는 영향과 검증의 중요성이 다시금 강조됩니다.

엔비디아, 노트북 및 데스크톱 PC용 범용 칩 공개

엔비디아, 노트북 및 데스크톱 PC용 범용 칩 공개

엔비디아가 노트북과 데스크톱 PC를 위한 범용 칩을 공개했습니다. 기존 GPU 중심의 하드웨어 구성을 넘어 PC 시스템의 핵심 연산 영역으로 진출합니다.

OpenAI 청구서 공포 끝낼 LLM 관측 플랫폼 Spanlens

OpenAI 청구서 공포 끝낼 LLM 관측 플랫폼 Spanlens

LLM 서비스 운영 시 가장 큰 고민은 예상치 못한 비용과 복잡한 디버깅이다. 오픈소스 플랫폼 Spanlens는 baseURL 변경만으로 비용 추적과 에이전트 경로 시각화를 제공한다. LangGraph 토폴로지 뷰와 Critical Path 분석으로

코드 재작성 비용 0원 시대, 모델링이 개발자의 유일한 무기

코드 재작성 비용 0원 시대, 모델링이 개발자의 유일한 무기

LLM의 생산성 폭발로 인간의 소비 속도가 개발의 새로운 병목이 됐다. 무분별한 AI 생성물인 '슬롭(Slop)'의 악순환을 막기 위해 자동 방어층 구축이 필수적이다. 이제 개발자의 핵심 역량은 단순 구현이 아니라 시스템 아키텍처 설계와 컨텍스트 관리

OpenAI가 못 먹는 AI 앱 시장, '시스템 오브 워크'가 해자다

OpenAI가 못 먹는 AI 앱 시장, '시스템 오브 워크'가 해자다

AI 모델 성능이 올라가며 단순한 앱 서비스들이 거대 랩에 흡수되고 있다. 하지만 복잡한 산업별 워크플로와 규제를 해결하는 버티컬 영역은 여전히 기회다. 모델은 교체 가능하지만 실제 업무가 돌아가는 시스템을 소유한 기업이 살아남는다.

The Website Specification 공개, AI 에이전트 대응 포함한 10개 영역 표준 제시

The Website Specification 공개, AI 에이전트 대응 포함한 10개 영역 표준 제시

플랫폼과 무관하게 적용 가능한 웹사이트 기술 표준인 'The Website Specification'이 공개되었습니다. SEO, 보안, 성능 등 10개 영역을 다루며 MCP 서버를 통해 AI 에이전트의 접근성을 높였습니다.

AI 구독 서비스, 이제는 '해지'가 해결책이 될 수 있을까?

AI 구독 서비스, 이제는 '해지'가 해결책이 될 수 있을까?

AI 구독 비용에 대한 부담과 효용성 고민이 제기되었습니다. 구독 해지를 통해 최적의 도구 조합을 찾는 움직임이 나타나고 있습니다.

Odysseus, ChatGPT UI를 내 서버에 구현하는 셀프 호스팅 AI 워크스페이스 공개

Odysseus, ChatGPT UI를 내 서버에 구현하는 셀프 호스팅 AI 워크스페이스 공개

ChatGPT와 Claude의 UI 경험을 개인 서버에서 구현하는 셀프 호스팅 워크스페이스 Odysseus 1.0이 공개됐다. ChromaDB, SearXNG, ntfy를 통합해 로컬 데이터 기반의 프라이버시 중심 환경을 제공한다. 셸 접근, 모델 다

초당 400토큰 쏟아내는 Step 3.7 Flash, AI 에이전트 '실행' 속도 잡았다

초당 400토큰 쏟아내는 Step 3.7 Flash, AI 에이전트 '실행' 속도 잡았다

AI 에이전트가 단순 대화를 넘어 실제 업무를 수행하는 실행 단계로 진입했다. StepFun이 공개한 Step 3.7 Flash는 초당 최대 400토큰의 처리량을 구현했다. 256k 컨텍스트 윈도우와 3단계 추론 설정을 통해 비용과 성능의 균형을 맞췄

서버 없이 아이폰에서 9초 만에 그림 그리는 Bonsai Image 4B

서버 없이 아이폰에서 9초 만에 그림 그리는 Bonsai Image 4B

이미지 생성 AI를 쓰려면 비싼 서버 비용과 대기 시간이 필수였다. PrismML이 모델 크기를 획기적으로 줄인 Bonsai Image 4B를 공개했다. 아이폰 17 프로 맥스에서 512px 이미지를 9.4초 만에 생성한다.

200파운드로 VRAM 32GB 확보 — Tesla V100 중고 조합의 실효성

200파운드로 VRAM 32GB 확보 — Tesla V100 중고 조합의 실효성

최신 GPU의 VRAM 부족 문제를 중고 데이터센터 GPU 조합으로 해결했다. Tesla V100 SXM2와 어댑터를 사용하여 총 32GB VRAM 환경을 구축했다. Qwen3.6-27B 모델을 초당 최대 60토큰 속도로 로컬에서 구동했다.

제로데이 스스로 찾는 Claude Mythos, 무너진 패치 골든타임

제로데이 스스로 찾는 Claude Mythos, 무너진 패치 골든타임

AI가 알려진 취약점 공격을 넘어 스스로 제로데이 취약점을 발견하는 단계에 진입했다. Claude Mythos는 CyberGym 83.1%를 기록하며 취약점 발견의 '안전 마진'을 제거했다. 기존 CVSS 중심의 패치 우선순위 체계는 AI의 공격 속도

"인간은 소중하다" — AI 능력 격차 논리를 대체할 명제

"인간은 소중하다" — AI 능력 격차 논리를 대체할 명제

AI와 인간의 능력 격차가 좁아지며 기존의 인간 가치 옹호 논리가 흔들리고 있다. 창작물의 질을 결정하는 '의도'와 '형식' 중 AI는 의도 없는 형식만 빠르게 생성한다. 결과물의 품질이라는 가변적 수치 대신 인간 존재 자체의 가치를 선언하는 논리가

토큰 65배 더 쓰는 MCP, 다시 CLI로 돌아가는 이유

토큰 65배 더 쓰는 MCP, 다시 CLI로 돌아가는 이유

LLM 외부 도구 연결 표준인 MCP가 과도한 토큰 소비와 성능 저하 문제를 드러냈다. 4개 서버 연결 시 컨텍스트의 최대 16.5%가 도구 정의로 낭비되며 호출 속도는 API 대비 3배 느리다. CLI 우선 전략과 필요할 때만 로드하는 '스킬(Ski

50개 쌓인 세션 속에서 정답 찾기 — pi 전용 관리 도구 pisesh

50개 쌓인 세션 속에서 정답 찾기 — pi 전용 관리 도구 pisesh

코딩 에이전트 사용 시 급증하는 세션 관리의 불편함이 실무적 병목이 된다. pisesh는 즐겨찾기와 검색 기능을 통해 pi의 세션 복구 과정을 효율화한다. npm 설치 후 pi 내부에서 /sesh 명령어로 즉시 호출해 사용할 수 있다.

월급보다 무서운 정체성 상실, 'AI 대체 장애(AIRD)'의 등장

월급보다 무서운 정체성 상실, 'AI 대체 장애(AIRD)'의 등장

AI로 인한 일자리 상실이 단순한 경제적 불안을 넘어 심리적 '애도' 단계로 진입했다. 2025년 플로리다대 연구진은 이를 'AI 대체 장애(AIRD)'라는 새로운 임상 개념으로 정의했다. 인지 노동자의 전문성이 곧 정체성인 특성상, 과거 산업혁명보다

AI 에이전트의 'DROP TABLE' 막는 보안 방화벽 Claw Patrol 공개

AI 에이전트의 'DROP TABLE' 막는 보안 방화벽 Claw Patrol 공개

AI 에이전트에게 프로덕션 권한을 줬을 때 발생하는 통제 불능 위험을 해결한다. 자격 증명을 분리 보관하고 SQL·k8s 등 와이어 레벨 트래픽을 파싱해 액션을 게이팅한다. LLM 판사와 사람의 승인 절차를 결합해 위험 호출을 실시간으로 차단하는 구조

프랑스에 750억 유로 쏟아붓는 소프트뱅크의 AI 인프라 베팅

프랑스에 750억 유로 쏟아붓는 소프트뱅크의 AI 인프라 베팅

소프트뱅크가 프랑스 데이터센터 확장에 최대 750억 유로를 투자한다. 2031년까지 3.1GW를 포함해 총 5GW의 전력 용량을 확보할 계획이다. 미국 내 건설 반대 여론을 피해 유럽 AI 인프라 거점을 선점하려는 움직임이다.

DeepAI 광풍 속에서 '지루한 웹'을 선택한 전략적 이유

AI 광풍 속에서 '지루한 웹'을 선택한 전략적 이유

생존을 위해 모든 제품을 AI로 피벗해야 한다는 압박이 거세다. 메타 출신 크레이그 캠벨은 2022년 엑싯 후 AI 골드러시를 외면했다. 하이프를 쫓는 대신 기초적인 유틸리티를 확보하는 역발상 전략을 택했다.

분기 40억 달러 적자 Meta, AI 펜던트로 하드웨어 반전 노린다

분기 40억 달러 적자 Meta, AI 펜던트로 하드웨어 반전 노린다

Meta가 대화 기록이 가능한 AI 펜던트를 개발해 내년부터 테스트한다. 2025년 말 인수한 Limitless의 기술을 기반으로 웨어러블 라인업을 확장한다. 기업용 구독 서비스 'Wearables for Work'를 통해 리얼리티 랩스의 적자를 상쇄

AI 윤리를 고집하면 '아웃사이더'가 되는 업계의 민낯

AI 윤리를 고집하면 '아웃사이더'가 되는 업계의 민낯

AI 업계에서 도덕적 관점을 유지하는 것이 직업적 고립으로 이어진다. 성장 지상주의 속에서 윤리적 제동을 거는 실무자의 소외감을 분석한다. 기업의 홍보용 윤리와 실제 개발 현장의 괴리가 만드는 충돌을 다룬다.

Deep무제한 코딩의 시대는 끝났다: 깃허브 코파일럿의 '토큰 과금' 전환 분석

무제한 코딩의 시대는 끝났다: 깃허브 코파일럿의 '토큰 과금' 전환 분석

개발자들은 코딩 도구를 매달 일정액만 내는 수도세처럼 여겨왔습니다. 깃허브 코파일럿이 토큰 기반 과금으로 전환하며 월 29달러였던 비용이 750달러까지 치솟았습니다. 이제는 생각 없이 코드를 생성하는 대신 가용 자원을 관리하는 전략이 필요합니다.

노트북 꺼도 작업 계속하는 구글 '제미나이 스파크'의 실효성

노트북 꺼도 작업 계속하는 구글 '제미나이 스파크'의 실효성

구글이 클라우드 VM 기반의 상시 구동 에이전트 제미나이 스파크를 공개했다. 기기 전원 상태와 무관하게 백그라운드에서 디지털 할 일을 완수한다. 워크스페이스 연동을 통해 일정 요약, 쇼핑 리서치, 정보 취합을 수행한다.

역대 지방선거 공약 55만 건을 데이터로 뚫어낸 Show GN

역대 지방선거 공약 55만 건을 데이터로 뚫어낸 Show GN

AI가 정치 공약 분석의 진입장벽을 낮추고 있다. 2006년 이후 지방선거 공약 55만 건을 분석하는 Show GN이 공개됐다. GPT와 Gemini를 활용해 공약-조례-입법의 연속성을 추적할 계획이다.

비싼 AI는 이제 그만, 비용 부담에 '사용량 제한' 거는 미국 기업들

비싼 AI는 이제 그만, 비용 부담에 '사용량 제한' 거는 미국 기업들

AI 도입 초기 기대감과 달리 운영 비용이 급격히 상승하고 있다. 미국 기업들이 비용 절감을 위해 AI 사용 권한을 제한하기 시작했다. 무제한 제공에서 효율 중심의 'AI 배분' 체제로 전환하는 추세다.

OpenAI 꺾은 앤스로픽, 기업가치 1조 달러 육박하며 세계 1위 등극

OpenAI 꺾은 앤스로픽, 기업가치 1조 달러 육박하며 세계 1위 등극

앤스로픽이 OpenAI를 제치고 세계에서 가장 가치 있는 AI 스타트업이 됐다. 시리즈 H 펀딩으로 650억 달러를 조달하며 기업가치가 1조 달러에 육박했다. 클로드 코드의 흥행과 연 매출 470억 달러 달성이 성장의 핵심 동력이다.