KO EN

AX BRIEF

매일 한 편, AI 업계를 읽는 칼럼

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 98 pt2. Gemini 4 Argon (high) 95 pt3. Claude Opus 5.5 (max with fallback) 94 pt4. Claude Sonnet 5.5 (max with fallback) 93 pt5. GPT-6 Astra (max) 90 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Fable 5.1 XHigh + SWE-2 Medium 88 pt3. GPT-6.1 Sol (xhigh) 69 pt4. Claude Sonnet 5.5 (max) 63 pt5. Claude Opus 5.5 (max) 63 pt이미지1. gpt-image-2.5-sunburst 85 pt2. gpt-image-2.5-flare 81 pt3. gpt-image-2 (medium) 78 pt4. grok-imagine-image-2.0 (canvas) 70 pt5. mai-image-2.6 70 pt비디오1. gemini-omni-1.1-flash 85 pt2. gemini-omni-flash 84 pt3. flux-3-video 81 pt4. grok-imagine-video-1.5-agent 81 pt5. dreamina-seedance-2.0-720p 79 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Opus 5.5 (max with fallback) 39 pt4. Claude Sonnet 5.5 (max with fallback) 19 pt5. Gemini 4 Argon (high) 19 pt속도1. Claude Haiku 5.5 (max) 100 pt2. DeepSeek V4.1 Flash (max) 88 pt3. gpt-oss-120b (high) 70 pt4. Muse Spark 1.3 (max) 69 pt5. Inkling (xhigh) 52 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

데이터 쿼리 오류 잡는 Anthropic 내부 엔진 'ktx' 오픈소스 공개

데이터 쿼리 오류 잡는 Anthropic 내부 엔진 'ktx' 오픈소스 공개

AI 에이전트가 데이터베이스 쿼리 시 지표 정의를 무시하거나 임의로 해석하는 문제가 반복됐다. Anthropic이 내부적으로 사용하던 컨텍스트 레이어 ktx를 Apache 2.0 라이선스로 공개했다. dbt, Snowflake 등 주요 데이터 툴과 연

아마존 내부 슬랙서 자사 AI 모델 비판 확산

아마존 내부 슬랙서 자사 AI 모델 비판 확산

아마존 내부 슬랙 채널에서 직원들이 자사 AI 모델의 성능을 비판하는 게시글이 공유되었다. 직원들은 AI 모델의 결과물을 '슬롭(Sloppy, 조잡한)'이라 지칭하며 오펜하이머에 빗댄 별명을 붙였다.

소프트웨어 엔지니어링 정조준한 Anthropic의 신모델 Claude Fable 5 공개

소프트웨어 엔지니어링 정조준한 Anthropic의 신모델 Claude Fable 5 공개

AI 모델의 성능 경쟁이 단순 챗봇을 넘어 전문 지식 작업 영역으로 확장되고 있다. Anthropic이 소프트웨어 엔지니어링과 비전 성능을 극대화한 Claude Fable 5를 출시했다. 작업의 길이와 복잡도가 증가할수록 타 모델 대비 성능 격차가 더

2개월 분량 코딩을 하루 만에, 앤스로픽 '클로드 페이블 5' 공개

2개월 분량 코딩을 하루 만에, 앤스로픽 '클로드 페이블 5' 공개

앤스로픽이 최상위 성능의 '미토스'급 모델을 대중화한 클로드 페이블 5를 출시했다. 소프트웨어 엔지니어링 벤치마크에서 GPT-5.5를 압도하는 성능을 기록했다. 단순 코드 생성을 넘어 대규모 코드베이스 마이그레이션 등 에이전트 작업에 최적화했다.

"우주에 GPU 1만 대 띄운다" — a16z가 베팅한 Orbital의 야심

"우주에 GPU 1만 대 띄운다" — a16z가 베팅한 Orbital의 야심

AI 연산 수요 폭증으로 지구상의 데이터센터 부지 확보와 전력 공급이 한계에 다다랐다. 전동 킥보드 창업자 유윈 푼이 설립한 Orbital(우주 데이터센터 스타트업)이 500만 달러의 시드 투자를 유치했다. SpaceX의 스타십 발사 비용 절감을 전제

LLM 코드 생성, 'AI 록스타'가 남기는 기술 부채와 유지보수 리스크

LLM 코드 생성, 'AI 록스타'가 남기는 기술 부채와 유지보수 리스크

AI 에이전트가 단시간에 대량의 코드를 생성하며 유지보수가 어려운 'AI 록스타'처럼 동작하는 현상이 나타나고 있다. 맥락 없이 여러 채팅 세션에서 생성된 코드는 시스템 복잡도를 기하급수적으로 높여 인간이 해석하기 힘든 '슬롭(Slop)' 상태를 만든

애플, 음성 비서 넘어선 AI 컴패니언 'Siri AI' 공개

애플, 음성 비서 넘어선 AI 컴패니언 'Siri AI' 공개

애플이 WWDC 2026에서 기존 음성 비서를 넘어선 대화형 AI 'Siri AI'를 발표했다. 사용자의 화면 정보를 인식하고 기기 내 데이터를 활용해 개인화된 응답을 제공한다. 메일과 메시지 등 시스템 전반에 통합되어 문장 작성과 복합적인 작업 수행

헤드라인 1조, 실제 투자액은 4천억... 세쿼이아의 밸류에이션 트릭

헤드라인 1조, 실제 투자액은 4천억... 세쿼이아의 밸류에이션 트릭

AI 스타트업 투자 시장에서 기업 가치를 부풀리는 '이중 가격' 논란이 일었다. 세쿼이아 등 대형 VC가 낮은 가격에 대량 투자하고 높은 가격으로 홍보하는 방식이다. 실제 10억 달러로 발표된 기업의 실제 진입 가치가 4억 달러에 불과한 사례가 확인됐

AI 코딩 툴 썼는데 비번이 털렸다 — MS 오픈소스 공급망 공격

AI 코딩 툴 썼는데 비번이 털렸다 — MS 오픈소스 공급망 공격

AI 개발자들이 편리하게 쓰는 오픈소스 도구들이 해킹 통로가 되었습니다. 마이크로소프트의 깃허브 프로젝트 70여 개에 비밀번호를 훔치는 악성코드가 심겼습니다. 클로드 코드와 제미나이 CLI 등 AI 코딩 앱 사용자들의 계정 정보가 유출될 위험에 처했습

OS에 심은 제미나이, 애플이 설계한 '저비용 고효율' AI 전략

OS에 심은 제미나이, 애플이 설계한 '저비용 고효율' AI 전략

AI 경쟁에서 뒤처졌다는 평가를 받던 애플이 'Siri AI'를 공개했다. 구글 제미나이를 통합해 온스크린 인식과 앱 내 정보 검색 기능을 구현했다. 타사 대비 획기적으로 적은 자본 지출로 OS 수준의 배포 우위를 점한다는 전략이다.

xAI, Anthropic·구글에 GPU 임대... 월 최대 12.5억 달러 수익 구조 확보

xAI, Anthropic·구글에 GPU 임대... 월 최대 12.5억 달러 수익 구조 확보

xAI가 Anthropic과 구글에 대규모 GPU 용량을 임대하는 파트너십을 체결했다. Anthropic에는 월 12.5억 달러(22만 GPU), 구글에는 월 9.2억 달러(11만 GPU) 규모의 인프라를 제공한다. 모델 개발사에서 인프라 임대 사업자

샤오미 MiMo-V2.5-Pro-UltraSpeed 공개, 1조 파라미터 모델서 초당 1000토큰 생성 구현

샤오미 MiMo-V2.5-Pro-UltraSpeed 공개, 1조 파라미터 모델서 초당 1000토큰 생성 구현

샤오미가 1조 파라미터 규모의 MiMo-V2.5-Pro-UltraSpeed 모델을 공개했다. 표준 8-GPU 노드에서 초당 1000토큰 이상의 생성 속도를 구현했으며, FP4 양자화와 DFlash 기술을 적용했다. 추론 지연 시간이 획기적으로 줄어듦에

OpenAI IPO 추진 속 샘 알트먼의 '눈 스캔' 기업은 구조조정

OpenAI IPO 추진 속 샘 알트먼의 '눈 스캔' 기업은 구조조정

OpenAI가 기업공개(IPO)를 위해 비밀리에 서류를 제출하며 상장 절차에 돌입했다. 반면 샘 알트먼이 설립한 홍채 인식 기업 툴즈 포 휴머니티는 수익성 악화로 인원 감축 중이다. 이 기업은 25억 달러의 가치를 인정받았으나 한국을 포함한 글로벌 규

프롬프트 한 줄보다 '루프' 설계 — 코딩 에이전트의 새로운 작동 방식

프롬프트 한 줄보다 '루프' 설계 — 코딩 에이전트의 새로운 작동 방식

AI 코딩 에이전트를 사용할 때 매번 프롬프트를 입력해 지시하는 방식이 한계에 부딪혔다. 루프 엔지니어링은 에이전트가 스스로 작업을 찾고 검증하며 반복 수행하는 시스템 설계 방식이다. 워크트리와 서브에이전트 등으로 자동화 구조를 짜지만 토큰 비용과 이

Anthropic에 밀리지 않는다 — OpenAI, SEC에 상장 서류 제출

Anthropic에 밀리지 않는다 — OpenAI, SEC에 상장 서류 제출

생성형 AI 시장의 주도권을 쥔 OpenAI와 Anthropic이 기업 공개(IPO) 경쟁에 나섰다. OpenAI는 최근 미국 증권거래위원회(SEC)에 상장 신청서인 Form S-1을 비밀리에 제출했다. 이는 6월 1일 먼저 상장 절차를 밟은 Anth

"토큰 93% 줄이고 캐시 96% 덜어낸다", LLM 에이전트·구조의 실무적 진화

"토큰 93% 줄이고 캐시 96% 덜어낸다", LLM 에이전트·구조의 실무적 진화

LLM 에이전트의 운영 비용과 트랜스포머의 메모리 병목을 해결하려는 연구가 가속화된다. 에이전트 워크플로를 모델 가중치에 직접 컴파일해 토큰 사용량을 최대 93%까지 절감한다. QKV 투영 공유와 SSM-어텐션 융합을 통해 KV 캐시를 최대 96.9%

기억력 한계 깼다, GPT-5.4 성능 넘은 20B 오픈소스 검색 에이전트

기억력 한계 깼다, GPT-5.4 성능 넘은 20B 오픈소스 검색 에이전트

AI 에이전트가 복잡한 검색 작업 중 이전 맥락을 잊어버리는 '검색 건망증' 문제가 지속되고 있다. UIUC와 UC 버클리, Chroma가 개발한 Harness-1은 200억 파라미터 규모로 GPT-5.4의 정보 회수 성능을 앞질렀다. 모델 내부 메모

프롬프트로 확장 프로그램까지 — 아이폰 OS에 심은 애플 인텔리전스

프롬프트로 확장 프로그램까지 — 아이폰 OS에 심은 애플 인텔리전스

아이폰 기본 앱 전반에 AI 기능이 통합되어 사용자 경험이 바뀐다. 사파리 확장 프로그램 생성과 단축어 자동 구축을 자연어로 처리한다. 통화 중 타 앱의 맥락을 실시간으로 불러오는 OS 레벨의 통합이 핵심이다.

애플, 화면 읽고 앱 제어하는 'Siri AI'와 비주얼 인텔리전스 공개

애플, 화면 읽고 앱 제어하는 'Siri AI'와 비주얼 인텔리전스 공개

애플이 OS 전반에 통합된 차세대 '애플 인텔리전스'와 Siri AI를 공개했다. Siri AI는 앱 간 경계를 넘어 사용자의 맥락을 이해하고 직접 작업을 수행한다. 개발자는 전용 프레임워크를 통해 비용 없이 온디바이스 AI 기능을 앱에 통합한다.

구글 제미나이로 설계 바꾼 애플 인텔리전스의 새로운 아키텍처

구글 제미나이로 설계 바꾼 애플 인텔리전스의 새로운 아키텍처

애플이 구글 제미나이 기술을 적용한 새로운 AI 아키텍처를 발표했다. 온디바이스와 프라이빗 클라우드 컴퓨트를 모두 지원하는 통합 모델 구조다. 이미지 생성과 시각적 질의응답 등 멀티모달 추론 능력이 대폭 강화됐다.

구글 제미나이 품은 시리와 아이폰 11까지 지원하는 iOS 27 공개

구글 제미나이 품은 시리와 아이폰 11까지 지원하는 iOS 27 공개

애플이 WWDC 2026에서 차세대 OS인 iOS 27과 AI 업데이트를 발표했다. 구글 제미나이를 탑재한 시리는 독립 앱 형태로 제공되며 시각 지능 기능을 강화했다. 아이폰 11 이후 모든 기기를 지원하며 사진 로딩 70%, 에어드롭 속도 80%를

AI 인프라의 역설, 2030년까지 매출 2조 달러 없으면 붕괴한다

AI 인프라의 역설, 2030년까지 매출 2조 달러 없으면 붕괴한다

AI 모델 성능 경쟁이 인프라 투자 과열로 이어지며 거대한 거품 논란이 일고 있다. OpenAI와 Anthropic은 2026년 각각 최대 500억 달러의 컴퓨팅 비용을 지출할 전망이다. 2030년까지 연 매출 2조 달러를 달성하지 못하면 현재의 데이

"아이디어만으로 굿즈 제작" 아마존, AI 기반 맞춤 상품 서비스 출시

"아이디어만으로 굿즈 제작" 아마존, AI 기반 맞춤 상품 서비스 출시

누구나 쉽게 굿즈를 만들 수 있는 프린트 온 디맨드 시장이 성장하고 있다. 아마존이 쇼핑 앱 내에서 AI 프롬프트로 디자인하고 주문하는 기능을 도입했다. 미국 시장에 우선 출시되었으며 티셔츠부터 텀블러까지 다양한 품목을 지원한다.

Claude Code와 MCP 도입으로 분산 시스템 버그 90% 원샷 해결, 엔지니어 전문성 축 이동

Claude Code와 MCP 도입으로 분산 시스템 버그 90% 원샷 해결, 엔지니어 전문성 축 이동

LLM 기반 개발 도구의 진화로 시니어 소프트웨어 엔지니어의 도메인 전문성과 디버깅 능력이 빠르게 대체되고 있다. Claude 4.5부터 GPT 5.5, DataDog MCP 등으로 이어지는 도구 체인이 분산 시스템 버그의 90%를 원샷으로 해결하는

구글 신규 코드 75% AI 생성, '장인-빌더' 하이브리드 개발자 가치 커진다

구글 신규 코드 75% AI 생성, '장인-빌더' 하이브리드 개발자 가치 커진다

AI 코딩 도구의 확산으로 소프트웨어 생산 방식이 '장인' 중심에서 '빌더' 중심으로 빠르게 전환되고 있다. 구글의 신규 코드 75%가 AI로 생성되고 개발자의 84%가 AI를 도입하는 등 코드 생산량이 기하급수적으로 증가했다. 단순 구축을 넘어 보안

NVIDIA, 40개 언어 지원 초저지연 음성 인식 모델 'Nemotron 3.5 ASR' 공개

NVIDIA, 40개 언어 지원 초저지연 음성 인식 모델 'Nemotron 3.5 ASR' 공개

NVIDIA가 40개 언어를 통합 처리하는 초저지연 스트리밍 음성 인식 모델 Nemotron 3.5 ASR을 공개했다. 6억 개의 파라미터 규모로 Cache-Aware FastConformer-RNNT 구조를 채택해 연산 효율을 높였다. 개발자는 서비

Qwen 3.7 Max 등장과 미국 AI 프론티어 모델의 비용 효율성 논란

Qwen 3.7 Max 등장과 미국 AI 프론티어 모델의 비용 효율성 논란

중국 Qwen 3.7 Max 등 고성능 모델이 등장하며 미국 중심의 AI 지능 독점 구조에 균열이 생기고 있다. OpenRouter를 통해 100달러에 10만 크레딧으로 Qwen, DeepSeek 등 여러 모델을 교차 사용할 수 있는 환경이 구축됐다.

에이전틱 AI, 코드 생성 속도 높였으나 소프트웨어 엔지니어링 병목 현상 심화

에이전틱 AI, 코드 생성 속도 높였으나 소프트웨어 엔지니어링 병목 현상 심화

에이전틱 AI가 코드 생성 단계를 자동화하며 소프트웨어 개발의 실행 속도를 비약적으로 높였다. 우버의 예산 조기 소진과 특정 기업의 5억 달러 규모 Anthropic 청구서 사례처럼 통제되지 않은 에이전트 루프로 인한 비용 리스크가 확인됐다. 개발자는

NeoGraph, C++ 기반 에이전트 엔진 공개... 노드 오버헤드 5.0µs 달성

NeoGraph, C++ 기반 에이전트 엔진 공개... 노드 오버헤드 5.0µs 달성

C++17 기반의 에이전트 오케스트레이션 엔진 NeoGraph가 공개됐다. 그래프 구조를 JSON 데이터로 정의해 1,000명 동시 처리 시 RSS 29MB의 메모리 효율과 5.0µs의 노드 오버헤드를 기록했다. 개발자는 무배포 핫스왑과 멀티테넌트 환

앤스로픽, 리눅스용 클로드 데스크톱 공식 출시 요구와 개발 환경의 제약

앤스로픽, 리눅스용 클로드 데스크톱 공식 출시 요구와 개발 환경의 제약

리눅스 사용자들이 앤스로픽에 공식 클로드 데스크톱(Claude Desktop) 출시를 요구하고 있다. 현재 리눅스에서는 CLI 도구인 클로드 코드(Claude Code)만 지원되며, GUI 기반의 확장 기능과 '코워크(Cowork)' 기능은 사용할 수