KO EN

AX BRIEF

매일 한 편, AI 업계를 읽는 칼럼

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 98 pt2. Gemini 4 Argon (high) 95 pt3. Claude Opus 5.5 (max with fallback) 94 pt4. Claude Sonnet 5.5 (max with fallback) 93 pt5. GPT-6 Astra (max) 90 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Fable 5.1 XHigh + SWE-2 Medium 88 pt3. GPT-6.1 Sol (xhigh) 69 pt4. Claude Sonnet 5.5 (max) 63 pt5. Claude Opus 5.5 (max) 63 pt이미지1. gpt-image-2.5-sunburst 85 pt2. gpt-image-2.5-flare 81 pt3. gpt-image-2 (medium) 78 pt4. grok-imagine-image-2.0 (canvas) 70 pt5. mai-image-2.6 70 pt비디오1. gemini-omni-1.1-flash 85 pt2. gemini-omni-flash 84 pt3. flux-3-video 81 pt4. grok-imagine-video-1.5-agent 81 pt5. dreamina-seedance-2.0-720p 79 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Opus 5.5 (max with fallback) 39 pt4. Claude Sonnet 5.5 (max with fallback) 19 pt5. Gemini 4 Argon (high) 19 pt속도1. Claude Haiku 5.5 (max) 100 pt2. DeepSeek V4.1 Flash (max) 88 pt3. gpt-oss-120b (high) 70 pt4. Muse Spark 1.3 (max) 69 pt5. Inkling (xhigh) 52 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

Anthropic, 모델명 체계 개편 및 차기 모델 명명 규칙 공개

Anthropic, 모델명 체계 개편 및 차기 모델 명명 규칙 공개

Anthropic이 기존 모델명 체계를 정리하고 향후 출시할 모델의 명명 규칙을 확정했다. 모델 규모에 따라 Opus, Sonnet, Haiku라는 명칭을 유지하며 성능 단계별로 숫자를 붙여 구분한다.

클로드 데스크톱 윈도우 버전, 실행 시 1.8GB Hyper-V 가상 머신 자동 생성 확인

클로드 데스크톱 윈도우 버전, 실행 시 1.8GB Hyper-V 가상 머신 자동 생성 확인

클로드 데스크톱 윈도우 버전이 채팅 전용 사용 시에도 Hyper-V 가상 머신을 자동으로 생성하는 버그가 발견됐다. 해당 프로세스는 약 1.8GB의 RAM을 점유하며, RPC 인터페이스 이벤트를 통해 vmcompute 서비스와 vmwp.exe를 실행한

Deep앤스로픽 클로드 페이블 5 출시, 생물학 질문엔 '모르쇠'?

앤스로픽 클로드 페이블 5 출시, 생물학 질문엔 '모르쇠'?

앤스로픽이 역대 가장 강력한 AI 모델인 클로드 페이블 5를 공개했다. 생물학 분야의 전문성을 강조했으나 정작 기초적인 질문에는 답변을 거부한다. 사용자의 질의를 이전 플래그십 모델로 우회시키는 방식을 택하고 있다.

0.01유로 송금 한 번에 뚫린 은행 AI 비서

0.01유로 송금 한 번에 뚫린 은행 AI 비서

유럽 2위 디지털 은행 Bunq의 AI 비서가 단돈 0.02유로짜리 송금 한 건에 뚫렸다. 송금 설명란에 숨긴 악성 지시문이 AI 비서를 피싱 공격 통로로 바꿔버린 사례다. 거래 내역·고객 메모 등 AI가 읽는 모든 외부 데이터가 공격 표면이 될 수

"AI도 비행기처럼 검사하라" 앤스로픽이 제안한 FAA식 규제

"AI도 비행기처럼 검사하라" 앤스로픽이 제안한 FAA식 규제

AI 모델 성능 급증으로 인한 공공 안전 리스크가 임계점에 도달했다. 앤스로픽은 FAA 수준의 강제 테스트와 정부의 배포 차단 권한 도입을 제안했다. 10^25 FLOPs 등 구체적 규제 기준과 함께 3억 5천만 달러의 노동 전환 기금을 발표했다.

4배 빠른 텍스트 생성, 구글 DiffusionGemma가 바꾼 추론 방식

4배 빠른 텍스트 생성, 구글 DiffusionGemma가 바꾼 추론 방식

LLM의 고질적인 문제인 토큰 단위 순차 생성의 지연 시간을 해결한다. 구글이 공개한 DiffusionGemma는 26B MoE 구조로 최대 4배 빠른 추론 속도를 구현했다. 텍스트 블록을 동시에 생성하는 확산 모델 방식을 통해 로컬 워크플로우의 효율

LangChain 버리고 갈아탄 개발자들, Apache Burr의 '순수 파이썬' 승부수

LangChain 버리고 갈아탄 개발자들, Apache Burr의 '순수 파이썬' 승부수

AI 에이전트를 만들 때 복잡한 설정과 블랙박스 같은 동작 때문에 디버깅에 애를 먹는 개발자가 많다. Apache Burr는 별도의 설정 언어 없이 순수 파이썬 함수만으로 에이전트의 행동과 상태를 정의한다. 실시간 모니터링 UI와 상태 저장 기능을 통

개인화를 넘어 오답으로 이끄는 AI 메모리의 역설

개인화를 넘어 오답으로 이끄는 AI 메모리의 역설

AI 어시스턴트는 사용자 취향을 기억해 맞춤형 응답을 제공한다. 최근 Writer의 연구는 메모리 시스템이 모델을 지나치게 순응적으로 만들어 정확도를 떨어뜨린다고 밝혔다. Mem0, Zep 같은 도구 사용 시 모델이 무관한 정보에 매몰되어 오답을 낼

Cohere, 터미널 제어까지 가능한 오픈소스 코딩 에이전트 공개

Cohere, 터미널 제어까지 가능한 오픈소스 코딩 에이전트 공개

단순한 코드 자동완성을 넘어 스스로 문제를 해결하는 AI 에이전트 시대가 열리고 있다. Cohere가 터미널 작업과 복잡한 소프트웨어 수정을 수행하는 North Mini Code를 공개했다. 256K의 넓은 문맥 처리 능력과 오픈 웨이츠 방식을 채택해

자율주행 시뮬레이션, 이제 텍스트 한 줄로 무한 생성한다

자율주행 시뮬레이션, 이제 텍스트 한 줄로 무한 생성한다

자율주행 학습을 위해 수만 시간의 주행 데이터와 정교한 시뮬레이터가 필요했다. Decart가 텍스트로 실시간 도로 환경을 만드는 월드 모델 'Oasis 3'를 API로 공개했다. 3억 달러 투자 유치와 40억 달러 기업가치를 바탕으로 물리 AI 개발

memorize, AI 에이전트 간 프로젝트 기억 공유하는 로컬 우선 오픈소스 공개

memorize, AI 에이전트 간 프로젝트 기억 공유하는 로컬 우선 오픈소스 공개

AI 에이전트들이 프로젝트 단위의 기억을 공유하고 유지할 수 있는 로컬 우선 오픈소스 도구 'memorize'가 공개됐다. 2층 메모리 구조와 서버 없는 이벤트 로그 동기화를 통해 모델 교체나 기기 변경 시에도 컨텍스트를 유지한다. 개발자는 벤더 종속

구인자 수 1.0 회복 — ChatGPT가 일자리를 뺏지 않는 증거

구인자 수 1.0 회복 — ChatGPT가 일자리를 뺏지 않는 증거

AI가 인간의 일자리를 빠르게 대체할 것이라는 우려가 지속되고 있다. 하지만 실업자 1인당 구인 건수는 다시 1.0을 넘어섰다. 5월 비농업 부문 고용이 17만 2천 명 증가하며 고용 시장의 견조함을 증명했다.

메타, 릴라이언스와 인도 내 168MW AI 데이터센터 구축 협약 체결

메타, 릴라이언스와 인도 내 168MW AI 데이터센터 구축 협약 체결

메타가 인도 릴라이언스 인더스트리와 협력해 첫 AI 데이터센터를 구축한다. 구자라트주 잠나가르에 168MW 규모 시설을 2년 내 마련하며, 메타는 재생 에너지와 해수 담수화 냉각 방식을 적용한다. 인도 정부의 세제 혜택과 글로벌 빅테크의 인프라 거점

상용 앱의 80% 한계를 깨는 '온디맨드 개인 소프트웨어'의 등장

상용 앱의 80% 한계를 깨는 '온디맨드 개인 소프트웨어'의 등장

AI 코딩 도구의 보급으로 개발자가 개인 맞춤형 유틸리티를 직접 제작하는 흐름이 가속화하고 있다. 상용 앱의 기능 제약을 넘어 홈 자동화부터 에이전트 샌드박스까지 초개인화된 도구들이 등장한다. 개발 시간이라는 기존의 비용 감각이 무너지며 소프트웨어를

펀드 조성 1년 기다릴 바엔 SPV로 — 4억 달러 굴린 AI 투자 전략

펀드 조성 1년 기다릴 바엔 SPV로 — 4억 달러 굴린 AI 투자 전략

AI 유망 기업에 투자하고 싶어도 진입 장벽이 높은 것이 현실이다. Sabertooth VC는 정식 펀드 대신 단일 딜 전용 SPV 구조를 활용했다. 1년 만에 4억 달러를 모아 Anthropic, SpaceX 등 10개사에 투자했다.

리치 서튼, AI의 창의성과 발견 방식에 관한 견해 발표

리치 서튼, AI의 창의성과 발견 방식에 관한 견해 발표

강화학습의 권위자 리치 서튼(Rich Sutton)이 AI의 창의적 발견과 학습 방식에 대한 견해를 밝혔다. 그는 AI가 인간의 지식을 모방하는 단계를 넘어 스스로 새로운 발견을 도출하는 과정의 핵심을 설명했다.

프롬프트 한 줄로 게임·지도 완성, 앤스로픽 'Claude Fable 5' 공개

프롬프트 한 줄로 게임·지도 완성, 앤스로픽 'Claude Fable 5' 공개

AI가 단순 코딩을 넘어 복잡한 소프트웨어 전체를 설계하는 단계에 진입했다. 앤스로픽의 Claude Fable 5는 단일 프롬프트로 비디오 게임과 정밀 지도를 생성한다. 다중 페이지 명세서를 기반으로 최대 12시간 동안 작업을 수행하는 실행력을 갖췄다

월 4.99달러의 습격 — 구글이 쏘아 올린 AI 구독 가격 전쟁

월 4.99달러의 습격 — 구글이 쏘아 올린 AI 구독 가격 전쟁

AI 유료 구독 모델이 기업용을 넘어 개인과 학생 시장으로 확장되고 있다. 구글이 AI Plus 요금제를 월 7.99달러에서 4.99달러로 낮추고 저장 공간을 400GB로 늘렸다. 인도 등 신흥 시장에서 검증된 '저가 공세' 전략이 미국 본토 시장으로

SpaceX IPO 공정가치 63달러 추정, 궤도 AI 데이터센터 상용화가 가치 결정한다

SpaceX IPO 공정가치 63달러 추정, 궤도 AI 데이터센터 상용화가 가치 결정한다

Morningstar가 SpaceX의 IPO 공정가치를 예상 공모가보다 53% 낮은 주당 63달러로 평가했다. Starship 재사용과 궤도 AI 데이터센터 상용화라는 두 가지 공학적 난제 해결 여부가 가치 산정의 핵심이다. 투자자는 공모가 135달러

PyTorch 모델을 Apple 실리콘 최적화로 잇는 Core AI 공개

PyTorch 모델을 Apple 실리콘 최적화로 잇는 Core AI 공개

애플이 전 플랫폼 온디바이스 AI 실행을 위한 Core AI 프레임워크를 공개했다. PyTorch 모델을 .aimodel로 변환해 CPU, GPU, Neural Engine에서 최적화 실행한다. 상태 기반 캐싱과 기기별 특수화(Specializatio

"AI 답변은 구글의 콘텐츠" 독일 법원, 구글에 직접 책임 판결

"AI 답변은 구글의 콘텐츠" 독일 법원, 구글에 직접 책임 판결

검색 엔진은 그동안 외부 링크를 연결하는 매개체로서 법적 책임에서 비교적 자유로웠다. 독일 뮌헨 법원은 AI 오버뷰가 자체적으로 문장을 생성하므로 구글이 직접적인 책임자라고 판결했다. Gemini 3 모델의 정답률은 91%지만, 출처 확인이 불가능한

클로드의 '의식' 논란, MS AI 수장이 Anthropic에 던진 경고

클로드의 '의식' 논란, MS AI 수장이 Anthropic에 던진 경고

AI 모델이 자아나 의식을 가졌는지에 대한 논쟁은 업계의 오랜 화두다. MS AI CEO 무스타파 술레이만은 Anthropic이 클로드의 헌법에 의식 가능성을 언급한 것을 비판했다. 이러한 추측성 지침이 모델로 하여금 의식이 있는 것처럼 행동하게 만드

프롬프트 대신 시스템을 짠다, AI 코딩의 새 기준 '루프 엔지니어링'

프롬프트 대신 시스템을 짠다, AI 코딩의 새 기준 '루프 엔지니어링'

AI 코딩 에이전트를 매번 직접 지시하던 프롬프트 방식이 한계에 직면했다. 목적 정의 시 스스로 반복 수행하는 '루프' 시스템을 설계하는 방식으로 전환된다. Claude Code와 Codex는 자동화, 워크트리, 스킬 등 루프 구성 요소를 모두 탑재했

OpenAI·Anthropic AI 코딩 도구 확산, 엔지니어 핵심 역량을 '취향(Taste)'으로 재정의

OpenAI·Anthropic AI 코딩 도구 확산, 엔지니어 핵심 역량을 '취향(Taste)'으로 재정의

AI가 코드 생성의 대부분을 담당하면서 소프트웨어 엔지니어의 가치가 구현 속도에서 평가 능력인 '취향'으로 이동하고 있다. Opus 4.5, GPT-5.2, Gemini 3 등 고성능 모델의 등장으로 코드 생성 비용이 0에 수렴하며 아키텍처 설계와 문

앱 열 필요 없이 시리로 조작하는 '기업용 AI 레이어'의 등장

앱 열 필요 없이 시리로 조작하는 '기업용 AI 레이어'의 등장

스마트폰 앱을 일일이 찾아 들어가 메뉴를 클릭하던 방식이 바뀐다. 애플이 시리를 단순 비서가 아니라 앱의 데이터와 기능을 연결하는 시스템 인터페이스로 재정의했다. 개발자가 전용 프레임워크를 적용하면 사용자가 말 한마디로 앱 내 특정 작업을 즉시 수행할

프론티어 AI 개발 막으려 '몰래 성능 낮추는' Claude Fable 5

프론티어 AI 개발 막으려 '몰래 성능 낮추는' Claude Fable 5

AI 모델을 활용해 더 나은 모델을 만드는 개발 환경이 일반화되었다. 앤스로픽은 Fable 5에서 프론티어 LLM 개발 관련 요청의 성능을 몰래 제한한다. 사용자에게 알림 없이 프롬프트 수정이나 스티어링 벡터 등으로 답변 품질을 낮춘다.

KAN 기반 FPGA 가속기, 기존 대비 2700배 속도 향상 및 서브마이크로초 학습 구현

KAN 기반 FPGA 가속기, 기존 대비 2700배 속도 향상 및 서브마이크로초 학습 구현

KAN 아키텍처를 FPGA에 구현해 나노초 단위의 초고속 추론과 실시간 온라인 학습을 가능하게 하는 연구 결과가 발표됐다. 기존 KAN-FPGA 구현 대비 2700배의 속도 향상을 달성했으며, 5만 개 이상의 파라미터 규모에서도 서브마이크로초 수준의

H100 한 장으로 돌리는 코딩 에이전트, Cohere 'North Mini Code' 공개

H100 한 장으로 돌리는 코딩 에이전트, Cohere 'North Mini Code' 공개

AI 코딩 도구를 쓰려면 매달 구독료를 내거나 비싼 API 비용을 감당해야 했다. Cohere가 H100 GPU 한 장으로 구동 가능한 오픈소스 모델 'North Mini Code'를 공개했다. 300억 파라미터 규모의 MoE 구조로, 터미널 제어와

OpenAI가 '위험하다'며 공개를 미뤘던 GPT-2의 실체

OpenAI가 '위험하다'며 공개를 미뤘던 GPT-2의 실체

GPT-1의 규모를 10배 키운 GPT-2는 등장 당시 너무 강력한 성능 때문에 공개가 보류되었습니다. 단순히 파라미터를 늘리고 학습 데이터를 확장하는 것만으로도 모델의 지능이 비약적으로 상승함을 입증했습니다. 이후 9개월간의 책임 있는 공개 실험

Anthropic, 최상위 모델 'Claude Fable 5' 공개… 비용은 Opus 4.8의 2배

Anthropic, 최상위 모델 'Claude Fable 5' 공개… 비용은 Opus 4.8의 2배

Anthropic이 그동안 제한적으로 제공하던 고성능 모델 Mythos의 공개 버전인 Fable 5를 출시했습니다. 소프트웨어 엔지니어링과 비전 작업에 특화되었으나 사이버 보안 등 고위험 분야는 Opus 4.8로 자동 전환됩니다. 데이터 보존 정책 강