KO EN

AX BRIEF

매일 한 편, AI 업계를 읽는 칼럼

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 98 pt2. Gemini 4 Argon (high) 95 pt3. Claude Opus 5.5 (max with fallback) 94 pt4. Claude Sonnet 5.5 (max with fallback) 93 pt5. GPT-6 Astra (max) 90 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Fable 5.1 XHigh + SWE-2 Medium 88 pt3. GPT-6.1 Sol (xhigh) 69 pt4. Claude Sonnet 5.5 (max) 63 pt5. Claude Opus 5.5 (max) 63 pt이미지1. gpt-image-2.5-sunburst 85 pt2. gpt-image-2.5-flare 81 pt3. gpt-image-2 (medium) 78 pt4. grok-imagine-image-2.0 (canvas) 70 pt5. mai-image-2.6 70 pt비디오1. gemini-omni-1.1-flash 85 pt2. gemini-omni-flash 84 pt3. flux-3-video 81 pt4. grok-imagine-video-1.5-agent 81 pt5. dreamina-seedance-2.0-720p 79 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Opus 5.5 (max with fallback) 39 pt4. Claude Sonnet 5.5 (max with fallback) 19 pt5. Gemini 4 Argon (high) 19 pt속도1. Claude Haiku 5.5 (max) 100 pt2. DeepSeek V4.1 Flash (max) 88 pt3. gpt-oss-120b (high) 70 pt4. Muse Spark 1.3 (max) 68 pt5. Inkling (xhigh) 55 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

법대 교수 75%가 선택한 정답, 정체는 AI였다

법대 교수 75%가 선택한 정답, 정체는 AI였다

법학 교육의 핵심인 법적 추론 영역에서 AI의 성능이 검증되었다. 스탠퍼드 법대 연구 결과, 교수들은 동료보다 AI의 답변을 75% 더 선호했다. 특히 교육적 위해성 판단에서 AI(3.5%)가 인간(12%)보다 낮게 나타났다.

Deep브라우저 밖으로 나온 GitHub Copilot, 데스크탑 전용 에이전트 앱 공개

브라우저 밖으로 나온 GitHub Copilot, 데스크탑 전용 에이전트 앱 공개

웹 브라우저와 IDE에 머물던 GitHub Copilot이 독립형 데스크탑 앱으로 확장됩니다. 기존 유료 구독자는 즉시 설치 가능하며, 에이전트 기반의 워크플로우 자동화를 지원합니다. 멀티 에이전트 세션과 MCP 서버 연동을 통해 개발 생산성 도구

클라우드 토큰 비용 제로, 1200억 파라미터 모델 돌리는 '서피스 RTX 스파크' 공개

클라우드 토큰 비용 제로, 1200억 파라미터 모델 돌리는 '서피스 RTX 스파크' 공개

AI 개발의 핵심 비용인 클라우드 토큰 과금 체계를 하드웨어로 정면 돌파한다. 엔비디아 블랙웰 기반 RTX 스파크 칩과 128GB 통합 메모리로 1200억 개 이상의 파라미터 모델을 로컬에서 구동한다. 윈도우 11 프로 기반의 개발 환경을 사전 구성해

Claude Code, 작업별 맞춤형 '동적 워크플로우' 기능 공개

Claude Code, 작업별 맞춤형 '동적 워크플로우' 기능 공개

Claude Code가 복잡한 작업에 최적화된 하네스를 스스로 작성하는 동적 워크플로우를 도입했다. 기존 단일 컨텍스트의 한계를 넘어 서브에이전트를 조율하고 작업을 병렬로 분리해 수행한다. 마이그레이션, 딥 리서치 등 코딩 외 비기술적 영역까지 에이전

H100 절반 가격의 MI300X, DeepSeek-V4-Flash 구동 장벽 뚫었다

H100 절반 가격의 MI300X, DeepSeek-V4-Flash 구동 장벽 뚫었다

AMD MI300X는 NVIDIA H100 대비 메모리 용량과 가격 경쟁력이 높지만 소프트웨어 최적화가 부족했다. FP8 데이터 타입 표준 불일치와 커널 부재로 인해 vLLM 기반의 DeepSeek-V4-Flash 구동이 불가능했다. vLLM 수정과

Kapa, RAG 이미지 비용 낮추고 성능 높인 '인덱싱 캡셔닝' 도입

Kapa, RAG 이미지 비용 낮추고 성능 높인 '인덱싱 캡셔닝' 도입

기술 문서 RAG에서 이미지 데이터 처리 비용과 컨텍스트 제한이 고질적 문제다. 쿼리 시점이 아닌 인덱싱 단계에서 이미지를 텍스트 캡션으로 변환해 저장했다. 쿼리당 비용 증가를 1~6%로 억제하며 답변 정확도를 통계적으로 유의미하게 높였다.

인프라 설정 없이 프롬프트로 웹 앱 배포하는 OpenAI 'Sites' 공개

인프라 설정 없이 프롬프트로 웹 앱 배포하는 OpenAI 'Sites' 공개

AI로 코드를 생성해도 실제 서버에 올리는 배포 과정은 여전히 개발자의 몫이었다. OpenAI가 프롬프트만으로 웹사이트와 앱을 즉시 배포하는 'Sites' 플러그인을 공개했다. Cloudflare Worker와 D1, R2를 통합해 별도 워크플로 없이

알리바바 Qwen3.7-Plus, 멀티모달 성능 높이고 API 가격 60% 낮췄다

알리바바 Qwen3.7-Plus, 멀티모달 성능 높이고 API 가격 60% 낮췄다

알리바바가 텍스트, 영상, 이미지를 모두 처리하는 Qwen3.7-Plus를 공개했다. 이전 모델 대비 비용을 60% 절감했으며 100만 토큰의 컨텍스트 창을 제공한다. 다만 기존의 오픈소스 전략을 버리고 폐쇄형 API 라이선스로만 제공된다.

MS, AI 에이전트 행동 제어 표준 'ACS' 공개

MS, AI 에이전트 행동 제어 표준 'ACS' 공개

AI 에이전트 도입 기업들이 환경마다 제각각인 행동 제어와 보안 설정에 어려움을 겪고 있다. 마이크로소프트가 오픈소스 표준인 ACS(Agent Control Specification)를 통해 일관된 거버넌스 계층을 제안했다. 정책 파일 하나로 입력부터

UC(캘리포니아 대학교) 시스템, 캠퍼스별로 엇갈린 AI 도입 정책 확인

UC(캘리포니아 대학교) 시스템, 캠퍼스별로 엇갈린 AI 도입 정책 확인

캘리포니아 대학교(UC) 시스템 내 캠퍼스들이 AI 도입에 대해 서로 다른 입장을 보이고 있습니다. 버클리 등 일부는 적극적으로 통합하는 반면, 다른 곳은 학문적 정직성을 이유로 제한하고 있습니다.

AI 제품 개발, 속도보다 '방향'과 '완성도'가 핵심 경쟁력으로 부상

AI 제품 개발, 속도보다 '방향'과 '완성도'가 핵심 경쟁력으로 부상

AI로 제품 구현 속도가 상향 평준화되며 단순 속도는 더 이상 차별화 요소가 되지 않습니다. AI의 기본값에 안주하지 않고 능동적인 선택과 반복적인 다듬기를 통해 완성도를 높이는 능력이 중요해졌습니다.

코딩 도구 뗀 OpenAI Codex, 기업용 인터랙티브 앱 시장 진입

코딩 도구 뗀 OpenAI Codex, 기업용 인터랙티브 앱 시장 진입

OpenAI가 에이전틱 AI 플랫폼 Codex의 대규모 업데이트를 발표했다. 주간 사용자 500만 명 중 비개발자 비중이 20%까지 확대되었다. 'Sites'와 'Annotations'로 기업 전용 웹 앱 구축과 정밀 편집을 지원한다.

OpenAI·SpaceX 상장 딜레마, 증시가 감당할 수 있는 규모인가

OpenAI·SpaceX 상장 딜레마, 증시가 감당할 수 있는 규모인가

AI 유니콘들의 기업가치가 천문학적으로 상승하고 있다. OpenAI와 Anthropic은 컴퓨팅 자원 확보를 위해 막대한 자본 투입이 필수적이다. 이들의 몸값이 공모 시장의 수용 능력을 넘어설 경우 상장 전략의 수정이 불가피하다.

트럼프, 수주간 수정 거친 '규모 축소' AI 행정명령 서명

트럼프, 수주간 수정 거친 '규모 축소' AI 행정명령 서명

트럼프 대통령이 여러 차례의 수정을 거쳐 규모를 줄인 AI 행정명령에 최종 서명했습니다. 규제보다는 효율성과 산업 성장에 무게를 둔 조정으로 풀이됩니다.

"텍스트로 AI 행동 정의하면 테스트 끝" — MS, 오픈소스 ASSERT 공개

"텍스트로 AI 행동 정의하면 테스트 끝" — MS, 오픈소스 ASSERT 공개

AI 모델의 일반 성능 평가를 넘어 특정 서비스 내에서의 구체적인 행동 제어가 중요해졌다. 마이크로소프트가 자연어 설명만으로 AI 행동 테스트 케이스를 생성하고 점수화하는 오픈소스 프레임워크 ASSERT를 공개했다. 목표와 정책을 텍스트로 입력하면 A

윈도우 버리고 안드로이드 택한 MS, AI 에이전트 플랫폼 '솔라라' 공개

윈도우 버리고 안드로이드 택한 MS, AI 에이전트 플랫폼 '솔라라' 공개

스마트폰과 PC가 모든 작업을 처리하던 앱 중심 시대가 저문다. MS가 앱 대신 AI 에이전트가 구동되는 디바이스 플랫폼 '솔라라'를 공개했다. 윈도우가 아닌 기업용 안드로이드 기반으로 저전력 특화 기기를 지향한다.

로컬과 클라우드 사이 실시간 경로 결정, Perplexity의 하이브리드 추론 시스템 공개

로컬과 클라우드 사이 실시간 경로 결정, Perplexity의 하이브리드 추론 시스템 공개

AI 에이전트가 데이터 성격에 따라 처리 위치를 스스로 결정하는 기술이 등장했다. Perplexity는 Computex 2026에서 로컬-서버 하이브리드 추론 오케스트레이터를 발표했다. 민감 정보는 온디바이스에서, 고난도 추론은 클라우드 모델이 처리해

OS 커널이 직접 막는다, MS가 공개한 AI 에이전트 격리 체계 MXC

OS 커널이 직접 막는다, MS가 공개한 AI 에이전트 격리 체계 MXC

AI 에이전트의 자율성이 높아질수록 기업의 보안 우려는 커지고 있다. 마이크로소프트는 윈도우 OS 커널 수준에서 에이전트 권한을 제어하는 MXC를 발표했다. 프로세스 격리부터 마이크로 VM까지 리스크 수준에 따라 샌드박스 강도를 선택적으로 적용한다.

"1조 달러 가치 없다" — '빅쇼트' 마이클 버리의 AI 거품 경고

"1조 달러 가치 없다" — '빅쇼트' 마이클 버리의 AI 거품 경고

투자자 마이클 버리가 스페이스X와 앤스로픽의 기업가치 산정 방식에 의문을 제기했다. 스페이스X의 S-1 보고서와 앤스로픽의 9,650억 달러 밸류에이션은 근거가 부족하다고 분석했다. 컴퓨팅 파워의 범용화와 '토큰맥싱' 트렌드 종료로 인한 인프라 과잉

주간 사용자 500만 명 돌파한 Codex, 사무직 전용 도구로 기업 시장 정조준

주간 사용자 500만 명 돌파한 Codex, 사무직 전용 도구로 기업 시장 정조준

코딩 도구로 알려진 Codex가 소프트웨어 엔지니어를 넘어 일반 사무직 영역으로 확장한다. 데이터 분석부터 투자 은행 업무까지 특화된 6종의 플러그인과 웹사이트 출력 기능을 공개했다. 40억 달러 규모의 기업 전용 합작 법인 설립에 이어 실질적인 업무

구글, 실시간 멀티모달 추론 ‘제미나이 스파크’ 공개하며 AI 에이전트 경쟁 가속

구글, 실시간 멀티모달 추론 ‘제미나이 스파크’ 공개하며 AI 에이전트 경쟁 가속

구글이 복잡한 계획 수립에 최적화된 새로운 AI 경험 ‘제미나이 스파크’를 선보였습니다. 사용자의 의도를 실시간으로 파악해 여행 계획 등 다단계 과업을 수행하는 능력을 입증했습니다.

코딩 테스트의 종말 — AI 시대, 기업이 다시 '기초 역량'에 집착하는 이유

코딩 테스트의 종말 — AI 시대, 기업이 다시 '기초 역량'에 집착하는 이유

AI 코딩 도구의 보급으로 기존의 기술 면접 방식이 무력화되고 있다. 앤스로픽 등 주요 기업은 면접 내 AI 사용을 제한하며 기초 역량 검증으로 회귀 중이다. 도구적 숙련도보다 추론 능력과 설계 역량 중심의 라이브 테스트 비중이 확대된다.

10년 전 제온 서버, 최적화만으로 Gemma 4 '읽기 속도' 구현

10년 전 제온 서버, 최적화만으로 Gemma 4 '읽기 속도' 구현

LLM 추론의 핵심 병목은 연산 속도가 아니라 메모리 대역폭이다. 2016년형 제온 서버에서 ik_llama.cpp 최적화를 통해 Gemma 4 26B-A4B를 실행했다. 추측 디코딩과 MoE 캐시 최적화로 GPU 없이도 읽기 가능한 속도를 확보했다.

DeepGoogle SRE의 진화, AI 자율 운영 시대의 '안전 삼각축'

Google SRE의 진화, AI 자율 운영 시대의 '안전 삼각축'

AI 코딩 도구로 배포 속도가 4배 빨라지며 기존 수동 SRE 관행이 한계에 봉착했다. Google은 AI 에이전트의 자율성을 4단계로 구분하고 안전 가드레일을 구축했다. 운영자는 이제 코드 리뷰어가 아닌, AI의 안전 경계를 설계하는 아키텍트로

그래미 어워즈 CEO 하비 메이슨 주니어, 생성형 AI의 음악 산업 파급력과 시상식 대응 논의

그래미 어워즈 CEO 하비 메이슨 주니어, 생성형 AI의 음악 산업 파급력과 시상식 대응 논의

그래미 어워즈를 주관하는 레코딩 아카데미의 하비 메이슨 주니어 CEO가 생성형 AI가 음악 산업에 미치는 영향과 대응 방안을 논의했습니다. 기술이 창작의 영역을 빠르게 잠식하는 가운데, 시상식의 공정성과 인간 예술가의 가치를 지키기 위한 고민이 깊어

알파벳, AI 인프라 및 컴퓨팅 확장 위해 800억 달러 자본 조달 발표

알파벳, AI 인프라 및 컴퓨팅 확장 위해 800억 달러 자본 조달 발표

알파벳이 AI 인프라와 컴퓨팅 능력을 강화하기 위해 800억 달러 규모의 자본을 조달합니다. 거대 AI 모델 구동에 필수적인 하드웨어 투자를 대폭 확대할 계획입니다.

UltraCat, 팬 조절부터 잠자기 제어까지 맥북 유틸리티 통합 무료 앱 공개

UltraCat, 팬 조절부터 잠자기 제어까지 맥북 유틸리티 통합 무료 앱 공개

맥북의 상태 모니터링, 팬 속도 조절, 잠자기 제어 기능을 하나로 통합한 무료 앱 UltraCat이 공개되었습니다. TG Pro, 암페타민 등 개별적으로 사용하던 유료 유틸리티의 핵심 기능을 한 곳에서 사용할 수 있습니다.

1200억 파라미터 모델을 로컬로, 엔비디아 품은 서피스 랩탑 울트라

1200억 파라미터 모델을 로컬로, 엔비디아 품은 서피스 랩탑 울트라

고성능 노트북 시장은 그동안 애플의 맥북 프로가 독주해 왔다. 마이크로소프트가 엔비디아와 협력해 128GB 통합 메모리를 갖춘 '서피스 랩탑 울트라'를 공개했다. 1200억 개의 파라미터를 가진 AI 모델을 클라우드 없이 로컬에서 돌리는 압도적 성능을

2000억 달러 CPU 시장 정조준한 엔비디아의 'RTX Spark' 공개

2000억 달러 CPU 시장 정조준한 엔비디아의 'RTX Spark' 공개

AI PC 시장이 단순 챗봇 실행을 넘어 자율적인 에이전트 구동 단계로 진입한다. 엔비디아가 1페타플롭 성능의 'RTX Spark' CPU를 공개하며 2000억 달러 규모의 CPU 시장에 도전한다. 마이크로소프트, 델, HP 등 주요 제조사가 올가을부

코드 생성 금지, 스탠퍼드가 정의한 '가르치는 AI'의 기준

코드 생성 금지, 스탠퍼드가 정의한 '가르치는 AI'의 기준

AI 코딩 어시스턴트가 정답을 즉시 제공하며 학습자의 사고 과정을 대체하는 문제가 늘고 있다. 스탠퍼드 대학교 CS336 과정은 AI가 구현 대신 설명과 피드백만 제공하는 엄격한 가이드라인을 설정했다. 구체적인 디버깅 유도 질문과 프로파일링 데이터 요