KO EN

AX BRIEF

매일 한 편, AI 업계를 읽는 칼럼

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 98 pt2. Gemini 4 Argon (high) 95 pt3. Claude Opus 5.5 (max with fallback) 94 pt4. Claude Sonnet 5.5 (max with fallback) 93 pt5. GPT-6 Astra (max) 90 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Fable 5.1 XHigh + SWE-2 Medium 88 pt3. GPT-6.1 Sol (xhigh) 69 pt4. Claude Sonnet 5.5 (max) 63 pt5. Claude Opus 5.5 (max) 63 pt이미지1. gpt-image-2.5-sunburst 85 pt2. gpt-image-2.5-flare 81 pt3. gpt-image-2 (medium) 78 pt4. grok-imagine-image-2.0 (canvas) 70 pt5. mai-image-2.6 70 pt비디오1. gemini-omni-1.1-flash 85 pt2. gemini-omni-flash 84 pt3. flux-3-video 81 pt4. grok-imagine-video-1.5-agent 81 pt5. dreamina-seedance-2.0-720p 79 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Opus 5.5 (max with fallback) 39 pt4. Claude Sonnet 5.5 (max with fallback) 19 pt5. Gemini 4 Argon (high) 19 pt속도1. Claude Haiku 5.5 (max) 100 pt2. DeepSeek V4.1 Flash (max) 89 pt3. gpt-oss-120b (high) 73 pt4. Muse Spark 1.3 (max) 68 pt5. Inkling (xhigh) 57 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

젠슨 황 Nvidia CEO, AI가 일자리 파괴 아닌 재산업화 이끈다 주장

젠슨 황 Nvidia CEO, AI가 일자리 파괴 아닌 재산업화 이끈다 주장

젠슨 황 Nvidia CEO가 AI가 대규모 일자리를 창출할 것이라고 밝혔다. 그는 특정 작업의 자동화가 전체 직업의 소멸을 의미하지 않는다고 설명했다. 일부 기관은 향후 수년간 미국 일자리의 15%가 사라질 것으로 전망했다.

신경망과 암호 알고리즘이 동일한 구조로 수렴하는 이유

신경망과 암호 알고리즘이 동일한 구조로 수렴하는 이유

신경망과 암호 알고리즘은 반복적인 혼합 계층 구조를 공유한다. 두 분야 모두 하드웨어 성능 최적화를 위해 병렬 처리를 극대화한다. 복잡한 혼합과 단순한 제약 조건이 설계의 유사성을 이끌어낸다.

OpenAI와 Google이 지지하는 LIFT AI 법안, K-12 교육과정 개편 추진

OpenAI와 Google이 지지하는 LIFT AI 법안, K-12 교육과정 개편 추진

미국 의회가 K-12 교육과정에 인공지능 소양 교육을 의무화하는 LIFT AI 법안을 발의했다. OpenAI와 Google, Microsoft가 해당 법안을 공식적으로 지지하며 협력에 나섰다. 국립과학재단이 교육과정 개발과 교사 연수를 위한 연구 보조

Cerebras IPO 추진, 2800만 주 발행으로 35억 달러 조달 목표

Cerebras IPO 추진, 2800만 주 발행으로 35억 달러 조달 목표

Cerebras가 주당 115~125달러로 2800만 주를 발행하는 IPO를 준비한다. 이번 상장으로 최대 266억 달러의 기업 가치를 인정받을 전망이다. OpenAI는 Cerebras의 주요 고객이자 10억 달러 규모의 대출을 제공한 파트너다.

Microsoft, Agent 365 정식 출시와 Shadow AI 관리 본격화

Microsoft, Agent 365 정식 출시와 Shadow AI 관리 본격화

Microsoft가 AI 에이전트 통합 관리 플랫폼인 Agent 365를 정식 출시했다. 기업 내 허가받지 않은 로컬 AI 에이전트를 탐지하는 Shadow AI 관리 기능을 제공한다. 사용자당 월 15달러의 구독료로 기업 내 모든 AI 에이전트의 거버

이미지 생성 모델, 챗봇 업데이트보다 6.5배 높은 앱 다운로드 유도

이미지 생성 모델, 챗봇 업데이트보다 6.5배 높은 앱 다운로드 유도

이미지 생성 모델 출시가 텍스트 기반 챗봇 업데이트보다 6.5배 많은 앱 다운로드를 유발한다. OpenAI의 GPT-4o 이미지 모델은 출시 후 28일간 7천만 달러의 매출을 기록했다. 단순 다운로드 증가가 반드시 수익으로 직결되지는 않으며 모델별 편

1931년 이전 데이터만 학습해 100년 전 말투를 재현한 AI의 정체

1931년 이전 데이터만 학습해 100년 전 말투를 재현한 AI의 정체

1931년 이전의 영어 텍스트만 학습한 빈티지 언어 모델이 공개되었다. 130억 개의 파라미터를 통해 100년 전의 말투와 지식을 정밀하게 재현한다. 역사적 고증이 필요한 콘텐츠 제작이나 언어 연구에 핵심적인 도구가 된다.

OpenAI가 공개한 일론 머스크의 협박성 메시지와 소송의 실체

OpenAI가 공개한 일론 머스크의 협박성 메시지와 소송의 실체

OpenAI가 일론 머스크가 보낸 협박성 문자 메시지를 법원에 제출했다. 일론 머스크는 소송 취하를 조건으로 OpenAI 경영진을 압박했다. 법원은 해당 메시지를 증거로 채택하지 않기로 최종 결정했다.

Anthropic과 OpenAI, 기업용 AI 서비스 위한 1.5조 원 규모 합작사 설립

Anthropic과 OpenAI, 기업용 AI 서비스 위한 1.5조 원 규모 합작사 설립

Anthropic이 Blackstone 등과 협력해 기업용 AI 서비스 합작사를 설립한다. OpenAI 또한 100억 달러 가치의 별도 법인인 The Development Company를 준비 중이다. 두 기업은 전진 배치 엔지니어를 통해 기업 현장에

장기 실행 에이전트, 며칠간 자율 작업하는 시스템의 설계

장기 실행 에이전트, 며칠간 자율 작업하는 시스템의 설계

AI 에이전트가 수일간 자율 실행되는 새로운 패러다임이 등장했다. Anthropic과 Google 등은 뇌와 실행 환경을 분리하는 아키텍처로 수렴 중이다. 이제 에이전트의 생산성은 모델 자체가 아닌 세션 관리와 상태 유지에 달렸다.

NVIDIA Nemotron 3 Nano Omni, RTX 5090에서 310억 파라미터 구동

NVIDIA Nemotron 3 Nano Omni, RTX 5090에서 310억 파라미터 구동

NVIDIA가 310억 파라미터 규모의 멀티모달 모델을 공개했다. RTX 5090 한 장으로 로컬 환경에서 모델 구동이 가능하다. 전문가 혼합 방식을 통해 활성화 파라미터를 30억 개로 최적화했다.

TUI의 귀환, GUI 파편화가 만든 개발 효율의 틈새

TUI의 귀환, GUI 파편화가 만든 개발 효율의 틈새

TUI(텍스트 기반 사용자 인터페이스)가 다시 주목받고 있다. 윈도우와 맥의 네이티브 GUI 전략이 일관성을 잃었기 때문이다. 일렉트론 기반 앱의 한계가 개발자를 다시 터미널로 이끌고 있다.

AI 코드 생성 시대, 판단력 소유 여부가 엔지니어의 가치를 결정한다

AI 코드 생성 시대, 판단력 소유 여부가 엔지니어의 가치를 결정한다

AI가 생성한 결과물에 의존해 사고를 외주화하면 엔지니어의 판단력이 약해진다. 기계적 작업은 AI에 맡기되 문제 정의와 트레이드오프 결정은 직접 수행해야 한다. 조직 리더는 겉보기 유창함이 아닌 실제 추론 능력과 기술적 깊이를 평가해야 한다.

OpenAI o1 모델, 응급실 진단 정확도 67%로 의사 앞질러

OpenAI o1 모델, 응급실 진단 정확도 67%로 의사 앞질러

OpenAI의 o1 모델이 응급실 환자 진단에서 의사보다 높은 정확도를 기록했다. 제한된 정보 속에서 빠른 판단이 필요한 상황에서 AI의 강점이 두드러졌다. 연구진은 AI가 의사를 대체하기보다 진료를 보조하는 새로운 모델이 될 것으로 보았다.

DeepSeek V4 출시, 1.6T 파라미터와 압도적 가성비로 시장 공략

DeepSeek V4 출시, 1.6T 파라미터와 압도적 가성비로 시장 공략

DeepSeek가 100만 토큰 컨텍스트를 지원하는 V4 모델 시리즈를 공개했다. Pro 모델은 1.6조 개의 파라미터로 현존 최대 규모의 오픈 웨이트 모델이 되었다. 효율성 개선을 통해 기존 모델 대비 연산량과 KV 캐시 점유율을 획기적으로 낮췄다.

YAML 기반 명세서 작성이 AI 환각을 제어하는 방식

YAML 기반 명세서 작성이 AI 환각을 제어하는 방식

AI 모델이 복잡한 지시사항을 처리할 때 발생하는 환각 현상을 분석했다. YAML 형식으로 명세서를 작성하면 모델의 추론 오류를 줄일 수 있다. 구조화된 데이터 입력이 모델의 출력 일관성을 높이는 핵심이다.

Mac mini M4 Pro 기반 macOS 가상화 성능과 최소 사양 검증

Mac mini M4 Pro 기반 macOS 가상화 성능과 최소 사양 검증

Mac mini M4 Pro에서 macOS 26.4.1 가상 머신 성능을 측정했다. 단일 코어와 GPU 성능은 호스트의 95% 이상 수준을 기록했다. 가벼운 작업은 2개 코어와 4GB 메모리만으로도 충분히 구동된다.

Mistral Medium 3.5 128B 출시, 추론 강도 조절로 코딩 에이전트 성능 극대화

Mistral Medium 3.5 128B 출시, 추론 강도 조절로 코딩 에이전트 성능 극대화

Mistral AI가 128B 파라미터의 통합 플래그십 모델인 Mistral Medium 3.5를 공개했다. 사용자는 reasoning_effort 설정을 통해 작업 난이도에 따라 추론 강도를 직접 조절할 수 있다. SWE-Bench Verified에

Context Mode, AI 코딩 에이전트 컨텍스트 98% 절약

Context Mode, AI 코딩 에이전트 컨텍스트 98% 절약

Context Mode가 MCP 서버를 통해 AI 코딩 에이전트의 컨텍스트 사용량을 98% 절약한다. SQLite와 FTS5를 활용해 세션 지속 시간을 기존 30분에서 3시간으로 연장한다. Claude Code를 포함한 14개 플랫폼에서 로컬 환경으로

아카데미, AI 배우 및 시나리오 후보 자격 박탈

아카데미, AI 배우 및 시나리오 후보 자격 박탈

아카데미 시상식이 AI 생성 배우와 시나리오의 후보 자격을 박탈했다. 인간의 직접 수행과 명시적 동의를 증명해야 하는 엄격한 기준을 세웠다. 기술적 효율보다 인간 창작물의 배타적 지위를 보호하는 방향으로 규정을 바꿨다.

AI 채용 알고리즘의 자기 선호 편향과 데이터 피드백 루프의 실체

AI 채용 알고리즘의 자기 선호 편향과 데이터 피드백 루프의 실체

AI 채용 도구가 특정 패턴의 후보자만 반복 선택하는 자기 선호 편향이 확인되었다. 기존의 인구통계학적 편향을 넘어 학습 데이터의 특성을 복제하는 양상이 관찰된다. 채용 파이프라인의 다양성을 확보하기 위해 알고리즘 감사 체계 도입이 필요하다.

k-sajja-agents, 전문직 업무 프로세스를 AI 스킬로 공개해 수임 연결

k-sajja-agents, 전문직 업무 프로세스를 AI 스킬로 공개해 수임 연결

전문직의 실무 지식을 AI 스킬 형태로 모아둔 k-sajja-agents 저장소가 공개됐다. 전문가가 자신의 업무 방식을 오픈소스로 구축해 AI 에이전트에 연결하는 구조다. AI가 기초 작업을 처리하고 최종 단계에서 실제 전문가 상담으로 유도하는 모델

VS Code, Copilot을 Git 공동 작성자로 자동 등록

VS Code, Copilot을 Git 공동 작성자로 자동 등록

VS Code가 Copilot의 Git 공동 작성 기능을 기본 활성화했다. 설정에서 AI 기여 범위를 세 가지 단계로 조절할 수 있다. AI가 생성한 코드의 출처를 명확히 기록하는 체계가 도입됐다.

AI 코딩의 함정, 실행 가능한 코드와 제품 감각의 괴리

AI 코딩의 함정, 실행 가능한 코드와 제품 감각의 괴리

AI가 생성한 코드는 실행 가능하지만 제품 완성도는 낮다. RLVR 학습 구조가 코드 실행 성공에만 보상을 집중한다. 인간의 제품 감각과 상식 보완이 여전히 필수적인 영역이다.

spawn-agent, 로컬 코딩 에이전트를 Vercel AI SDK로 통합

spawn-agent, 로컬 코딩 에이전트를 Vercel AI SDK로 통합

spawn-agent가 로컬 코딩 에이전트를 Vercel AI SDK 모델로 변환한다. ACP 표준을 준수하여 다양한 CLI 도구와 일관된 통신을 지원한다. 권한 관리와 프로세스 워치독 등 실무 운영 정책을 내장했다.

Gemini, 프롬프트 하나로 구글 문서·시트·프레젠테이션 초안 생성

Gemini, 프롬프트 하나로 구글 문서·시트·프레젠테이션 초안 생성

Google이 Gemini 앱에서 문서와 시트, 프레젠테이션을 직접 생성하는 기능을 발표했다. 사용자는 프롬프트 입력만으로 초안을 만들고 구글 드라이브에 바로 저장할 수 있다. 문서 요약과 데이터 분석 등 반복적인 사무 작업의 자동화를 목표로 한다.

인텔 오토라운드, LLM 2비트 양자화 정확도 97.9% 유지

인텔 오토라운드, LLM 2비트 양자화 정확도 97.9% 유지

인텔이 오픈소스 양자화 도구 오토라운드의 업데이트를 공개했다. 2비트 수준에서도 모델 정확도를 97.9%까지 보존한다. vLLM, SGLang, 트랜스포머스 등 주요 추론 엔진과 통합을 마쳤다.

Spotify, '인증' 배지로 AI 음악과 인간 아티스트 구분한다

Spotify, '인증' 배지로 AI 음악과 인간 아티스트 구분한다

Spotify가 인간 아티스트를 식별하는 '인증' 배지를 도입한다. 소셜 계정 연결과 공연 일정 등 실제 활동 증거가 인증 기준이 된다. 음악 자체가 아닌 아티스트의 정체성만 인증한다는 한계가 지적된다.

캘리포니아 데이터센터 물 사용량, 전체의 0.05% 수준에 불과하다

캘리포니아 데이터센터 물 사용량, 전체의 0.05% 수준에 불과하다

AI 데이터센터의 물 사용량이 과도하게 부풀려져 있다는 연구 결과가 나왔다. 캘리포니아 전체 인간 물 사용량 중 AI가 차지하는 비중은 0.05% 수준이다. 데이터센터의 수자원 소비는 농업 등 타 산업 대비 경제적 효율성이 높다.

Salesforce Agentforce Operations, AI 에이전트를 위한 결정론적 워크플로우 제어 평면 도입

Salesforce Agentforce Operations, AI 에이전트를 위한 결정론적 워크플로우 제어 평면 도입

Salesforce가 Agentforce Operations를 출시했다. 인간 중심의 모호한 업무 흐름을 AI 에이전트용 결정론적 구조로 변환한다. 추론 능력보다 워크플로우의 일관성이 기업용 AI의 핵심 병목으로 정의되었다.