KO EN

AX BRIEF

매일 한 편, AI 업계를 읽는 칼럼

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 98 pt2. Gemini 4 Argon (high) 95 pt3. Claude Opus 5.5 (max with fallback) 94 pt4. Claude Sonnet 5.5 (max with fallback) 93 pt5. GPT-6 Astra (max) 90 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Fable 5.1 XHigh + SWE-2 Medium 88 pt3. GPT-6.1 Sol (xhigh) 69 pt4. Claude Sonnet 5.5 (max) 63 pt5. Claude Opus 5.5 (max) 63 pt이미지1. gpt-image-2.5-sunburst 85 pt2. gpt-image-2.5-flare 81 pt3. gpt-image-2 (medium) 78 pt4. grok-imagine-image-2.0 (canvas) 70 pt5. mai-image-2.6 70 pt비디오1. gemini-omni-1.1-flash 85 pt2. gemini-omni-flash 84 pt3. flux-3-video 81 pt4. grok-imagine-video-1.5-agent 81 pt5. dreamina-seedance-2.0-720p 79 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Opus 5.5 (max with fallback) 39 pt4. Claude Sonnet 5.5 (max with fallback) 19 pt5. Gemini 4 Argon (high) 19 pt속도1. Claude Haiku 5.5 (max) 100 pt2. DeepSeek V4.1 Flash (max) 89 pt3. gpt-oss-120b (high) 73 pt4. Muse Spark 1.3 (max) 68 pt5. Inkling (xhigh) 57 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

경험이 해자가 아닌 세금으로 변하는 3주간의 기술적 격차

경험이 해자가 아닌 세금으로 변하는 3주간의 기술적 격차

AI 도입 결정권자와 실무자 간의 기술 이해도 격차가 심화되고 있다. 경험은 더 이상 경쟁 우위가 아닌 의사결정을 방해하는 세금으로 작용한다. 필터 없는 사고가 가능한 젊은 세대에게 AI는 강력한 자산이 된다.

tinygrad가 WebGPU로 구현한 브라우저 내 AI 학습 데모 공개

tinygrad가 WebGPU로 구현한 브라우저 내 AI 학습 데모 공개

tinygrad가 브라우저에서 직접 AI를 학습시키는 데모를 공개했다. PPO 알고리즘과 WebGPU 기술을 통해 별도 서버 없이 학습이 가능하다. AI 모델의 학습 환경이 서버 중심에서 클라이언트 중심으로 확장된다.

Cisco, AI 에이전트 83% 도입하지만 보안 준비는 29%뿐

Cisco, AI 에이전트 83% 도입하지만 보안 준비는 29%뿐

Cisco가 AI 에이전트의 신원 확인은 성공해도 세부 권한 제어가 안 되는 보안 결함을 경고했다. 기업의 83%가 에이전트 도입을 계획 중이지만 보안 준비가 된 곳은 29%에 불과한 것으로 나타났다. 신분증만 확인하고 마스터키를 넘겨주는 식의 권한

RecursiveMAS가 멀티 에이전트 추론 속도 2.4배 높이고 토큰 75% 줄였다

RecursiveMAS가 멀티 에이전트 추론 속도 2.4배 높이고 토큰 75% 줄였다

일리노이대와 스탠퍼드대 연구진이 RecursiveMAS 프레임워크를 개발했다. 에이전트 간 통신을 텍스트가 아닌 임베딩 공간에서 처리해 효율을 높였다. 추론 속도는 2.4배 빨라졌으며 토큰 사용량은 75% 감소했다.

SpaceXAI, 합병 후 핵심 연구원 50명 이상 이탈하며 인력 유출 가속

SpaceXAI, 합병 후 핵심 연구원 50명 이상 이탈하며 인력 유출 가속

SpaceX와 xAI가 합병한 2월 이후 핵심 인력 50명 이상이 회사를 떠났다. 메타와 Thinking Machine Labs 등 경쟁사들이 이탈한 인력을 대거 영입하고 있다. 모델 사전 학습 팀의 인력 감소로 인해 향후 모델 개발 역량에 의문이 제

Mitchellh가 지적한 기업들의 AI 사이코시스 현상

Mitchellh가 지적한 기업들의 AI 사이코시스 현상

Mitchellh가 기업들의 AI 사이코시스 상태를 주장했다. 실질적 효용 없는 AI 도입 경쟁을 비판했다. 기술 중심의 맹목적 투자가 리스크로 작용한다.

Fin Operator 출시, 주당 200만 건 처리하는 Fin 관리 전담

Fin Operator 출시, 주당 200만 건 처리하는 Fin 관리 전담

Fin(구 인터콤)이 AI 에이전트를 관리하는 AI 에이전트인 Fin Operator를 공개했다. 데이터 분석, 지식 관리, 디버깅 기능을 통해 백오피스 운영팀의 업무를 자동화한다. 모든 변경 사항은 인간의 승인을 거치는 제안 시스템 방식으로 작동한다

머스크-알트만 소송 종료와 SpaceX IPO 향한 창업자 생태계 이동

머스크-알트만 소송 종료와 SpaceX IPO 향한 창업자 생태계 이동

머스크와 알트만의 OpenAI 관련 소송이 이번 주 종료되었다. SpaceX의 기업 공개 준비와 함께 머스크 생태계의 창업자 배출이 가속화되고 있다. AI 통제권 논쟁을 넘어 머스크 중심의 기술 창업 네트워크가 새로운 지형을 형성하고 있다.

영국 정부의 소버린 AI 전략, 자체 LLM 추론 인프라 구축

영국 정부의 소버린 AI 전략, 자체 LLM 추론 인프라 구축

영국 정부가 국가 주권 확보를 위한 자체 LLM 추론 환경을 구축한다. 외부 클라우드 의존도를 낮추고 데이터 보안과 통제권을 강화하는 것이 핵심이다. 공공 부문 전용 인프라를 통해 AI 모델의 안정적인 운영을 도모한다.

NV Energy, 22GW 데이터센터 수요로 레이크 타호 전력 공급 종료

NV Energy, 22GW 데이터센터 수요로 레이크 타호 전력 공급 종료

NV Energy가 2027년 5월까지 레이크 타호 지역의 전력 공급 계약을 종료한다. 데이터센터의 전력 수요가 지역 피크 사용량의 40배인 22GW를 넘어섰다. 전력 우선순위가 AI 인프라로 이동하며 지역 전기 요금 상승이 예상된다.

Anthropic, 0%에서 5.7%로 진입하며 에이전트 제어권 경쟁 합류

Anthropic, 0%에서 5.7%로 진입하며 에이전트 제어권 경쟁 합류

Anthropic이 기업용 에이전트 오케스트레이션 시장에 처음으로 진입했다. 단순 모델 교체보다 인프라 수준의 런타임 점유가 더 강력한 락인 효과를 가진다. 보안과 권한 관리가 기업의 에이전트 플랫폼 선택의 핵심 기준으로 부상했다.

아마존 직원들, AI 사용량 할당량 채우려 가짜 업무 생성

아마존 직원들, AI 사용량 할당량 채우려 가짜 업무 생성

아마존 직원들이 AI 사용량 지표를 맞추기 위해 가짜 업무를 생성하고 있다. 성과 측정 기준이 결과물이 아닌 도구 사용 빈도로 옮겨갔기 때문이다. 이는 AI 도입의 실질적 효율성보다 수치적 성과에 치중한 결과다.

OpenAI, Plaid 연동해 12,000개 금융기관 데이터 통합한 금융 AI 출시

OpenAI, Plaid 연동해 12,000개 금융기관 데이터 통합한 금융 AI 출시

OpenAI가 미국 Pro 사용자를 대상으로 개인 금융 도구를 출시했다. Plaid를 통해 12,000개 이상의 금융기관 계좌를 연동할 수 있다. GPT-5.5 모델의 추론 능력을 활용해 지출 분석과 재무 계획을 제공한다.

Anima 20억 파라미터 모델, 합성 데이터 없이 애니메이션 구현

Anima 20억 파라미터 모델, 합성 데이터 없이 애니메이션 구현

CircleStone Labs가 20억 파라미터 규모의 Anima 모델을 공개했다. 합성 데이터 없이 순수 예술 이미지와 애니메이션 데이터만으로 학습했다. ComfyUI 환경에서 구동되며 특정 샘플러와 태그 전략으로 고품질 구현이 가능하다.

Cerebras, IPO 가격 2배 상승하며 시총 1,000억 달러 돌파

Cerebras, IPO 가격 2배 상승하며 시총 1,000억 달러 돌파

Cerebras가 나스닥 상장 첫날 시가총액 1,000억 달러를 돌파했다. WSE-3 칩은 엔비디아 B200 대비 메모리 대역폭이 2,625배 높다. 하드웨어 판매에서 클라우드 추론 서비스로 사업 모델을 전환했다.

Turso, LLM 생성 저질 PR 급증으로 1,000달러 버그 포상제 종료

Turso, LLM 생성 저질 PR 급증으로 1,000달러 버그 포상제 종료

Turso가 데이터 오염 버그에 지급하던 1,000달러 포상제를 종료했다. LLM을 이용해 무작위로 제출되는 저질 PR이 유지보수 인력을 마비시켰다. 자동화된 테스트 도구와 보상 체계 사이의 새로운 거버넌스 필요성이 제기되었다.

Claude로 30분 만에 만든 MDV.app, 네이티브 UI의 개인 맞춤형 전환

Claude로 30분 만에 만든 MDV.app, 네이티브 UI의 개인 맞춤형 전환

AI 에이전트가 SwiftUI 코드를 능숙하게 작성하며 네이티브 앱 제작 장벽이 낮아졌다. Claude를 통해 30분 만에 구현한 MDV.app은 개인의 불편을 즉각 해결하는 도구의 가능성을 보여준다. 소프트웨어의 가치가 완제품 배포에서 개인의 아이디

DeepSeek V4 출시, 0.30달러로 80% 이상의 SWE-bench 성능 구현

DeepSeek V4 출시, 0.30달러로 80% 이상의 SWE-bench 성능 구현

DeepSeek V4-Pro가 MIT 라이선스로 공개되었다. 출력 토큰 100만 개당 0.30달러라는 파격적인 가격을 제시했다. SWE-bench Verified에서 80.6%를 기록하며 폐쇄형 모델 수준의 성능을 보였다.

GGUF 단일 파일 포맷의 샘플러 체인 통합과 툴 호출 과제

GGUF 단일 파일 포맷의 샘플러 체인 통합과 툴 호출 과제

GGUF가 모델 가중치와 메타데이터를 단일 파일로 통합해 편의성을 높였다. 샘플러 설정 순서를 파일 내에 직접 명시하는 기능이 추가되어 수동 설정 번거로움이 사라졌다. 다만 툴 호출을 위한 표준 문법이 없어 여전히 모델별 하드코딩 방식에 의존한다.

Osaurus, 맥 전용 LLM 서버로 로컬-클라우드 모델 통합 및 11만 건 다운로드

Osaurus, 맥 전용 LLM 서버로 로컬-클라우드 모델 통합 및 11만 건 다운로드

Osaurus가 맥 전용 오픈소스 LLM 서버를 공개했다. 로컬 모델과 클라우드 AI를 통합하며 11만 회 이상의 다운로드를 기록했다. 64GB 이상의 램 환경에서 20여 개의 플러그인과 MCP 서버 기능을 제공한다.

머스크 vs OpenAI, 100억 달러 투자가 가른 비영리 미션의 향방

머스크 vs OpenAI, 100억 달러 투자가 가른 비영리 미션의 향방

엘론 머스크가 OpenAI를 상대로 제기한 소송의 배심원 심리가 진행 중이다. 핵심 쟁점은 100억 달러 규모의 마이크로소프트 투자가 비영리 설립 취지를 위반했는지 여부다. 판결 결과에 따라 OpenAI의 영리 기업 구조와 지배구조가 근본적으로 바뀔

Runway, 53억 달러 가치로 비디오 생성 넘어 월드 모델 도전

Runway, 53억 달러 가치로 비디오 생성 넘어 월드 모델 도전

Runway가 비디오 생성 모델 Gen-4.5를 넘어 월드 모델 개발에 집중하고 있다. 기업 가치는 53억 달러이며 2026년 2분기 연간 반복 매출 4,000만 달러를 추가했다. 텍스트 기반 지능을 넘어 물리 법칙을 학습하는 AI로 과학적 진보를 목

Claude for Legal 공개, Managed Agents API로 법률 전용 에이전트 구축

Claude for Legal 공개, Managed Agents API로 법률 전용 에이전트 구축

Anthropic이 법률 워크플로우 전용 에이전트와 커넥터를 공개했다. Managed Agents API를 통해 기업 자체 워크플로우 엔진에 배포 가능하다. 외부 리서치 도구 연결을 통해 인용문의 신뢰성을 검증하는 구조를 갖췄다.

내 하드웨어에 최적화된 로컬 LLM을 찾는 도구, WhichLLM

내 하드웨어에 최적화된 로컬 LLM을 찾는 도구, WhichLLM

WhichLLM은 사용자 하드웨어 사양을 분석해 최적의 로컬 LLM을 추천한다. 단순 파라미터 크기가 아닌 벤치마크 성능과 실제 구동 가능 여부를 종합한다. 명령어 한 줄로 모델 설치부터 대화 환경 구축까지 즉시 실행할 수 있다.

OpenAI와 Anthropic, 보안 모델 접근 제한하며 '폐쇄적 AI' 전환

OpenAI와 Anthropic, 보안 모델 접근 제한하며 '폐쇄적 AI' 전환

OpenAI와 Anthropic이 보안 특화 모델의 접근 권한을 일부 기업으로 제한했다. 미국 정부의 안보 개입과 모델 증류 기술 방지가 주요 원인으로 분석된다. AI 토큰이 무한히 공급될 것이라는 기존의 시장 낙관론이 무너지고 있다.

Claude Code, RAG 버리고 에이전틱 검색으로 대규모 코드베이스 공략

Claude Code, RAG 버리고 에이전틱 검색으로 대규모 코드베이스 공략

Anthropic이 대규모 코드베이스용 Claude Code 운용 패턴을 공개했다. RAG 대신 에이전틱 검색을 도입해 실시간 코드 반영 문제를 해결했다. CLAUDE.md와 훅 등 하네스 설정을 통해 모델 성능을 최적화한다.

온타리오 AI Scribe 20개 업체 감사 결과 약물 오류 60% 기록

온타리오 AI Scribe 20개 업체 감사 결과 약물 오류 60% 기록

온타리오주 감사원이 의료용 AI Scribe 시스템 20개를 조사했다. 조사 대상의 60%가 처방 약물 정보를 잘못 기록한 것으로 나타났다. 정확도보다 지역 업체 여부에 더 높은 가점을 준 평가 방식이 문제로 지적되었다.

시카고대 시험·학보까지 침투한 LLM, 성적 40%p 격차 발생

시카고대 시험·학보까지 침투한 LLM, 성적 40%p 격차 발생

시카고대학교 학생들이 시험과 과제에 LLM을 광범위하게 사용하고 있다. 재택 시험과 대면 시험의 성적 차이가 최대 40%포인트까지 벌어졌다. 대학 학보사 기사까지 AI가 작성하며 학문적 정체성이 훼손되고 있다.

20분 만에 완성하는 나만의 LLM 학습 실습 워크숍

20분 만에 완성하는 나만의 LLM 학습 실습 워크숍

10M 파라미터 규모의 GPT 모델을 처음부터 직접 학습한다. 노트북 환경에서 20분 내외로 학습을 완료할 수 있도록 설계했다. 토크나이저부터 학습 루프까지 전체 파이프라인을 직접 구현한다.

Claude Design 대체하려는 OpenDesign과 GPT-5.5의 완성도 격차

Claude Design 대체하려는 OpenDesign과 GPT-5.5의 완성도 격차

개발자 커뮤니티에서 Claude Design의 오픈소스 대체재를 찾는 움직임이 있다. OpenDesign에 GPT-5.5를 연결해 사용했지만 완성도가 낮다는 평가가 나왔다. AI 디자인 도구의 핵심인 일관성과 마감 처리에서 여전히 격차가 존재한다.