KO EN

AX BRIEF

매일 한 편, AI 업계를 읽는 칼럼

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 98 pt2. Gemini 4 Argon (high) 95 pt3. Claude Opus 5.5 (max with fallback) 94 pt4. Claude Sonnet 5.5 (max with fallback) 93 pt5. GPT-6 Astra (max) 90 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Fable 5.1 XHigh + SWE-2 Medium 88 pt3. GPT-6.1 Sol (xhigh) 69 pt4. Claude Sonnet 5.5 (max) 63 pt5. Claude Opus 5.5 (max) 63 pt이미지1. gpt-image-2.5-sunburst 85 pt2. gpt-image-2.5-flare 81 pt3. gpt-image-2 (medium) 78 pt4. grok-imagine-image-2.0 (canvas) 70 pt5. mai-image-2.6 70 pt비디오1. gemini-omni-1.1-flash 85 pt2. gemini-omni-flash 84 pt3. flux-3-video 81 pt4. grok-imagine-video-1.5-agent 81 pt5. dreamina-seedance-2.0-720p 79 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Opus 5.5 (max with fallback) 39 pt4. Claude Sonnet 5.5 (max with fallback) 19 pt5. Gemini 4 Argon (high) 19 pt속도1. Claude Haiku 5.5 (max) 100 pt2. DeepSeek V4.1 Flash (max) 89 pt3. gpt-oss-120b (high) 74 pt4. Inkling (xhigh) 59 pt5. Muse Spark 1.3 (max) 58 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

Mistral Medium 3.5 출시와 클라우드 기반 코딩 에이전트의 등장

Mistral Medium 3.5 출시와 클라우드 기반 코딩 에이전트의 등장

Mistral이 128B 파라미터의 신규 모델 Mistral Medium 3.5를 공개했다. 클라우드에서 독립적으로 실행되는 코딩 에이전트와 워크 모드를 지원한다. API 가격은 입력 100만 토큰당 1.5달러, 출력 100만 토큰당 7.5달러다.

IBM, AI 코딩 플랫폼 Bob 출시: 4단계 구독 모델과 Bobcoin 도입

IBM, AI 코딩 플랫폼 Bob 출시: 4단계 구독 모델과 Bobcoin 도입

IBM이 기업용 AI 소프트웨어 개발 플랫폼 Bob을 전 세계에 출시했다. 사용자는 Bobcoin이라는 자체 크레딧을 통해 코드 생성과 작업을 수행한다. 인간의 검토 과정을 필수 단계로 포함해 보안과 신뢰성을 강화했다.

Google TV, Gemini 탑재로 거실 스크린 생성형 AI 거점화

Google TV, Gemini 탑재로 거실 스크린 생성형 AI 거점화

Google이 Google TV에 Gemini 기반 생성형 AI 기능을 도입한다. 사용자는 음성 명령으로 이미지를 생성하고 영상을 제작할 수 있다. 홈 화면에 YouTube Shorts 피드를 추가해 콘텐츠 접근성을 높인다.

AI 탄수화물 계산의 치명적 오류, 인슐린 투여량 42단위 오차 발생

AI 탄수화물 계산의 치명적 오류, 인슐린 투여량 42단위 오차 발생

주요 AI 모델 4종을 대상으로 음식 사진 탄수화물 추정치를 2만 7천 회 테스트했다. 동일한 사진과 프롬프트에도 모델별로 결과값이 크게 달라 임상적 위험이 확인되었다. 모델이 제공하는 신뢰도 점수는 실제 정확도와 상관관계가 없어 신뢰할 수 없다.

Claude.ai 서비스 중단 및 API 오류 급증 발생

Claude.ai 서비스 중단 및 API 오류 급증 발생

Anthropic의 Claude.ai 서비스가 일시적으로 중단되었다. API 호출 시 오류 발생 빈도가 급격히 높아졌다. 개발자 커뮤니티에서 서비스 불안정성에 대한 논의가 확산되고 있다.

Firestorm Labs, 8,200만 달러 투자로 xCell 전방 배치 가속화

Firestorm Labs, 8,200만 달러 투자로 xCell 전방 배치 가속화

Firestorm Labs가 8,200만 달러의 시리즈 B 투자를 유치했다. 컨테이너형 제조 플랫폼 xCell을 통해 24시간 내 드론 생산이 가능하다. 미 공군과 육군에 배치되어 전방 보급 문제를 해결하고 있다.

Xiaomi MiMo-V2.5 공개, 1M 토큰 지원하는 옴니모델

Xiaomi MiMo-V2.5 공개, 1M 토큰 지원하는 옴니모델

Xiaomi가 텍스트와 멀티모달을 통합 처리하는 MiMo-V2.5를 공개했다. Sparse MoE 구조를 채택해 310B 모델임에도 15B만 활성화하여 효율을 높였다. MIT 라이선스를 적용하여 상용 배포와 파인튜닝이 자유롭다.

YC가 지목한 2026년의 기회: AI 네이티브로 재편될 15개 산업

YC가 지목한 2026년의 기회: AI 네이티브로 재편될 15개 산업

Y Combinator가 AI 기반의 물리적·디지털 산업 재구축 아이디어 15개를 공개했다. 레거시 소프트웨어와 공급망의 비효율을 AI 에이전트로 해결하는 기업이 차세대 주자가 된다. 대기업과의 초기 계약이 가능해지며 스타트업의 성장 방정식이 완전히

Chrome 138 Prompt API 공개, Gemini Nano로 서버 없는 AI 추론 구현

Chrome 138 Prompt API 공개, Gemini Nano로 서버 없는 AI 추론 구현

Google이 Chrome 138에서 Gemini Nano를 사용하는 Prompt API를 공개했다. 서버 통신 없이 브라우저 내에서 텍스트, 이미지, 오디오 추론이 가능하다. JSON 스키마 제한과 세션 관리 기능을 통해 정교한 AI 제어가 가능하다

GitHub Copilot의 유료화 전환과 AI 서비스의 경제적 현실

GitHub Copilot의 유료화 전환과 AI 서비스의 경제적 현실

GitHub Copilot이 2026년 6월부터 사용량 기반 과금제로 전환한다. 기존의 고정 구독료 모델은 AI 추론 비용을 감당하기에 불가능했다. 사용자는 이제 실제 소비한 토큰만큼 비용을 지불해야 하는 상황이다.

AI 성향 분석 도구 AIType, 16개 문항으로 모델 매칭

AI 성향 분석 도구 AIType, 16개 문항으로 모델 매칭

개발자가 직접 16개 문항 기반의 AI 성향 분석 도구 AIType을 공개했다. 사용자는 설문을 통해 9개 주요 AI 모델 중 자신과 맞는 모델을 찾는다. 별도의 회원가입이나 결제 없이 누구나 즉시 테스트에 참여할 수 있다.

로컬 환경에서 구동하는 AI 에이전트 시뮬레이터 mirollama

로컬 환경에서 구동하는 AI 에이전트 시뮬레이터 mirollama

mirollama는 로컬 LLM 기반의 다중 에이전트 시뮬레이션 도구다. 민감한 문서를 외부 서버 전송 없이 내부에서 분석하고 실험한다. Flask와 Vue 3를 기반으로 하며 Docker Compose로 배포를 지원한다.

Tools For Humanity, 브루노 마스 파트너십 허위 발표로 정체성 검증 신뢰도 타격

Tools For Humanity, 브루노 마스 파트너십 허위 발표로 정체성 검증 신뢰도 타격

Tools For Humanity가 브루노 마스와의 파트너십을 허위로 발표했다. 브루노 마스 측과 라이브 네이션은 협의 사실이 없다고 공식 부인했다. 정체성 검증 전문 기업이 아티스트 신원을 오인하며 브랜드 신뢰도에 타격을 입었다.

Poolside, 33B 파라미터 Laguna XS.2 공개... 로컬 코딩 에이전트 시대 연다

Poolside, 33B 파라미터 Laguna XS.2 공개... 로컬 코딩 에이전트 시대 연다

Poolside가 오픈 소스 코딩 모델 Laguna XS.2를 공개했다. 330억 개의 파라미터를 가진 MoE 구조로 단일 GPU에서 로컬 실행이 가능하다. 30조 개의 토큰과 Muon 최적화 기술을 통해 처음부터 직접 학습시켰다.

Google, 미 국방부와 AI 모델 사용에 관한 기밀 계약 체결

Google, 미 국방부와 AI 모델 사용에 관한 기밀 계약 체결

Google이 미 국방부와 AI 모델 사용에 관한 기밀 계약을 체결했다. 해당 계약은 합법적인 정부 목적이라면 AI 모델의 사용을 허용한다. Google은 국방부의 운영 결정에 대해 거부권을 행사할 권한이 없다.

Anthropic, 오픈소스 3D 툴 Blender 개발 펀드 후원 합류

Anthropic, 오픈소스 3D 툴 Blender 개발 펀드 후원 합류

Anthropic이 오픈소스 3D 소프트웨어 Blender의 개발 펀드 후원자로 합류했다. 이번 지원은 Blender 파이썬 API 등 핵심 기능의 지속적인 개선에 집중된다. Blender 재단은 이번 후원을 통해 독립적인 도구 개발 기조를 유지할 계

Amazon, 상품 페이지에 실시간 음성 대화형 AI 도입

Amazon, 상품 페이지에 실시간 음성 대화형 AI 도입

Amazon이 상품 페이지에서 질문에 음성으로 답하는 AI 기능을 출시했다. 사용자는 제품 상세 정보와 리뷰를 기반으로 실시간 대화를 나눌 수 있다. 이번 기능은 기존의 요약 서비스인 Hear the highlights와 연동된다.

Lovable, iOS·안드로이드 출시로 바이브 코딩 지형 확장

Lovable, iOS·안드로이드 출시로 바이브 코딩 지형 확장

Lovable이 iOS와 안드로이드용 노코드 AI 앱 빌더를 출시했다. 음성과 텍스트 프롬프트로 모바일에서 즉시 앱 빌드가 가능하다. 애플의 보안 정책에 따라 생성물은 웹 브라우저에서 실행된다.

NeoSQL, ERD와 SQL 에디터 통합하고 AI MCP 서버 내장했다

NeoSQL, ERD와 SQL 에디터 통합하고 AI MCP 서버 내장했다

NeoSQL이 DB 설계와 쿼리 실행, 코드 생성을 통합한 워크벤치를 공개했다. AI가 DB를 직접 수정하지 않고 사용자가 검토 후 승인하는 제어 방식을 도입했다. MCP 표준을 지원해 Claude나 Cursor 같은 AI 도구와 안전하게 연동된다.

Mistral AI, Temporal 기반 Workflows로 기업용 AI 자동화 구현

Mistral AI, Temporal 기반 Workflows로 기업용 AI 자동화 구현

Mistral AI가 기업용 AI 오케스트레이션 도구인 Workflows를 공개했다. Temporal의 내구성 실행 엔진을 통해 복잡한 AI 업무의 안정성을 확보했다. 드래그 앤 드롭 방식 대신 파이썬 코딩 기반의 개발자 중심 설계를 채택했다.

Utilyze, Compute와 Memory SOL %로 GPU 병목 실시간 포착

Utilyze, Compute와 Memory SOL %로 GPU 병목 실시간 포착

Utilyze가 오픈소스 GPU 모니터링 도구로 공개되었다. Compute와 Memory SOL 지표를 통해 실시간 병목 지점을 찾아낸다. Nsight Perf SDK를 활용해 오버헤드 없이 운영 환경에서 작동한다.

LAO, 채팅 기반 AI 개발의 한계를 설계서로 해결하는 macOS 앱 공개

LAO, 채팅 기반 AI 개발의 한계를 설계서로 해결하는 macOS 앱 공개

LAO가 아이디어를 AI용 설계서로 변환하는 macOS 앱을 공개했다. 아이디어 탐색부터 API 설계까지 구조화된 결과물을 생성한다. 채팅 맥락 소실 문제를 해결해 AI 개발의 수정 반복을 줄인다.

Microsoft VibeVoice, 7.5Hz 토크나이저로 음성 AI 효율 극대화

Microsoft VibeVoice, 7.5Hz 토크나이저로 음성 AI 효율 극대화

Microsoft가 TTS와 ASR을 통합한 오픈소스 음성 AI 모델 VibeVoice를 공개했다. 7.5Hz 초저 프레임 레이트 기술을 적용해 연산 효율과 오디오 품질을 동시에 확보했다. 실시간 처리가 가능한 0.5B 모델부터 7B 모델까지 다양한

모델보다 중요한 하네스 엔지니어링, AI 성능의 실체

모델보다 중요한 하네스 엔지니어링, AI 성능의 실체

AI 모델의 성능은 모델 자체보다 이를 둘러싼 하네스 설계에 의해 결정된다. 하네스는 모델이 도구를 사용하고 실수를 방지하며 작업을 완수하게 돕는 시스템이다. 성공적인 AI 에이전트 구축은 실패를 규칙으로 만드는 반복적인 공학 과정이다.

HTML로 영상 만드는 HyperFrames, Remotion과 무엇이 다른가

HTML로 영상 만드는 HyperFrames, Remotion과 무엇이 다른가

HyperFrames는 HTML과 CSS만으로 영상을 제작하는 오픈소스 프레임워크다. AI 코딩 에이전트가 직접 HTML을 작성해 영상을 생성하도록 설계되었다. Remotion과 달리 Apache 2.0 라이선스를 채택해 상업적 이용이 자유롭다.

NVIDIA, 한국 인구 통계 반영한 100만 건 합성 페르소나 공개

NVIDIA, 한국 인구 통계 반영한 100만 건 합성 페르소나 공개

NVIDIA가 대한민국 공공 데이터를 기반으로 100만 건의 합성 페르소나 데이터셋을 공개했다. 기존 LLM의 한국 문화 왜곡 문제를 해결하고 소버린 AI의 편향성을 완화하는 데 목적이 있다. Python datasets 라이브러리를 통해 누구나 상업

Remotion, AI 에이전트 결합으로 코드 기반 영상 제작 지원

Remotion, AI 에이전트 결합으로 코드 기반 영상 제작 지원

Remotion이 AI 에이전트와 연동되어 코드 자동 생성을 지원한다. 자연어 프롬프트로 TypeScript 기반의 고화질 영상을 제작할 수 있다. 개인 및 3인 이하 소규모 팀은 상용 서비스로 무료 사용이 가능하다.

OpenAI Privacy Filter 공개, PII 마스킹 F1 97.43% 달성

OpenAI Privacy Filter 공개, PII 마스킹 F1 97.43% 달성

OpenAI가 개인식별정보 탐지 및 마스킹 모델인 Privacy Filter를 공개했다. 로컬 실행이 가능하며 벤치마크에서 최대 97.43%의 F1 점수를 기록했다. Apache 2.0 라이선스로 Hugging Face와 GitHub에 오픈웨이트로 배

Athena로 본 2026 지방선거, AI 투표 시뮬레이션의 한계

Athena로 본 2026 지방선거, AI 투표 시뮬레이션의 한계

AI 모델 Athena를 활용해 2026년 지방선거 시뮬레이션을 진행했다. 5,100명의 가상 유권자가 4,800표를 행사하며 투표 패턴을 분석했다. LLM 기반 시뮬레이션은 실제 여론조사를 대체하기 어렵다는 결론이 나왔다.

13B 파라미터 규모의 빈티지 언어 모델 Talkie 공개

13B 파라미터 규모의 빈티지 언어 모델 Talkie 공개

1930년대 스타일을 재현한 13B 규모의 Talkie 모델이 공개되었다. 해당 모델은 과거의 언어적 특징과 문체 데이터를 학습하여 구축되었다. 사용자는 허깅페이스를 통해 모델 가중치와 관련 코드를 내려받을 수 있다.