KO EN

AX BRIEF

매일 한 편, AI 업계를 읽는 칼럼

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 98 pt2. Gemini 4 Argon (high) 95 pt3. Claude Opus 5.5 (max with fallback) 94 pt4. Claude Sonnet 5.5 (max with fallback) 93 pt5. GPT-6 Astra (max) 90 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Fable 5.1 XHigh + SWE-2 Medium 88 pt3. GPT-6.1 Sol (xhigh) 69 pt4. Claude Sonnet 5.5 (max) 63 pt5. Claude Opus 5.5 (max) 63 pt이미지1. gpt-image-2.5-sunburst 85 pt2. gpt-image-2.5-flare 81 pt3. gpt-image-2 (medium) 78 pt4. grok-imagine-image-2.0 (canvas) 70 pt5. mai-image-2.6 70 pt비디오1. gemini-omni-1.1-flash 85 pt2. gemini-omni-flash 84 pt3. flux-3-video 81 pt4. grok-imagine-video-1.5-agent 81 pt5. dreamina-seedance-2.0-720p 79 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Opus 5.5 (max with fallback) 39 pt4. Claude Sonnet 5.5 (max with fallback) 19 pt5. Gemini 4 Argon (high) 19 pt속도1. Claude Haiku 5.5 (max) 100 pt2. DeepSeek V4.1 Flash (max) 90 pt3. Muse Spark 1.3 (max) 78 pt4. gpt-oss-120b (high) 68 pt5. Inkling (xhigh) 55 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

"반복되는 환각과 이모지에 지쳤다" LLM 번아웃의 실체

"반복되는 환각과 이모지에 지쳤다" LLM 번아웃의 실체

AI 도구는 이제 개발자의 일상적인 업무 환경으로 완전히 자리 잡았다. 설계와 작성이 아닌 LLM 결과물을 검토하고 수정하는 방식으로 업무 프로세스가 변화했다. 하지만 반복되는 환각과 정형화된 문체 패턴이 실무자에게 'LLM 번아웃'이라는 새로운 피로

Kokoro, 82M 파라미터 모델로 CPU 기반 로컬 TTS 환경 지원

Kokoro, 82M 파라미터 모델로 CPU 기반 로컬 TTS 환경 지원

로컬 CPU에서 고품질 음성을 생성하는 TTS 모델 Kokoro가 공개됐다. 82M 파라미터 규모로 OpenAI speech API와 호환되며, AMD Ryzen 7 8745HS 기준 1.5초의 합성 속도를 기록했다. GPU 자원을 LLM 추론에 집중

말 끊어도 자연스러운 GPT-Live-1, OpenAI가 그리는 '음성 컴퓨팅' 시대

말 끊어도 자연스러운 GPT-Live-1, OpenAI가 그리는 '음성 컴퓨팅' 시대

ChatGPT와 대화할 때 발생하는 부자연스러운 끊김은 흔한 경험이다. OpenAI가 말하고 듣기를 동시에 수행하는 GPT-Live-1과 mini 모델을 출시했다. GPT-5.5와 연동해 복잡한 추론과 시각적 응답까지 수행하는 구조다.

SpaceX, 코딩·에이전트 특화 모델 'Grok 4.5' 공개... API 비용 50% 낮췄다

SpaceX, 코딩·에이전트 특화 모델 'Grok 4.5' 공개... API 비용 50% 낮췄다

SpaceX가 코딩과 자율 에이전트 작업에 최적화된 AI 모델 Grok 4.5를 출시했다. 입력 토큰 100만 개당 2달러, 출력 6달러의 가격 정책과 Colossus 슈퍼컴퓨터 인프라를 투입했다. 개발자는 벤치마크의 절대적 순위보다 작업당 완료 비용

구글 포토, 제미나이 옴니 기반 '비디오 리믹스' 기능 공개

구글 포토, 제미나이 옴니 기반 '비디오 리믹스' 기능 공개

구글이 제미나이 옴니(Gemini Omni)를 활용해 영상을 빠르게 편집하는 '비디오 리믹스' 기능을 구글 포토에 추가했다. 시네마틱 조명 조절, 배경 교체, 수채화 및 유화 스타일 적용이 가능하며 한국을 포함한 주요 국가의 유료 구독자에게 순차 제공

단어 하나에 셧다운, Anthropic Fable의 '과잉 안전' 논란

단어 하나에 셧다운, Anthropic Fable의 '과잉 안전' 논란

AI에게 코딩이나 수학 문제 풀이를 맡기는 것은 이제 흔한 일입니다. 하지만 Anthropic의 안전 특화 모델 Fable은 단순한 전문 용어에도 답변을 거부합니다. 과도한 필터링 탓에 실제 연구나 개발 현장에서 쓰기 어렵다는 비판이 나옵니다.

무전기 시대 끝났다, OpenAI가 공개한 '사람처럼 듣고 말하는' GPT-Live

무전기 시대 끝났다, OpenAI가 공개한 '사람처럼 듣고 말하는' GPT-Live

우리는 AI와 대화할 때 상대의 말이 끝날 때까지 기다려야 하는 불편함을 겪어왔다. OpenAI가 실시간으로 듣고 말하기가 동시에 가능한 '풀 듀플렉스' 구조의 GPT-Live를 출시했다. 음성 인터랙션과 추론 레이어를 분리해 자연스러운 대화와 고성능

구글, 안드로이드 벤치 업데이트 및 신규 모델 8종 추가

구글, 안드로이드 벤치 업데이트 및 신규 모델 8종 추가

구글이 안드로이드 앱 개발 성능 평가 도구인 안드로이드 벤치(Android Bench)를 업데이트했다. 신규 모델 8종을 리더보드에 추가하고 비용과 효율성 지표를 도입했다.

GeoSQL, '지도 기반 루프' 도입해 Claude·Copilot 지리공간 분석 성능 4배 높였다

GeoSQL, '지도 기반 루프' 도입해 Claude·Copilot 지리공간 분석 성능 4배 높였다

GeoSQL이 Claude, Codex, GitHub Copilot을 위한 지리공간 데이터 분석 스킬을 공개했다. 지도 기반 루프(map-in-the-loop) 방식을 통해 텍스트 전용 검증 대비 작업 성능을 4배 개선했다. PostGIS, BigQu

Cognition, 1조 파라미터 코딩 모델 SWE-1.7 공개... 분산 RL로 효율 극대화

Cognition, 1조 파라미터 코딩 모델 SWE-1.7 공개... 분산 RL로 효율 극대화

코딩 AI가 단순 함수 작성을 넘어 전체 코드베이스를 분석하는 엔지니어링 단계로 진입하고 있다. Cognition이 공개한 SWE-1.7은 Kimi K2.7 기반의 RL 최적화로 프런티어급 지능과 낮은 비용을 구현했다. 3개 대륙에 분산된 학습 인프라

1조 원 돌파에 단 4개월, AI 스타트업들의 기괴한 매출 가속도

1조 원 돌파에 단 4개월, AI 스타트업들의 기괴한 매출 가속도

AI 기술 도입으로 기업들의 매출 성장 속도가 단순 증가를 넘어 가속화 단계에 진입했다. Anthropic과 Mercor 등 주요 AI 기업들이 수천억에서 수조 원 단위의 매출 지표를 단 몇 개월 만에 경신했다. AI 네이티브 기업뿐 아니라 기존 HR

Mistral, 단일 RGB 카메라 기반 로봇 내비게이션 모델 'Robostral Navigate' 공개

Mistral, 단일 RGB 카메라 기반 로봇 내비게이션 모델 'Robostral Navigate' 공개

Mistral이 단일 RGB 카메라와 언어 지침만으로 자율 주행이 가능한 8B 규모의 로봇 내비게이션 모델 'Robostral Navigate'를 공개했다. 해당 모델은 R2R-CE 벤치마크의 unseen 데이터셋에서 76.6%의 성공률을 기록하며 기

"탭 전환 끝났다" — 슬랙봇, 세일즈포스 CRM·태블로 데이터 통합

"탭 전환 끝났다" — 슬랙봇, 세일즈포스 CRM·태블로 데이터 통합

기업용 AI는 그동안 개별 사용자의 생산성을 높이는 1:1 채팅 방식에 머물렀다. 슬랙은 MCP 프로토콜을 통해 슬랙봇을 세일즈포스 CRM 및 태블로와 직접 연결했다. 이제 공유 채널에서 데이터 조회부터 문서 승인까지 협업 기반의 AI 워크플로우가 가

수학 증명부터 소프트웨어 검증까지 스스로 수행하는 Mistral의 Leanstral 1.5

수학 증명부터 소프트웨어 검증까지 스스로 수행하는 Mistral의 Leanstral 1.5

AI가 단순 코딩을 넘어 수학적 정리 증명과 소프트웨어 무결성 검증 단계로 진입했다. Mistral AI가 정형 검증 도구 Lean 4 전용 오픈소스 에이전트 Leanstral 1.5를 공개했다. 119B 규모의 MoE 구조를 채택해 연산 비용은 낮추

JP모건이 선택한 '온프레미스 AI'의 힘, 삼바노바 110억 달러 가치 인정

JP모건이 선택한 '온프레미스 AI'의 힘, 삼바노바 110억 달러 가치 인정

AI 칩 시장은 엔비디아 같은 거대 기업이 주도하는 것처럼 보입니다. 삼바노바가 110억 달러의 기업 가치를 인정받으며 10억 달러 규모의 투자를 유치했습니다. 클라우드 의존도를 낮추려는 JP모건 같은 금융권의 온프레미스 수요가 성장의 핵심입니다.

엔비디아 락인 끝낼까, 모든 칩에서 최적 속도 내는 ZML/LLMD 공개

엔비디아 락인 끝낼까, 모든 칩에서 최적 속도 내는 ZML/LLMD 공개

AI 모델 구동 시 특정 GPU 벤더에 종속되어 비용과 선택지가 제한되는 문제가 반복된다. 프랑스 스타트업 ZML이 Nvidia, AMD, TPU, Apple Metal 등 다양한 칩에서 최적 속도를 내는 추론 서버 ZML/LLMD를 출시했다. 현재

깃허브 에이전틱 워크플로우에서 프라이빗 저장소 데이터 유출하는 'GitLost' 취약점 발견

깃허브 에이전틱 워크플로우에서 프라이빗 저장소 데이터 유출하는 'GitLost' 취약점 발견

노마 랩스(Noma Labs)가 깃허브 에이전틱 워크플로우에서 프라이빗 저장소 데이터를 유출할 수 있는 'GitLost' 취약점을 발견했다. 공격자가 공개 저장소에 조작된 이슈를 게시하면 AI 에이전트가 이를 지시사항으로 오인해 내부 프라이빗 저장소

Red Hat, 엔터프라이즈 AI 에이전트 운영 시 비용 최적화 및 보안 패치 주기 단축 강조

Red Hat, 엔터프라이즈 AI 에이전트 운영 시 비용 최적화 및 보안 패치 주기 단축 강조

Red Hat의 브라이언 그레이슬리 상무가 엔터프라이즈 AI 에이전트의 실제 운영 단계에서 발생하는 비용과 보안 리스크를 분석했다. 시맨틱 라우팅과 캐싱을 통한 토큰 비용 절감 및 7~14일 단위의 신속한 취약점 패치 관리 체계가 핵심으로 제시됐다.

Cloudflare 암호화 라이브러리 결함 7건 찾아낸 AI 에이전트 'zkao'

Cloudflare 암호화 라이브러리 결함 7건 찾아낸 AI 에이전트 'zkao'

오픈소스 암호화 라이브러리는 작은 구현 실수 하나로 전체 보안 체계가 무너질 수 있다. zkSecurity의 AI 에이전트 zkao가 Cloudflare의 CIRCL 라이브러리에서 7개의 실질적 버그를 발견했다. 부동 소수점 정밀도 손실부터 로그 키

디스코드 AI 모더레이션 오류, 무고한 사용자 8천 명 차단

디스코드 AI 모더레이션 오류, 무고한 사용자 8천 명 차단

디스코드의 AI 자동 차단 시스템이 무해한 이미지를 유해물로 오인해 8천 명 이상의 계정을 정지했다. 단순 표나 게임 텍스처를 불법 콘텐츠로 분류하는 오류가 발생하며 사용자들의 거센 반발을 샀다. 자동화된 검열의 신뢰성 문제가 불거지며 플랫폼 기업들의

취업 치트키 끝났다—그럼에도 코딩을 배워야 하는 진짜 이유

취업 치트키 끝났다—그럼에도 코딩을 배워야 하는 진짜 이유

AI가 코드를 대신 짜주는 '바이브 코딩' 시대가 열렸다. 이제 코딩은 고연봉 취업 수단이 아닌 사고력을 기르는 도구로 정의된다. 수학적 정밀함과 논리를 익히는 코드 리터러시가 AI 시대의 핵심 경쟁력이 된다.

Ternlight, BitNet b1.58 기반 7MB 임베딩 모델로 서버 없는 시맨틱 검색 지원

Ternlight, BitNet b1.58 기반 7MB 임베딩 모델로 서버 없는 시맨틱 검색 지원

Ternlight가 브라우저와 엣지 런타임에서 직접 실행되는 초경량 임베딩 모델을 공개했다. BitNet b1.58의 삼진 가중치 방식을 적용해 5~7MB 크기의 WASM 번들로 제공하며 밀리초 단위의 추론 속도를 구현했다. 개발자는 서버 호출 없이

OpenAI 공동창업자가 짚어준 현대 AI의 뿌리, 핵심 논문 27선

OpenAI 공동창업자가 짚어준 현대 AI의 뿌리, 핵심 논문 27선

AI 모델의 발전 속도가 빨라지며 기초 이론에 대한 실무적 갈증이 커지고 있다. OpenAI 공동창업자 일리야 서츠케버가 추천한 27개의 핵심 논문 목록이 공개됐다. CNN부터 트랜스포머, 스케일링 법칙과 정보이론까지 AI의 기술적 계보를 다룬다.

"특정 모델에 묶이지 마라" — 리버티 뮤추얼의 모델 교체 가능 AI 아키텍처

"특정 모델에 묶이지 마라" — 리버티 뮤추얼의 모델 교체 가능 AI 아키텍처

AI 모델의 갑작스러운 서비스 중단이나 정책 변화는 기업의 운영 리스크가 된다. 리버티 뮤추얼은 50여 개의 독립 컴포넌트로 구성된 'AI 백본'을 통해 모델을 즉시 교체할 수 있는 구조를 만들었다. 6개의 전문 에이전트 협업 체계인 '소프트웨어 팩토

"목표 달성까지 반복하라" Claude Code가 제시한 4가지 에이전트 루프

"목표 달성까지 반복하라" Claude Code가 제시한 4가지 에이전트 루프

AI 코딩 도구를 사용할 때 매번 프롬프트를 입력해 지시하는 방식이 일반적이다. Claude Code 팀은 정지 조건이 충족될 때까지 작업을 반복하는 '루프' 운영 패턴을 공개했다. 작업 성격에 따라 Turn, Goal, Time, Proactive

AI가 엉망으로 짠 코드, 일주일 1만 달러에 지워주는 서비스 등장

AI가 엉망으로 짠 코드, 일주일 1만 달러에 지워주는 서비스 등장

AI 코딩 도구로 빠르게 만든 프로젝트가 규모가 커질수록 유지보수가 어려워지는 문제가 발생하고 있다. Odra는 AI가 중복 생성한 코드를 분석해 줄이고 유지보수 가능한 구조로 재설계하는 서비스를 제공한다. 시니어 엔지니어 3명이 일주일간 작업하며,

인스타그램·왓츠앱에 바로 심었다, Meta의 AI 이미지 생성기 'Muse' 공개

인스타그램·왓츠앱에 바로 심었다, Meta의 AI 이미지 생성기 'Muse' 공개

인스타그램 스토리나 왓츠앱에서 AI로 이미지를 만드는 기능이 추가됩니다. Meta가 공개한 'Muse'는 단순 생성부터 배경 삭제, QR 코드 제작까지 지원합니다. 기본 이용은 무료지만 사용량 제한을 넘기면 구독제로 전환되는 구조입니다.

Claude Desktop의 오픈소스 대안, 지식 그래프 기반 AI 동료 Rowboat 공개

Claude Desktop의 오픈소스 대안, 지식 그래프 기반 AI 동료 Rowboat 공개

AI와 협업할 때 매번 이전 맥락을 다시 설명하거나 문서를 업로드하는 번거로움이 있다. Rowboat는 로컬 데이터를 지식 그래프로 인덱싱해 누적된 기억을 가진 AI 워크스테이션을 제공한다. MCP 지원으로 외부 툴과 연결 가능하며 Mac, Windo

토큰 양은 DeepSeek, 매출은 Anthropic — AI 모델의 이층 구조

토큰 양은 DeepSeek, 매출은 Anthropic — AI 모델의 이층 구조

오픈소스 AI의 사용량이 급증하며 시장 점유율을 빠르게 높이고 있다. 하지만 실제 지출액은 여전히 고가의 프런티어 모델에 집중되어 있다. AI 도입 단계가 '발견'과 '생산'으로 분리되는 이층 경제 구조가 나타났다.

AI 에이전트가 데이터베이스 때문에 멈추지 않게 하는 법

AI 에이전트가 데이터베이스 때문에 멈추지 않게 하는 법

AI 에이전트 시대에는 기존의 딱딱한 데이터 관리 방식이 개발 속도를 늦추는 병목 현상을 일으킵니다. Huntr, Modelence, Tavily 등 AI 스타트업들은 데이터와 검색 기능을 하나로 합친 통합 플랫폼으로 이 문제를 해결했습니다. 유연한