KO EN

AX BRIEF

매일 한 편, AI 업계를 읽는 칼럼

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 98 pt2. Gemini 4 Argon (high) 95 pt3. Claude Opus 5.5 (max with fallback) 94 pt4. Claude Sonnet 5.5 (max with fallback) 93 pt5. GPT-6 Astra (max) 90 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Fable 5.1 XHigh + SWE-2 Medium 88 pt3. GPT-6.1 Sol (xhigh) 69 pt4. Claude Sonnet 5.5 (max) 63 pt5. Claude Opus 5.5 (max) 63 pt이미지1. gpt-image-2.5-sunburst 85 pt2. gpt-image-2.5-flare 81 pt3. gpt-image-2 (medium) 78 pt4. grok-imagine-image-2.0 (canvas) 70 pt5. mai-image-2.6 70 pt비디오1. gemini-omni-1.1-flash 85 pt2. gemini-omni-flash 84 pt3. flux-3-video 81 pt4. grok-imagine-video-1.5-agent 81 pt5. dreamina-seedance-2.0-720p 79 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Opus 5.5 (max with fallback) 39 pt4. Claude Sonnet 5.5 (max with fallback) 19 pt5. Gemini 4 Argon (high) 19 pt속도1. Claude Haiku 5.5 (max) 100 pt2. DeepSeek V4.1 Flash (max) 89 pt3. gpt-oss-120b (high) 74 pt4. Inkling (xhigh) 59 pt5. Muse Spark 1.3 (max) 58 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

Super ZSNES, GPU 가속으로 다시 쓴 SNES 에뮬레이션

Super ZSNES, GPU 가속으로 다시 쓴 SNES 에뮬레이션

ZSNES 원작 개발자들이 다시 뭉쳐 Super ZSNES를 공개했다. GPU(그래픽 처리 장치) 가속을 활용해 처음부터 완전히 다시 작성했다. 현재 7종의 인기 게임을 지원하며 지속적으로 업데이트할 예정이다.

중국 규제 당국, 메타의 AI 스타트업 매너스 인수 불허

중국 규제 당국, 메타의 AI 스타트업 매너스 인수 불허

중국 규제 당국이 메타의 AI 스타트업 매너스 인수를 차단했다. 이번 조치는 미국 기술 기업의 중국 내 AI 자산 확보를 제한한다. 매너스는 자율적인 AI 에이전트 개발에 집중하는 기업이다.

TypeScript-Go v7 대비하는 ttsc, ts-node보다 10배 빠른 구동 속도 구현

TypeScript-Go v7 대비하는 ttsc, ts-node보다 10배 빠른 구동 속도 구현

TypeScript-Go v7 출시를 앞두고 ttsc와 ttsx가 공개되었다. ttsx는 ts-node 대비 초기 구동 속도가 10배 빠르다. tsx와 달리 실행 시 타입 체크를 동시에 수행하는 것이 특징이다.

Mistral, 140억 달러 가치로 유럽 AI 독립 지형 구축

Mistral, 140억 달러 가치로 유럽 AI 독립 지형 구축

Mistral이 기업 가치 140억 달러를 기록하며 유럽 AI 시장의 중심이 됐다. 오픈 웨이트 방식을 통해 데이터 주권과 독립성을 강조하는 전략을 쓴다. ASML과 HSBC 등 글로벌 기업 및 정부 기관을 고객사로 확보했다.

아이폰 홈 화면을 AI 에이전트로 바꾸는 Skye, 358만 달러 투자 유치

아이폰 홈 화면을 AI 에이전트로 바꾸는 Skye, 358만 달러 투자 유치

Signull Labs가 아이폰 홈 화면용 AI 에이전트 앱 Skye를 개발 중이다. 최근 프리시드 라운드에서 358만 달러의 투자를 유치하며 기업 가치를 인정받았다. 정식 출시 전임에도 수만 명의 대기자가 몰리며 높은 관심을 받고 있다.

소프트웨어 예산 아닌 노동 비용 30배 공략하는 버티컬 AI 전략

소프트웨어 예산 아닌 노동 비용 30배 공략하는 버티컬 AI 전략

버티컬 AI가 복잡한 규제와 레거시가 얽힌 산업에서 강력한 방어벽을 구축하고 있다. 시장 규모를 소프트웨어 예산이 아닌 실제 노동 비용 기준으로 재산정해야 한다. 단순 보조 도구에서 업무 대체 시스템으로 전환하며 과금 영역을 확장하고 있다.

Mercor 데이터 유출, 4만 명의 음성 데이터와 신분증 동시 탈취

Mercor 데이터 유출, 4만 명의 음성 데이터와 신분증 동시 탈취

Mercor에서 4만 명의 계약직 데이터가 담긴 4TB 규모의 정보가 유출되었다. 유출된 데이터에는 음성 샘플과 정부 발행 신분증이 결합되어 포함되었다. 피해자들은 음성 복제 공격에 노출되어 즉각적인 보안 대응이 필요한 상태다.

로보틱스 2026 전망: 데이터 비용 30억 달러와 풀스택 기업의 가치

로보틱스 2026 전망: 데이터 비용 30억 달러와 풀스택 기업의 가치

로보틱스 산업이 연구실 성과와 현장 배포 사이의 격차를 겪는 GPT-2.5 단계에 진입했다. 향후 2년간 데이터 수집에만 30억 달러 이상의 비용이 소요될 것으로 예측된다. 범용 모델보다 독점 데이터 파이프라인을 가진 풀스택 기업이 단기적 우위를 점한

ManyPerson, 통계청 MDIS 데이터로 AI 시민 4.1만 명 구현

ManyPerson, 통계청 MDIS 데이터로 AI 시민 4.1만 명 구현

통계청 MDIS 데이터를 기반으로 한국인 AI 페르소나 시뮬레이터 ManyPerson이 공개됐다. 가계금융복지조사 데이터를 활용해 약 4.1만 명의 구체적인 AI 시민 풀을 구축했다. 단순 LLM 추론이 아닌 실제 인구 통계 가중치를 적용해 여론 시뮬

RAG 임베딩 모델 미세 조정, 검색 정확도 40% 하락 위험

RAG 임베딩 모델 미세 조정, 검색 정확도 40% 하락 위험

RAG 임베딩 모델의 미세 조정이 검색 성능을 저하시킨다. 구조적 차이를 학습시키면 일반 검색 능력이 크게 감소한다. 하이브리드 검색이나 리랭킹도 이 구조적 오류를 해결하지 못한다.

에이전트 AI의 자율성이 깨뜨린 데이터베이스 설계 규칙

에이전트 AI의 자율성이 깨뜨린 데이터베이스 설계 규칙

에이전트 AI가 기존 데이터베이스 설계의 기본 전제를 무너뜨리고 있다. 예측 불가능한 쿼리와 자율적인 쓰기 작업이 시스템 불안정을 초래한다. 소프트 삭제와 멱등성 키 도입 등 새로운 설계 패턴이 필요하다.

Browser Harness: LLM이 브라우저 작업을 직접 완료하는 도구

Browser Harness: LLM이 브라우저 작업을 직접 완료하는 도구

Browser Harness가 LLM이 브라우저 작업을 직접 수행할 수 있는 경량 도구를 공개했다. 이 도구는 CDP 위에 구축되어 중간 프레임워크 없이 웹소켓 하나로 연결된다. 무료 티어는 3개의 동시 브라우저와 프록시, 캡차 해결을 지원한다.

웹 스크래핑 전용 Obscura, 크롬 대비 5배 빠른 속도와 30MB 경량화

웹 스크래핑 전용 Obscura, 크롬 대비 5배 빠른 속도와 30MB 경량화

Obscura는 웹 스크래핑과 AI 자동화에 특화된 경량 헤드리스 브라우저다. 기존 크롬 대비 메모리 사용량은 30MB로 줄고 페이지 로드 속도는 85ms로 빨라졌다. 별도 의존성 없이 단일 바이너리로 실행되며 안티봇 우회 기능을 기본 탑재했다.

Cloudflare Workers 위에 올린 AI 이메일 클라이언트, Agentic Inbox 공개

Cloudflare Workers 위에 올린 AI 이메일 클라이언트, Agentic Inbox 공개

Agentic Inbox가 Cloudflare Workers 위에서 동작하는 셀프호스팅 이메일 클라이언트로 등장했다. AI 에이전트가 수신 이메일의 답장 초안을 자동 생성하고 사용자 확인 후 전송한다. MCP 서버를 노출해 Claude Code 등 외

AI를 정답지가 아닌 사고의 지렛대로 쓰는 법

AI를 정답지가 아닌 사고의 지렛대로 쓰는 법

AI가 확률 기반으로 작동하는 기술적 원리를 설명했다. 단순 대체가 아닌 사고 확장 도구로 활용하는 방법을 제시했다. 질문하는 능력이 미래의 핵심 경쟁력이 된다고 분석했다.

Eden AI, 단일 API로 수백 개 모델 통합 및 스마트 라우팅 구현

Eden AI, 단일 API로 수백 개 모델 통합 및 스마트 라우팅 구현

Eden AI가 여러 AI 모델을 단일 API로 통합하는 플랫폼을 제공한다. 스마트 라우팅 기능을 통해 모델 장애 시 자동으로 대체 모델로 전환한다. 비용, 지연 시간, 실행 지역에 따라 최적의 모델을 선택해 벤더 종속성을 방지한다.

DeepSeek-V4 출시, 100만 토큰 처리 시 메모리 점유율 10%로 절감

DeepSeek-V4 출시, 100만 토큰 처리 시 메모리 점유율 10%로 절감

DeepSeek-V4가 100만 토큰 컨텍스트를 지원하며 출시되었다. 전문가 혼합 방식과 하이브리드 어텐션을 통해 키-값 캐시를 10% 수준으로 낮췄다. 개발자는 HuggingFace를 통해 모델을 내려받아 온프레미스 환경에 배포할 수 있다.

ModMix, 두 게임을 조합해 기획안과 아트워크를 생성하는 AI 도구 출시

ModMix, 두 게임을 조합해 기획안과 아트워크를 생성하는 AI 도구 출시

ModMix이 두 게임과 태그를 조합해 게임 기획안을 생성한다. Anthropic Claude와 Flux schnell 모델을 활용해 비용을 최적화했다. 3주간의 스프린트를 거쳐 누적 비용 0.14달러로 서비스를 구현했다.

100줄 코드로 구현한 mini-swe-agent, AI 코딩 에이전트의 경량화

100줄 코드로 구현한 mini-swe-agent, AI 코딩 에이전트의 경량화

프린스턴과 스탠퍼드 연구팀이 100줄짜리 AI 코딩 에이전트를 공개했다. 별도의 복잡한 도구 호출 없이 bash 명령만으로 소프트웨어 이슈를 해결한다. SWE-bench 벤치마크에서 74% 이상의 성능을 기록하며 범용성을 입증했다.

PM 없는 스타트업, Slack과 Claude Code로 3배 빠른 실험

PM 없는 스타트업, Slack과 Claude Code로 3배 빠른 실험

샌프란시스코의 AI 네이티브 기업들이 전담 PM을 없애고 엔지니어 중심의 운영 모델로 전환하고 있다. Slack을 에이전트 오케스트레이션 허브로 활용하며 실험 비용을 획기적으로 낮추고 있다. AI 내재화 속도에 따라 기업 간의 생산성 격차가 매주 벌어

람다 대수 벤치마크, AI 논리 추론 능력 18% 향상 확인

람다 대수 벤치마크, AI 논리 추론 능력 18% 향상 확인

람다 대수 벤치마크가 AI 모델의 추론 능력을 측정하기 위해 공개되었다. 새로운 평가 체계는 기존 모델의 논리적 오류를 18% 더 정밀하게 포착한다. 복잡한 함수형 프로그래밍 구조를 통해 모델의 연산 정확도를 검증한다.

AI 산업을 향한 대중의 반감과 데이터 센터 갈등의 실체

AI 산업을 향한 대중의 반감과 데이터 센터 갈등의 실체

AI 산업에 대한 대중의 부정적 인식이 급격히 확산되고 있다. 기업의 생산성 향상 지표와 실제 현장의 체감 사이에는 큰 괴리가 존재한다. 데이터 센터 확충으로 인한 전기료 상승 등 실질적 피해가 반발을 키운다.

구글 Gemini Enterprise Agent Platform 출시, 200개 모델 통합 에이전트 인프라 공개

구글 Gemini Enterprise Agent Platform 출시, 200개 모델 통합 에이전트 인프라 공개

구글 클라우드가 Gemini Enterprise Agent Platform을 공식 출시했다. 200개 이상의 모델을 지원하며 에이전트의 전 생애주기를 단일 환경에서 관리한다. 보안 샌드박스와 장기 기억 기능을 통해 기업용 AI 에이전트 운영 인프라를

AI 에이전트용 오픈소스 메모리 레이어와 계층적 네임스페이스 도입

AI 에이전트용 오픈소스 메모리 레이어와 계층적 네임스페이스 도입

AI 에이전트의 기억을 체계적으로 관리하는 오픈소스 메모리 레이어가 공개되었다. 폴더 구조와 유사한 계층적 네임스페이스 방식을 통해 정보를 논리적으로 분리한다. 상위 경로를 읽으면 하위 경로의 데이터가 자동으로 포함되는 구조를 갖췄다.

8개 질문으로 3D 바디 생성하는 MLP 모델, 오차 0.3cm 달성

8개 질문으로 3D 바디 생성하는 MLP 모델, 오차 0.3cm 달성

8개 질문으로 3D 신체 모델을 생성하는 MLP 모델이 공개됐다. 사진이나 GPU 없이 CPU만으로 밀리초 단위의 빠른 연산이 가능하다. 신장 오차 0.3cm, 체중 오차 0.3kg의 높은 정확도를 기록했다.

WUPHF, Git 기반 공유 위키로 AI 에이전트 토큰 소모 7배 줄이다

WUPHF, Git 기반 공유 위키로 AI 에이전트 토큰 소모 7배 줄이다

AI 에이전트들이 공유 위키를 통해 협업하는 WUPHF가 공개되었다. Git 기반 마크다운 저장소를 공유 메모리로 사용하여 토큰 소모를 줄였다. Claude Code 등 기존 CLI 도구와 연동해 실제 업무 수행이 가능하다.

오픈소스 이슈 1만 3천 개 정리하는 AI 봇 ClawSweeper

오픈소스 이슈 1만 3천 개 정리하는 AI 봇 ClawSweeper

ClawSweeper가 1만 3천 개의 미처리 이슈를 AI로 자동 분류한다. 보수적인 5가지 기준을 적용해 확실한 항목만 닫기 제안을 한다. 사람이 최종 결정을 내리는 구조로 오류율을 0.1% 미만으로 유지한다.

Tolaria, 마크다운 노트를 Git 저장소로 관리하는 오픈소스 앱 출시

Tolaria, 마크다운 노트를 Git 저장소로 관리하는 오픈소스 앱 출시

Tolaria가 마크다운 지식 베이스를 관리하는 데스크톱 앱을 공개했다. 노트를 일반 파일과 Git 저장소로 다루며 데이터 이식성을 유지한다. 계정과 구독 없이 완전 오프라인 동작이 가능하다.

SSH 세션에 로컬 클립보드 이미지를 바로 붙여넣는 imgssh 공개

SSH 세션에 로컬 클립보드 이미지를 바로 붙여넣는 imgssh 공개

SSH 접속 시 로컬 클립보드 이미지를 원격 서버에 자동 업로드하는 도구 imgssh가 공개됐다. 설치나 데몬 없이 ssh를 감싸는 방식으로 동작하며, Ctrl+] 단축키 하나로 이미지 경로를 세션에 삽입한다. Claude Code 등 터미널 AI 도

DESIGN.md: AI 코딩 도구가 읽는 디자인 시스템 단일 파일 포맷

DESIGN.md: AI 코딩 도구가 읽는 디자인 시스템 단일 파일 포맷

Google Labs가 제안한 DESIGN.md 포맷이 주목받고 있다. 디자인 시스템을 YAML과 마크다운 이중 구조로 단일 파일에 담는다. AI 코딩 에이전트가 디자인 규칙을 참조하는 기준점으로 설계되었다.