KO EN

AX BRIEF

매일 한 편, AI 업계를 읽는 칼럼

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 98 pt2. Gemini 4 Argon (high) 95 pt3. Claude Opus 5.5 (max with fallback) 94 pt4. Claude Sonnet 5.5 (max with fallback) 93 pt5. GPT-6 Astra (max) 90 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Fable 5.1 XHigh + SWE-2 Medium 88 pt3. GPT-6.1 Sol (xhigh) 69 pt4. Claude Sonnet 5.5 (max) 63 pt5. Claude Opus 5.5 (max) 63 pt이미지1. gpt-image-2.5-sunburst 85 pt2. gpt-image-2.5-flare 81 pt3. gpt-image-2 (medium) 78 pt4. grok-imagine-image-2.0 (canvas) 70 pt5. mai-image-2.6 70 pt비디오1. gemini-omni-1.1-flash 85 pt2. gemini-omni-flash 84 pt3. flux-3-video 81 pt4. grok-imagine-video-1.5-agent 81 pt5. dreamina-seedance-2.0-720p 79 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Opus 5.5 (max with fallback) 39 pt4. Claude Sonnet 5.5 (max with fallback) 19 pt5. Gemini 4 Argon (high) 19 pt속도1. Claude Haiku 5.5 (max) 100 pt2. DeepSeek V4.1 Flash (max) 88 pt3. gpt-oss-120b (high) 70 pt4. Muse Spark 1.3 (max) 68 pt5. Inkling (xhigh) 55 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

표 데이터 꼬임 해결한 PaddleOCR-VL-1.6의 영역 정밀화

표 데이터 꼬임 해결한 PaddleOCR-VL-1.6의 영역 정밀화

RAG 시스템에서 복잡한 표나 다단 문서의 텍스트 순서가 꼬이는 문제가 빈번하다. PaddleOCR-VL-1.6은 UORR 기술로 텍스트 경계 오차를 줄여 데이터 순도를 높였다. VL 구조와 점진적 사후 학습(PPT)을 통해 금융·법률 등 전문 문서

로딩 속도 2배 높인 MS 365 코파일럿의 디자인 개편

로딩 속도 2배 높인 MS 365 코파일럿의 디자인 개편

MS 365 코파일럿이 디자인 개편과 성능 최적화를 진행했다. 로딩 속도를 기존 대비 2배 높여 사용자 대기 시간을 줄였다. 구조화된 응답 방식으로 가독성을 높여 업무 효율을 개선한다.

IT 서비스 발견의 넷플릭스화, 큐레이션 플랫폼 newflix 등장

IT 서비스 발견의 넷플릭스화, 큐레이션 플랫폼 newflix 등장

매일 쏟아지는 AI와 개발 도구를 OTT처럼 탐색하는 플랫폼이 나왔다. 시네마틱 UI를 도입해 서비스 탐색 경험을 직관적으로 개선했다. 임베딩 검색과 컬렉션 기능을 결합해 개인화된 발견을 지원한다.

API 비용 99% 덜어낸 딥시크의 가격 파괴력

API 비용 99% 덜어낸 딥시크의 가격 파괴력

AI API 비용 부담이 서비스 운영의 핵심 병목이 되고 있다. 클로드에서 딥시크로 모델을 전환해 API 비용을 99% 절감했다. 성능 유지와 비용 최적화를 동시에 잡은 실무적 전환 사례다.

채굴카드를 AI GPU로 바꾼 고1의 CUDA 엔진 'Show GN'

채굴카드를 AI GPU로 바꾼 고1의 CUDA 엔진 'Show GN'

NVIDIA가 의도적으로 성능을 제한한 채굴용 GPU(CMP 100-210)의 한계를 극복한 사례다. DP4A 커널과 3-bit KV 캐시를 적용해 llama.cpp 대비 최대 2.99배 빠른 추론 속도를 구현했다. Qwen3.5/3.6 하이브리드 모

기대했던 AI 효율, 현실은 '비용 폭탄' 맞은 미국 기업들

기대했던 AI 효율, 현실은 '비용 폭탄' 맞은 미국 기업들

AI 도입으로 업무 효율을 기대했던 기업들이 예상치를 훨씬 웃도는 운영 비용에 당황하고 있다. 단순 실험 단계를 넘어 실제 서비스에 적용하며 발생하는 API 호출 비용과 인프라 유지비가 핵심 원인이다. 투자 대비 수익(ROI) 증명이 어려워지며 무조건

일주일 업무를 월요일 정오에 끝내는 AI, 주 4일제 제안

일주일 업무를 월요일 정오에 끝내는 AI, 주 4일제 제안

AI 생산성이 10배 높아지면 일주일 업무를 월요일 정오까지 완료할 수 있다. 목요일 프롬프트 입력 후 금요일은 AI 에이전트가 전담하는 주 4일제를 제안한다. 월 6,000달러의 보육비 등 현실적 비용을 고려해 전 조직의 노동 시간을 단축한다.

"LLM에 의한 죽음"이라던 Stack Overflow, 데이터 팔아 매출 2배

"LLM에 의한 죽음"이라던 Stack Overflow, 데이터 팔아 매출 2배

개발자 Q&A의 성지였던 Stack Overflow의 포럼 트래픽이 급감했다. 연매출은 1억 1,500만 달러로 약 2배 성장하며 수익 구조를 전환했다. 광고 대신 기업용 솔루션과 AI 데이터 라이선스 판매로 생존 전략을 짰다.

DeepLLM 성능보다 중요한 건 '맥락'이다: 글린(Glean)이 ARR 3억 달러를 달성한 비결

LLM 성능보다 중요한 건 '맥락'이다: 글린(Glean)이 ARR 3억 달러를 달성한 비결

지식 노동자들은 파편화된 SaaS 툴 사이에서 정보를 찾느라 매일 수 시간을 낭비한다. 글린(Glean)은 권한 체계가 반영된 '컨텍스트 그래프'를 구축해 ARR 3억 달러를 달성했다. 이제 AI의 가치는 모델의 파워가 아니라 기업 내부의 맥락을 얼마

에이전트 20개를 돌려도 생산성이 정체되는 '오케스트레이션 세금'

에이전트 20개를 돌려도 생산성이 정체되는 '오케스트레이션 세금'

AI 에이전트를 병렬로 실행해도 인간의 검토 단계에서 병목이 발생한다. 이를 '오케스트레이션 세금'이라 하며 판단과 병합은 직렬로 처리되기 때문이다. 생산성 기준을 실행 수가 아닌 실제 배포 가능한 작업량으로 재정의해야 한다.

AI 에이전트와 공유하는 코드 지도, CodeBoarding 공개

AI 에이전트와 공유하는 코드 지도, CodeBoarding 공개

AI와 사람이 함께 보는 코드베이스 아키텍처 지도를 자동 생성하는 오픈소스 도구다. 정적 분석과 LLM을 결합해 .codeboarding 폴더에 마크다운과 Mermaid 다이어그램을 저장한다. 8개 언어와 다양한 LLM 프로바이더를 지원하며 CLI,

AI가 멈춰선 '조합 최적화' 난제, 뉴로모픽 이싱 머신으로 뚫는다

AI가 멈춰선 '조합 최적화' 난제, 뉴로모픽 이싱 머신으로 뚫는다

기존 AI가 고전하던 복잡한 조합 최적화 문제 해결의 실마리가 나왔다. 양자 터널링 물리 법칙과 뇌 구조를 결합한 뉴로모픽 이싱 머신을 구현했다. 단백질 접힘이나 물류망 최적화 같은 난제를 빠르게 해결할 수 있다.

AI 일자리 종말론 공식 철회한 OpenAI와 앤스로픽 CEO

AI 일자리 종말론 공식 철회한 OpenAI와 앤스로픽 CEO

AI가 화이트칼라 일자리를 대거 대체할 것이라는 공포가 확산되었다. OpenAI와 앤스로픽 CEO는 최근 기존의 실직 경고가 틀렸음을 인정했다. 자동화가 오히려 생산성을 높여 노동 수요를 늘린다는 경제적 논리가 근거로 제시된다.

인터넷을 뒤덮은 'AI 냄새', LLM 특유의 정형화된 문체 패턴

인터넷을 뒤덮은 'AI 냄새', LLM 특유의 정형화된 문체 패턴

LLM으로 다듬은 글은 초기에는 세련되게 느껴지나 시간이 흐르면 정형화된 패턴이 드러난다. 특정 문장 구조가 인터넷 전반에 반복되는 'AI 냄새(AI-smell)' 현상이 관찰되었다. 이는 다양한 AI 보조 작업에서 공통적으로 발생하는 식별 가능한 인

수백 명의 AI 비서를 동시에 돌리는 클로드의 다이내믹 워크플로우

수백 명의 AI 비서를 동시에 돌리는 클로드의 다이내믹 워크플로우

복잡한 코딩 작업을 혼자가 아닌 수백 명의 AI가 나눠서 처리합니다. 75만 줄의 코드를 11일 만에 옮긴 사례처럼 대규모 작업이 가능해졌습니다. 클로드 코드 CLI와 API, 주요 클라우드 플랫폼에서 바로 사용할 수 있습니다.

물리 시뮬레이션까지 집어삼킨 미스트랄 AI의 산업용 풀스택 전략

물리 시뮬레이션까지 집어삼킨 미스트랄 AI의 산업용 풀스택 전략

미스트랄 AI가 산업용 제조 AI와 자체 데이터센터 구축으로 미국 빅테크에 맞선다. LLM과 물리 시뮬레이션을 결합한 '산업 공학용 미스트랄'로 설계 주기를 획기적으로 단축한다. 프랑스와 스웨덴에 데이터센터를 세워 데이터 주권과 컴퓨팅 자원을 직접 통

수십만 줄 코드 마이그레이션 가능케 한 Opus 4.8과 다이내믹 워크플로우

수십만 줄 코드 마이그레이션 가능케 한 Opus 4.8과 다이내믹 워크플로우

Anthropic가 최신 고성능 모델 Opus 4.8을 공개했다. 불확실한 데이터를 스스로 식별하는 능력을 강화하고 '다이내믹 워크플로우' 기능을 도입했다. 수십만 줄의 코드 마이그레이션이 가능해졌으며, 향후 Mythos 모델 출시를 예고했다.

Deep똑똑한 AI보다 정직한 AI가 돈이 된다: 클로드 4.8의 전략

똑똑한 AI보다 정직한 AI가 돈이 된다: 클로드 4.8의 전략

기업용 AI 도입의 최대 걸림돌은 여전히 근거 없는 자신감, 즉 '환각' 현상이다. 앤스로픽(Anthropic)은 성능 경쟁 대신 정직함을 전면에 내세운 클로드 오퍼스(Claude Opus) 4.8을 출시했다. 벤치마크 점수 전쟁에서 벗어나 신뢰도 계

AI 에이전트의 끝없는 질문을 풍자한 60초 게임 'Continue? Y/N'

AI 에이전트의 끝없는 질문을 풍자한 60초 게임 'Continue? Y/N'

AI 에이전트가 매번 승인을 요청하는 불편함을 게임으로 구현했다. 'Continue? Y/N'은 60초 동안 쏟아지는 권한 요청을 처리하는 게임이다. 자율성과 보안 사이의 딜레마인 '권한 승인 피로감'을 꼬집는다.

3배 저렴한 패스트 모드와 수백 개 에이전트, 클로드 오퍼스 4.8 공개

3배 저렴한 패스트 모드와 수백 개 에이전트, 클로드 오퍼스 4.8 공개

앤스로픽이 플래그십 모델 클로드 오퍼스 4.8을 전격 공개했다. 패스트 모드 비용을 3배 낮추고 수백 개의 병렬 서브에이전트 기능을 도입했다. GPT-5.5 대비 12개 이상의 벤치마크에서 우위를 점하며 성능을 끌어올렸다.

텍스트로 좌표를 찍는 속도가 2.5배 빨라진 엔비디아 LocateAnything

텍스트로 좌표를 찍는 속도가 2.5배 빨라진 엔비디아 LocateAnything

텍스트 설명만으로 이미지 속 객체 위치를 정확히 찾는 시각 언어 접지 기술이 진화했다. 엔비디아가 공개한 LocateAnything-3B는 병렬 박스 디코딩으로 추론 속도를 2.5배 높였다. 물리적 AI와 GUI 에이전트, 문서 분석 등 실시간 좌표

DeepSeek의 파격가, 실리콘밸리 AI 비용 구조를 흔들다

DeepSeek의 파격가, 실리콘밸리 AI 비용 구조를 흔들다

DeepSeek가 V4 Pro 모델 가격을 75% 영구 인하하며 서구권 AI 시장을 정면으로 타격했다. 입력 비용은 기존 대비 7배, 출력은 17배 저렴해지며 기업들의 비용 부담을 획기적으로 낮췄다. 오픈 웨이트 기반의 효율적 아키텍처를 앞세워 대규모

마침내 사라진 업스케일링 단계, 엔비디아 PiD의 4K 직행

마침내 사라진 업스케일링 단계, 엔비디아 PiD의 4K 직행

이미지 생성 후 따로 확대하던 업샘플링 과정이 사라진다. 엔비디아 PiD는 디코딩과 업샘플링을 하나의 모듈로 통합했다. 4단계 추론만으로 최대 4K 해상도 출력이 가능해진다.

Deep애플의 '오케스트레이션' 전략: 시리가 챗봇을 넘어 에이전트가 되는 법

애플의 '오케스트레이션' 전략: 시리가 챗봇을 넘어 에이전트가 되는 법

아이폰 사용자들은 복잡한 질문을 할 때 시리 대신 챗GPT를 켭니다. 애플은 25억 대의 기기 인프라를 활용해 외부 AI 모델을 OS에 직접 심습니다. 시리는 프라이버시와 클라우드 지능을 조율하는 '라우터'로 진화합니다.

경영진의 손안으로 들어온 ERP, 버튜의 AI 폴더블폰

경영진의 손안으로 들어온 ERP, 버튜의 AI 폴더블폰

럭셔리 폰 브랜드 버튜가 AI 에이전트를 탑재한 폴더블폰 '알파폴드'를 공개했다. ERP와 CRM 등 기업 시스템을 연결해 결재와 일정 관리를 자연어로 처리한다. 최저 6,880달러부터 시작하며 전용 보안 칩 A5를 통해 기업 데이터 유출을 막는다.

Deep코파일럿을 넘어 자율 엔지니어로: 코그니션이 그리는 소프트웨어 자동화의 미래

코파일럿을 넘어 자율 엔지니어로: 코그니션이 그리는 소프트웨어 자동화의 미래

대부분의 개발자는 AI를 고성능 자동완성 도구 정도로 사용한다. 코그니션(Cognition)은 10억 달러 규모의 시리즈 D 투자를 유치하며 기업가치 260억 달러를 기록했다. 시장은 단순 보조를 넘어 개발 생애주기 전체를 관리하는 AI 에이전트에 베

Deep속도냐 정확도냐, 미니맥스 M3가 100만 토큰의 벽을 넘는 법

속도냐 정확도냐, 미니맥스 M3가 100만 토큰의 벽을 넘는 법

미니맥스(MiniMax) M3가 '스파스 어텐션(Sparse Attention)'을 도입해 기존 M2의 고질적인 지연 시간 문제를 해결했습니다. 100만 토큰의 방대한 컨텍스트에서도 추론의 안정성과 실시간 응답 속도라는 두 마리 토끼를 잡으려는 시도입

승인 안 한 AI 모델에 데이터 넘기는 벤더사 63.6% 적발

승인 안 한 AI 모델에 데이터 넘기는 벤더사 63.6% 적발

AI 소프트웨어를 도입해도 정작 내 데이터가 어디로 가는지 모르는 기업이 많다. 벤더사 63.6%가 계약서에 명시하지 않은 제3자 AI 모델을 몰래 사용 중이다. 섀도우 AI로 인한 데이터 유출 사고 시 평균 비용은 463만 달러에 달한다.

스트레스가 지운 기억의 연결고리, 해마의 통합 능력 저하

스트레스가 지운 기억의 연결고리, 해마의 통합 능력 저하

스트레스가 뇌의 해마 기능을 방해해 겹치는 사건들의 통합 능력을 떨어뜨린다. 서로 연관된 기억을 엮어 새로운 결론을 내는 기억 추론 과정이 중단된다. 스트레스 상황에서 왜 논리적 판단과 기억 회상이 어려워지는지 밝혀냈다.

"에이전트 수천 개를 돌리려면 배관부터 뚫어라" — 머크의 AI 인프라 전략

"에이전트 수천 개를 돌리려면 배관부터 뚫어라" — 머크의 AI 인프라 전략

AI 에이전트 도입 시 개별 기능 구현보다 데이터와 연결망 같은 '기초 인프라' 구축이 우선되어야 한다. 제약사 머크는 인프라 선제 구축으로 신약 개발 주기를 33% 단축하고 마케팅 검토 시간을 수개월에서 수일로 줄였다. 마스터카드는 복잡한 거래 분쟁