KO EN

AX BRIEF

매일 한 편, AI 업계를 읽는 칼럼

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 98 pt2. Gemini 4 Argon (high) 95 pt3. Claude Opus 5.5 (max with fallback) 94 pt4. Claude Sonnet 5.5 (max with fallback) 93 pt5. GPT-6 Astra (max) 90 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Fable 5.1 XHigh + SWE-2 Medium 88 pt3. GPT-6.1 Sol (xhigh) 69 pt4. Claude Sonnet 5.5 (max) 63 pt5. Claude Opus 5.5 (max) 63 pt이미지1. gpt-image-2.5-sunburst 85 pt2. gpt-image-2.5-flare 81 pt3. gpt-image-2 (medium) 78 pt4. grok-imagine-image-2.0 (canvas) 70 pt5. mai-image-2.6 70 pt비디오1. gemini-omni-1.1-flash 85 pt2. gemini-omni-flash 84 pt3. flux-3-video 81 pt4. grok-imagine-video-1.5-agent 81 pt5. dreamina-seedance-2.0-720p 79 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Opus 5.5 (max with fallback) 39 pt4. Claude Sonnet 5.5 (max with fallback) 19 pt5. Gemini 4 Argon (high) 19 pt속도1. Claude Haiku 5.5 (max) 100 pt2. DeepSeek V4.1 Flash (max) 90 pt3. Muse Spark 1.3 (max) 73 pt4. gpt-oss-120b (high) 68 pt5. Nemotron 3 Ultra 54 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

AI 텍스트의 '기계적 패턴' 걷어내는 AI 체커의 품질 관리법

AI 텍스트의 '기계적 패턴' 걷어내는 AI 체커의 품질 관리법

AI 도구로 콘텐츠 초안을 빠르게 작성하는 방식이 보편화되었다. 반복적 표현과 맥락 부족 등 AI 특유의 패턴이 독자의 신뢰도를 낮춘다. isgen.ai 같은 AI 체커로 문장 구조와 예측 가능성을 분석해 품질을 검증한다.

끝났다 — 사람이 직접 하던 회원가입, 에이전트 표준 auth.md 등장

끝났다 — 사람이 직접 하던 회원가입, 에이전트 표준 auth.md 등장

새로운 서비스에 가입할 때마다 이메일을 쓰고 인증 코드를 확인하는 번거로움이 반복됩니다. WorkOS가 에이전트가 사용자를 대신해 계정을 생성하는 오픈 프로토콜 auth.md를 공개했습니다. Cloudflare와 monday.com 등이 이미 도입했으

이해 없는 LLM 코딩, 결국 '인지 부채'로 돌아온다

이해 없는 LLM 코딩, 결국 '인지 부채'로 돌아온다

AI가 코드를 순식간에 짜주는 시대가 왔다. 원리 없는 복제는 수정 능력을 잃게 하는 '인지 부채'를 쌓는다. 장기적 생산성은 코드 양(Output)이 아닌 시스템 안정성(Outcome)에서 결정된다.

Liquid AI, 2억 3천만 파라미터 LFM2.5-230M 공개... 데이터 추출 성능 4배 큰 모델 상회

Liquid AI, 2억 3천만 파라미터 LFM2.5-230M 공개... 데이터 추출 성능 4배 큰 모델 상회

Liquid AI가 온디바이스 에이전트 워크플로우를 위한 초소형 언어 모델 LFM2.5-230M을 공개했다. 2억 3천만 개의 파라미터와 32K 컨텍스트 창을 지원하며, BFCLv3 벤치마크에서 43.26점을 기록해 10억 파라미터급 모델보다 높은 성

Claude 역량 불법 추출한 알리바바, 앤스로픽이 미 상원에 폭로

Claude 역량 불법 추출한 알리바바, 앤스로픽이 미 상원에 폭로

미국과 중국의 AI 패권 경쟁이 모델의 지식재산권 탈취 분쟁으로 번지고 있다. 앤스로픽은 알리바바가 2만 5천 개의 가짜 계정으로 Claude의 역량을 불법 추출했다고 주장했다. 약 2,880만 건의 교환을 통해 고성능 모델의 데이터를 학습시키는 '증

트럼프 정부, OpenAI GPT 5.6 '고객별 승인' 후 제한적 공개 지시

트럼프 정부, OpenAI GPT 5.6 '고객별 승인' 후 제한적 공개 지시

OpenAI가 차세대 모델 GPT 5.6의 출시를 준비하고 있다. 트럼프 정부의 안전 우려로 일반 공개 대신 파트너사 대상의 제한적 배포를 결정했다. 정부 기관의 고객별 승인 절차를 거쳐 안전성을 검증한 뒤 순차적으로 공개할 계획이다.

AI 모델 6개 중 4개가 좌편향, 정치적 좌표 찍는 '편향성 맵' 등장

AI 모델 6개 중 4개가 좌편향, 정치적 좌표 찍는 '편향성 맵' 등장

ChatGPT 같은 생성형 AI의 답변이 특정 정치적 성향을 띠는지에 대한 논란이 지속되고 있다. 주요 AI 모델의 정치·경제적 좌표를 측정해 시각화하는 'Political bias in AI' 도구가 공개됐다. 6개 모델 중 4개가 좌편향된 것으로

OpenKnowledge, 오픈소스 AI 기반 마크다운 에디터 공개

OpenKnowledge, 오픈소스 AI 기반 마크다운 에디터 공개

로컬 우선 마크다운 에디터이자 LLM 위키인 OpenKnowledge가 공개됐다. Claude, Codex 등 LLM 연동을 지원하며 오픈소스로 제공된다.

Patronus AI, AI 에이전트 검증용 '디지털 세계' 구축에 5천만 달러 확보

Patronus AI, AI 에이전트 검증용 '디지털 세계' 구축에 5천만 달러 확보

AI 에이전트가 단순 답변을 넘어 복잡한 업무를 자율 수행하는 단계로 진화하고 있다. Patronus AI는 가상 환경을 구축해 에이전트의 신뢰성을 스트레스 테스트하는 솔루션을 제공한다. 최근 5천만 달러의 시리즈 B 투자를 유치하며 소프트웨어 공학

OpenAI, GPT-5.5 Instant 업데이트 공개... 복합 제약 조건 처리 및 의도 파악 강화

OpenAI, GPT-5.5 Instant 업데이트 공개... 복합 제약 조건 처리 및 의도 파악 강화

OpenAI가 ChatGPT의 기본 모델인 GPT-5.5 Instant의 업데이트 버전을 공개했다. 사용자 의도 파악과 복합 제약 조건 처리 능력을 개선했으며, chat-latest API 별칭을 통해 제공된다. 개발자는 최신 기능을 테스트할 때 ch

GPU 100만 개 연결한 네트리스, a16z서 1,500만 달러 투자 유치

GPU 100만 개 연결한 네트리스, a16z서 1,500만 달러 투자 유치

AI 인프라 구축 시 GPU 확보만큼이나 네트워크 설정과 운영 최적화가 큰 병목이 된다. 네트리스(Netris)는 하드웨어 가속 기반의 네트워크 자동화 플랫폼으로 데이터센터 가동 시간을 단축한다. a16z로부터 1,500만 달러의 시리즈 A 투자를 유

Adobe, Topaz Labs 인수로 온디바이스 AI 영상 보정 시장 정조준

Adobe, Topaz Labs 인수로 온디바이스 AI 영상 보정 시장 정조준

포토샵과 프리미어로 익숙한 Adobe가 AI 보정 전문 기업 Topaz Labs를 인수한다. 영상 업스케일링 모델 Astra와 이미지 리터칭 모델 Wonder를 Firefly AI에 통합한다. 소비자용 GPU에서 대형 모델을 빠르게 돌리는 온디바이스

AI 메모리 품귀가 불러온 마이크론의 1.2조 달러 질주

AI 메모리 품귀가 불러온 마이크론의 1.2조 달러 질주

AI 모델 구동에 필수적인 메모리 칩 부족 현상이 2027년까지 이어질 전망이다. 미국 마이크론은 3분기 매출이 4배 성장하며 시가총액 1.2조 달러를 기록했다. 앤스로픽에 칩을 공급하고 투자까지 참여하며 AI 생태계의 핵심 공급망으로 부상했다.

시그널파이어 데이터, AI 시대 빅테크 엔지니어 신규 채용 비중 55%로 확대

시그널파이어 데이터, AI 시대 빅테크 엔지니어 신규 채용 비중 55%로 확대

벤처캐피털 시그널파이어의 최신 보고서에서 소프트웨어 엔지니어 직군이 AI 도입 이후에도 가장 높은 고용 회복력을 보인 것으로 나타났다. 빅테크 12개사 신규 채용 중 엔지니어 비중은 2019년 46%에서 2025년 55%로 상승했으며, 초기 스타트업의

ASML 매출 19% 증발 위기... 네덜란드, 美 '칩 전쟁'에 제동

ASML 매출 19% 증발 위기... 네덜란드, 美 '칩 전쟁'에 제동

미국과 중국의 반도체 패권 전쟁이 심화하며 글로벌 공급망의 불확실성이 커지고 있다. 미국이 추진하는 MATCH 법안이 통과될 경우 ASML의 DUV 노광 장비까지 중국 수출이 금지된다. 네덜란드 정부는 ASML 매출의 19%를 차지하는 중국 시장 상실

사람 대신 AI가 구축하는 IT 서비스, 인포시스 전 CEO의 '행텐' 출격

사람 대신 AI가 구축하는 IT 서비스, 인포시스 전 CEO의 '행텐' 출격

기업들이 소프트웨어 유지보수를 외부 업체에 맡기던 IT 아웃소싱 시대가 변하고 있습니다. 인포시스 전 CEO 비샬 시카가 AI 기반 소프트웨어 자동화 스타트업 '행텐 시스템즈'를 설립했습니다. 3,200만 달러의 시드 투자를 유치하며 인력 중심의 기존

모델의 '완료' 신호마저 무시하는 '하네스 루프'의 습격

모델의 '완료' 신호마저 무시하는 '하네스 루프'의 습격

AI 코딩 에이전트가 스스로 도구를 쓰는 단계를 넘어, 외부에서 반복을 강제하는 '하네스 루프' 패턴이 확산하고 있다. 코드 포팅이나 보안 스캔 등 검증이 쉬운 영역에서는 효율적이지만, 장기 유지보수 코드에서는 설계가 무너지는 부작용이 관찰된다. 공격

GPT부터 Ollama까지, Ruby 개발자를 위한 단일 AI 창구 RubyLLM

GPT부터 Ollama까지, Ruby 개발자를 위한 단일 AI 창구 RubyLLM

AI 모델마다 제각각인 API 응답 형식과 클라이언트 설정으로 개발 공수가 늘고 있다. RubyLLM은 GPT, Claude, Ollama 등 다양한 제공자를 하나의 인터페이스로 통합해 다룬다. 800개 이상의 모델 레지스트리와 Rails 전용 통합

UIUC·Meta·Stanford, 코드를 에이전트 실행 기반으로 정의한 'Code as Agent Harness' 논문 공개

UIUC·Meta·Stanford, 코드를 에이전트 실행 기반으로 정의한 'Code as Agent Harness' 논문 공개

UIUC, Meta, Stanford 연구진이 코드를 에이전트의 추론과 행동을 위한 실행 기반으로 정의한 'Code as Agent Harness' 서베이 논문을 공개했다. 에이전트 시스템을 인터페이스, 메커니즘, 스케일링의 3계층 구조로 분석하며 결

데이터오븐 하용호, AI 시대 전문성을 '운영 책임자'로 재정의

데이터오븐 하용호, AI 시대 전문성을 '운영 책임자'로 재정의

데이터오븐 하용호가 AI 전환 과정에서 발생하는 '검증 세금'과 세 가지 부채 개념을 제시했다. 기술·인지·의도 부채를 해결하기 위해 인간의 주 업무가 생산에서 검증 레이어 구축으로 이동한다. AI 실무자는 단순 스킬 숙련을 넘어 AI 결과물을 검증하

틱톡·유튜브 잡는 페이스북의 승부수, AI 크리에이터 비서 앱 공개

틱톡·유튜브 잡는 페이스북의 승부수, AI 크리에이터 비서 앱 공개

콘텐츠 기획을 위해 챗GPT를 오가며 아이디어를 짜내던 크리에이터들의 번거로움이 사라집니다. 메타가 기존 크리에이터 스튜디오를 독립된 AI 컴패니언 앱으로 재편해 전격 공개했습니다. 개인 맞춤형 추천부터 내 말투를 닮은 댓글 초안 작성까지 AI가 전

AI 검색 추천 노출 측정 결과, 신생 서비스 노출률 0% 기록

AI 검색 추천 노출 측정 결과, 신생 서비스 노출률 0% 기록

AI 검색 엔진의 추천 노출도를 측정하는 도구를 개발해 신생 서비스의 노출 여부를 실험했다. 4개 AI 모델에 100개 질문을 투입한 결과 노출률 0%를 기록했다. 단순 색인보다 도메인 권위와 외부 언급이 노출의 핵심 변수로 확인됐다.

3B 소형 모델이 Opus 4.5 추론 성능을 추월했다

3B 소형 모델이 Opus 4.5 추론 성능을 추월했다

보통 소형 AI 모델은 속도는 빠르지만 복잡한 추론 능력은 떨어진다고 생각합니다. 3B 파라미터 규모의 VibeThinker-3B가 수학과 코딩에서 거대 모델급 성능을 증명했습니다. Gemini 3 Pro나 GLM-5 같은 플래그십 모델과 대등하거나

데이터 주권과 비용 다 잡은 로컬 우선 AI OS, Mindstone 'Rebel' 공개

데이터 주권과 비용 다 잡은 로컬 우선 AI OS, Mindstone 'Rebel' 공개

기업들이 AI 에이전트 도입 시 겪는 데이터 유출 우려와 클라우드 비용 문제를 해결하려는 시도가 늘고 있다. 런던 스타트업 Mindstone가 마크다운 파일 기반의 로컬 우선 AI OS 'Rebel'을 출시했다. 작업 성격에 따라 로컬과 클라우드 모델

Krea.ai, 8단계 추론으로 2K 고해상도 구현한 'Krea 2' 공개

Krea.ai, 8단계 추론으로 2K 고해상도 구현한 'Krea 2' 공개

Krea.ai가 120억 파라미터 규모의 텍스트-이미지 생성 모델 Krea 2를 허깅페이스에 공개했다. Krea 2 Turbo 모델은 지식 증류 기술을 적용해 8단계의 추론만으로 2048x2048 고해상도 이미지를 생성한다. 오픈 웨이트 방식으로 배포

미스트랄, OCR 4 공개... 단순 텍스트 넘어 '문서 구조' 통째로 추출

미스트랄, OCR 4 공개... 단순 텍스트 넘어 '문서 구조' 통째로 추출

기업들이 PDF나 PPT에서 데이터를 추출해 AI에 넣을 때 레이아웃이 깨지는 문제는 고질적이었다. 미스트랄 AI가 텍스트뿐 아니라 위치 정보와 블록 유형까지 반환하는 OCR 4를 출시했다. 단일 컨테이너 배포를 지원해 미국 클라우드 의존도를 낮추려는

GPU 없이 실시간 음성 합성, 463만 파라미터로 리더보드 1위

GPU 없이 실시간 음성 합성, 463만 파라미터로 리더보드 1위

AI 음성 합성은 보통 고성능 GPU 서버와 거대 모델이 필수적이라고 여겨진다. 1인 개발자가 공개한 Inflect-Nano-v1은 463만 개의 파라미터만으로 TTS 리더보드 1위를 기록했다. 보코더까지 통합한 초경량 구조를 통해 CPU 환경에서도

행동보다 환경 예측이 먼저, 알리바바가 제시한 에이전트 학습법

행동보다 환경 예측이 먼저, 알리바바가 제시한 에이전트 학습법

AI 에이전트가 실제 환경의 예상치 못한 변수 때문에 작동을 멈추는 일은 흔합니다. 알리바바가 환경의 다음 상태를 예측하도록 학습시킨 Qwen-AgentWorld를 공개했습니다. 7개 도메인에서 시뮬레이션 학습을 통해 실제 환경보다 높은 성능 향상을

모델이 사라져도 서비스는 계속된다, 쇼피파이의 LLM 프록시 전략

모델이 사라져도 서비스는 계속된다, 쇼피파이의 LLM 프록시 전략

기업들은 특정 AI 모델의 업데이트나 서비스 종료로 인한 시스템 중단 위험에 노출되어 있다. 쇼피파이는 LLM 프록시를 구축해 모델 장애 시 다른 모델로 자동 전환하는 페일오버 체계를 구현했다. 지식 증류를 통해 특정 작업에 최적화된 소형 모델을 생성

구독료 200달러에 비용 1만 5천달러, 얀 르쿤이 예고한 '폐쇄형 AI의 종말'

구독료 200달러에 비용 1만 5천달러, 얀 르쿤이 예고한 '폐쇄형 AI의 종말'

거대 기업이 통제하는 폐쇄형 AI에 의존하는 현재의 구조는 지속 가능하지 않습니다. 얀 르쿤은 데이터 주권을 지키며 지능만 공유하는 '프로젝트 태피스트리'를 통해 대안을 제시합니다. 2027년 상용화를 목표로 한국을 포함한 글로벌 국가와 기업들이 오픈