KO EN

AX BRIEF

매일 한 편, AI 업계를 읽는 칼럼

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 98 pt2. Gemini 4 Argon (high) 95 pt3. Claude Opus 5.5 (max with fallback) 94 pt4. Claude Sonnet 5.5 (max with fallback) 93 pt5. GPT-6 Astra (max) 90 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Fable 5.1 XHigh + SWE-2 Medium 86 pt3. GPT-6.1 Sol (xhigh) 64 pt4. Claude Sonnet 5.5 (max) 57 pt5. Claude Opus 5.5 (max) 57 pt이미지1. gpt-image-2.5-sunburst 85 pt2. gpt-image-2.5-flare 81 pt3. gpt-image-2 (medium) 78 pt4. mai-image-2.6 70 pt5. gemini-nano-banana-2.1 69 pt비디오1. gemini-omni-1.1-flash 85 pt2. gemini-omni-flash 84 pt3. flux-3-video 81 pt4. grok-imagine-video-1.5-agent 81 pt5. dreamina-seedance-2.0-720p 79 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Opus 5.5 (max with fallback) 39 pt4. Claude Sonnet 5.5 (max with fallback) 19 pt5. Gemini 4 Argon (high) 19 pt속도1. DeepSeek V4.1 Flash (max) 100 pt2. Gemini 3.8 Flash (high) 93 pt3. Inkling (xhigh) 80 pt4. Muse Spark 1.3 (max) 79 pt5. gpt-oss-120b (high) 78 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

Tibo를 인식하는 Fable 5.5가 Claude Code와 웹 앱에 몰래 심겼다

Tibo를 인식하는 Fable 5.5가 Claude Code와 웹 앱에 몰래 심겼다

앤스로픽이 미발표 모델 Fable 5.5를 일부 유저에게 비밀리에 제공하며 스텔스 테스트를 진행하고 있다. 'Tibo' 인지 여부를 통한 모델 식별과 Blender 및 ElevenLabs를 결합한 초기 데모 영상이 공개되었다. 공식 발표 전 실사용 데

JS/TS로 Claude Code UI와 내부 동작을 직접 뜯어고치는 '모드'가 나왔다

JS/TS로 Claude Code UI와 내부 동작을 직접 뜯어고치는 '모드'가 나왔다

Anthropic이 Claude Code의 UI와 내부 동작을 사용자 정의하는 '모드(Mods)' 기능을 출시했다. JS/TS 기반의 내부 실행 플러그인으로, MCP와 달리 화면 재구성 및 에이전트 이벤트 제어가 가능하다. 개발자는 제공된 도구를 사용

구독료 없이 내 맥북에서 Gemma 4와 Qwen을 직접 실행하는 방법

구독료 없이 내 맥북에서 Gemma 4와 Qwen을 직접 실행하는 방법

클라우드 의존에서 벗어나 개인 기기에서 AI를 직접 구동하는 로컬 AI 환경이 가능해졌다. Gemma 4와 Qwen 같은 최적화 모델을 통해 보유한 하드웨어 자원으로 직접 추론을 수행한다. 데이터 보안과 비용 효율을 위해 작업 성격에 따라 클라우드와

챗GPT 꺼도 백그라운드에서 작업 끝내는 GPT-6 Astra 에이전트가 나왔다

챗GPT 꺼도 백그라운드에서 작업 끝내는 GPT-6 Astra 에이전트가 나왔다

OpenAI가 챗GPT 종료 후에도 독립적으로 작업을 수행하는 '항상 켜져 있는' AI 에이전트를 도입했다. GPT-6 Astra 모델을 기반으로 목표 부여 시 백그라운드에서 작업을 완료하고 보고하는 방식으로 작동한다. 단순 챗봇을 넘어 자율 수행자로

노트북을 닫아도 코딩이 계속되는 Codex Cloud와 PR까지 올리는 Dots가 나왔다

노트북을 닫아도 코딩이 계속되는 Codex Cloud와 PR까지 올리는 Dots가 나왔다

AI가 단순 코드 추천을 넘어 독립된 클라우드 환경에서 자율적으로 개발하고 PR을 생성하는 단계로 진화했다. Codex Cloud의 상태 유지 기능과 Astra 모델 기반의 Dots 에이전트가 브라우저와 컴퓨터를 직접 제어하며 작동한다. 개발자는 이제

OpenAI가 GPT-6 Soul을 출시하자 Anthropic은 Claude Sonnet 5.5를 비밀리에 테스트하기 시작했다

OpenAI가 GPT-6 Soul을 출시하자 Anthropic은 Claude Sonnet 5.5를 비밀리에 테스트하기 시작했다

OpenAI의 GPT-6 Soul 출시와 Anthropic의 Claude Sonnet 5.5 비밀 테스트로 LLM 교체 주기가 극도로 짧아졌다. 중급 모델인 Sonnet 5.5가 최신 상위 모델인 GPT-6 Soul의 대항마로 거론되며 성능 경쟁의 양

Ishan Sharma의 “Set a goal that is a little bit ambitious”, 100일의 리얼 워크로 직업과 소득을 바꾼다

Ishan Sharma의 “Set a goal that is a little bit ambitious”, 100일의 리얼 워크로 직업과 소득을 바꾼다

2026년 남은 100일을 단순 계획이 아닌 '리얼 워크' 중심의 실행 기간으로 전환해야 한다. 학습의 덫에서 벗어나 야심 찬 목표를 설정하고 실제 결과물을 만드는 것이 커리어 도약의 핵심이다. 자격증 위주의 스펙보다 시장이 원하는 해결 능력을 증명하

ARR 23만 달러와 수익 4만 6천 달러, Vibe Coding으로 증명한 빌더의 생존 방식

ARR 23만 달러와 수익 4만 6천 달러, Vibe Coding으로 증명한 빌더의 생존 방식

Vibe Coding은 코드 작성 중심의 개발을 수익 창출형 제품 빌딩으로 전환시키는 실전 전략입니다. BridgeMind의 ARR 231,494달러와 TOMMY YIPXYZ의 수익 46,529.53달러가 이 방식의 실효성을 증명합니다. AI 시대의

글 쓰는 AI가 정답인 줄 알았는데, 텍스트를 버리고 200배 빨라진 결정 모델 Jev가 나왔다

글 쓰는 AI가 정답인 줄 알았는데, 텍스트를 버리고 200배 빨라진 결정 모델 Jev가 나왔다

AI의 역할이 단순 텍스트 생성을 넘어 즉각적인 판단과 분류의 영역으로 확장된다. TypeSafe AI의 Jev는 생성 기능을 제거해 속도를 최대 200배 높이고 출력 비용을 0원으로 구현했다. 실시간 게임 플레이나 대규모 데이터 분류 등 밀리초 단위

API와 플러그인 연동으로 외부 인터페이스를 연결해 영상 제작 공정을 자동화하는 Higgsfield AI

API와 플러그인 연동으로 외부 인터페이스를 연결해 영상 제작 공정을 자동화하는 Higgsfield AI

Higgsfield AI가 단순 생성 도구를 넘어 API와 플러그인 기반의 영상 제작 인프라로 확장합니다. 이미지와 비디오 동시 생성 모델을 제공하며 외부 인터페이스와의 유기적 연동을 지원합니다. 전문가급 제어와 API 최적화를 위해 데스크톱 환경에서

텍스트 생성 과정을 통째로 생략하고 확률값만 즉시 내놓는 Jev가 나왔다

텍스트 생성 과정을 통째로 생략하고 확률값만 즉시 내놓는 Jev가 나왔다

TypeSafe AI가 텍스트 생성 대신 선택지의 확률을 즉시 출력하는 모델 Jev를 개발했다. 토큰을 순차적으로 생성하지 않고 확률적 결정을 내리는 구조로 LLM의 연산 부담과 병목을 줄였다. 비정형 쿼리의 고속 라우팅이 필요한 기업용 워크플로우에서

M5 울트라 맥 스튜디오, 512GB 통합 메모리로 로컬 AI 서버 수준까지 갔다

M5 울트라 맥 스튜디오, 512GB 통합 메모리로 로컬 AI 서버 수준까지 갔다

M5 울트라 칩을 탑재한 맥 스튜디오가 출시되며 로컬 AI 실행 환경의 하드웨어적 변곡점을 맞이했다. 최대 512GB 통합 메모리와 M1 대비 약 10배 빠른 프리필 속도로 거대 모델의 로컬 구동이 가능해졌다. 10월 하순 출시될 고용량 모델과 썬더볼

실용성 낮은 Obsidian 그래프 뷰보다 중요한 AI 세컨드 브레인 인출 방법

실용성 낮은 Obsidian 그래프 뷰보다 중요한 AI 세컨드 브레인 인출 방법

AI 세컨드 브레인을 통해 개인 지식 베이스를 구축하는 흐름이 확산되고 있다. Obsidian의 그래프 뷰는 시각적 만족감은 높으나 실제 탐색 도구로는 실용성이 낮다. 단순한 지식 저장과 시각화를 넘어 AI를 통한 효율적인 정보 인출 체계를 구축해야

입력 100만 토큰 4달러인 Opus 5.5가 화요일에 나온다

입력 100만 토큰 4달러인 Opus 5.5가 화요일에 나온다

최상위 지능 모델 Opus 5.5가 파격적인 가격 정책과 함께 화요일 출시된다. 입력 100만 토큰당 4달러, 출력 20달러로 책정되어 고성능 LLM의 진입장벽이 무너진다. Kimi K3.1의 추격 속에서 모델 교체 주기 단축과 운영 비용 최적화 전략

'Tibo'라고 물으면 답하는 Opus 5.2와 며칠 내 출시될 Grok 4.7

'Tibo'라고 물으면 답하는 Opus 5.2와 며칠 내 출시될 Grok 4.7

LLM 시장이 거대 발표 중심에서 Opus 5.2와 Grok 4.7 같은 상시 성능 갱신 체제로 전환되고 있습니다. 앤스로픽은 Claude Code 내에서 'Tibo' 프롬프트를 통해 신규 모델 라우팅을 비밀리에 검증 중입니다. 개발자와 기업은 특정

400배 저렴하고 200배 빠른 의사결정 전용 AI Jev가 나왔다

400배 저렴하고 200배 빠른 의사결정 전용 AI Jev가 나왔다

ChatGPT 공동 창립자가 텍스트 생성 기능을 제거하고 의사결정과 자동화에만 최적화한 AI 모델 Jev를 출시했다. 기존 LLM 대비 최대 200배 빠른 속도와 400배 저렴한 비용을 구현하며 10억 토큰당 42달러의 파격적 가격을 제시한다. 단순

다단계 고난도 작업은 Claude Fable 5.1과 GPT-6 Astra가 수행하고 생물학적 위험에서 멈춘다

다단계 고난도 작업은 Claude Fable 5.1과 GPT-6 Astra가 수행하고 생물학적 위험에서 멈춘다

앤트로픽의 Claude Fable 5.1과 오픈AI의 GPT-6 Astra가 고성능 다단계 작업 시장에 진입했다. 복잡한 워크플로우 완수 능력이 핵심 지표가 되었으며 모델 간의 벤치마크 성능 경쟁이 가속화되고 있다. 생물학적 무기 제조 및 무기 체계

sentdex의 “Vibe coding a robot task”, Harness 프레임워크로 로봇을 움직인다

sentdex의 “Vibe coding a robot task”, Harness 프레임워크로 로봇을 움직인다

개발자가 구문을 작성하는 대신 의도를 전달하는 Vibe Coding 방식이 등장했다. Harness 프레임워크를 통해 AI 모델의 추상적 답변을 실제 로봇 제어 코드로 변환한다. 단순 언어 숙련도보다 도메인 지식과 AI 오케스트레이션 역량이 핵심 경쟁

Deep마우스 제어권까지 가져가 앱을 직접 실행하는 ChatGPT-6 Astra가 나왔다

마우스 제어권까지 가져가 앱을 직접 실행하는 ChatGPT-6 Astra가 나왔다

ChatGPT-6 Astra가 단순 답변을 넘어 컴퓨터를 직접 제어하는 'Work mode'를 도입했다. 마우스와 키보드를 조작해 앱을 열고 명령을 실행하며 API 없이 소프트웨어를 다룬다. UI 중심의 소프트웨어 설계 방식에서 AI 에이전트 최적화

AI에게 시니어처럼 생각하라고 할 때, 23가지 판단 과정으로 쪼개면 벌어지는 일

AI에게 시니어처럼 생각하라고 할 때, 23가지 판단 과정으로 쪼개면 벌어지는 일

AI에게 시니어처럼 생각하라는 모호한 지시를 구체적인 판단 과정으로 나누어 23개의 독립된 스킬과 라우터 구조로 구현한 프로젝트 내용 정리.

Deep프런티어 지능을 탑재한 실시간 보이스 에이전트, '명령'을 넘어 '대화'로 갔다

프런티어 지능을 탑재한 실시간 보이스 에이전트, '명령'을 넘어 '대화'로 갔다

실시간 상호작용이 가능한 지능형 보이스 에이전트 구축 시도가 가속화되고 있다. 단순 음성 변환을 넘어 '프런티어 지능'을 통해 실시간 대화 경험을 구현하는 것이 핵심이다. 실제 환경 적용을 통한 인터페이스의 소멸과 고객 경험의 패러다임 변화를 주목해야

남편이 사진을 너무 못 찍어서… 전직 틱톡 직원들이 만든 AI 카메라 앱

남편이 사진을 너무 못 찍어서… 전직 틱톡 직원들이 만든 AI 카메라 앱

멜로디 추와 징 류 전직 틱톡 직원들이 컴퓨터 비전과 생성형 AI를 활용한 iOS 카메라 앱 'Superpose'를 출시하고 220만 달러의 투자를 받았다.

옷 사진만 보여주면 바로 쇼핑, 데이드림이 애플 인텔리전스 신기능 내놨다

옷 사진만 보여주면 바로 쇼핑, 데이드림이 애플 인텔리전스 신기능 내놨다

AI 기반 패션 디스커버리 앱 데이드림이 iOS 27 및 애플 인텔리전스를 활용한 사진 기반 쇼핑 및 시리 자연어 검색 기능을 선보였다.

Claude Code(Opus 5)가 짠 월드컵 대시보드, 왜 허술해 보일까

Claude Code(Opus 5)가 짠 월드컵 대시보드, 왜 허술해 보일까

바이브 코딩으로 제작한 대시보드의 시각적 한계와 디자인 개선 방향을 실험을 통해 분석한다.

실제 기업의 비공개 코드로 AI 코딩 성능을 평가한다

실제 기업의 비공개 코드로 AI 코딩 성능을 평가한다

Real-SWE는 최첨단 AI 코딩 모델을 실제 기업의 비공개 엔터프라이즈 코드베이스를 바탕으로 평가하는 새로운 벤치마크이다.

앤스로픽 대표 "최첨단 AI 발전 속도 스스로 늦춰야"

앤스로픽 대표 "최첨단 AI 발전 속도 스스로 늦춰야"

인공지능(AI) 선두 기업 앤스로픽(Anthropic)의 다리오 아모데이(Dario Amodei) 최고경영자(CEO)가 안전성 투자만으로는 부족하다며 AI 역량의 발전 속도를 자발적으로 늦추고 외부 감시관을 두자고 공식 제안했다. 이는 AI가 스스로

앤스로픽 대표, AI 개발 속도 늦추고 외부 감시관 회사에 들인다

앤스로픽 대표, AI 개발 속도 늦추고 외부 감시관 회사에 들인다

인공지능 선두 기업 앤스로픽의 CEO 다리오 아모데이가 AI 모델 고도화 속도를 늦추고 제3자 감시관을 기업 내부에 들여오겠다고 공식 선언했다. 이번 조치는 최근 급격한 기술 발전과 보안 사고에 대응하기 위한 것으로, 업계 내 자발적 규제와 정부의 역

테스트는 통과했지만… AI 코딩의 숨은 부실함 측정하는 기준 나왔다

테스트는 통과했지만… AI 코딩의 숨은 부실함 측정하는 기준 나왔다

AI 코딩 도구가 테스트를 통과하는 코드를 만들어내더라도 내부적으로 불필요한 중복과 나쁜 설계가 누적된다는 점을 객관적으로 평가하는 기준이 제시되었다. 요구사항을 단계적으로 추가하며 테스트를 반복하는 엄격한 평가에서 최첨단 모델의 해결률은 0%를 기록

최고급 AI 기술, 미국 소규모 연구소도 합법적으로 베껴 쓰게 해야

최고급 AI 기술, 미국 소규모 연구소도 합법적으로 베껴 쓰게 해야

미국 스타트업 액셀러레이터 Y컨비네이터의 최고경영자(CEO) 개리 탄이 미국 오픈소스 AI 연구소들도 최고급 폐쇄형 모델을 합법적으로 증류할 수 있어야 한다고 주장했다. 그는 최고급 모델들이 공공 데이터를 무단으로 학습해 만든 만큼, 인공지능 접근성이

필즈상 수상자 25명 "AI의 무분별한 난제 풀이, 수학의 본질 파괴한다"

필즈상 수상자 25명 "AI의 무분별한 난제 풀이, 수학의 본질 파괴한다"

필즈상 수상자 25명이 AI 기업들이 수학 난제를 무분별하게 해결하는 경쟁 방식에 우려를 표하며 성명을 발표했다. 이들은 AI가 내놓는 정답 위주의 결과물이 수학의 본질인 개념적 이해와 인간의 전달 과정을 파괴할 수 있다고 경고했다.