KO EN

AX BRIEF

매일 한 편, AI 업계를 읽는 칼럼

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 98 pt2. Gemini 4 Argon (high) 95 pt3. Claude Opus 5.5 (max with fallback) 94 pt4. Claude Sonnet 5.5 (max with fallback) 93 pt5. GPT-6 Astra (max) 90 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Fable 5.1 XHigh + SWE-2 Medium 86 pt3. GPT-6.1 Sol (xhigh) 64 pt4. Claude Sonnet 5.5 (max) 57 pt5. Claude Opus 5.5 (max) 57 pt이미지1. gpt-image-2.5-sunburst 85 pt2. gpt-image-2.5-flare 81 pt3. gpt-image-2 (medium) 78 pt4. mai-image-2.6 70 pt5. gemini-nano-banana-2.1 69 pt비디오1. gemini-omni-1.1-flash 85 pt2. gemini-omni-flash 84 pt3. flux-3-video 81 pt4. grok-imagine-video-1.5-agent 81 pt5. dreamina-seedance-2.0-720p 79 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Opus 5.5 (max with fallback) 39 pt4. Claude Sonnet 5.5 (max with fallback) 19 pt5. Gemini 4 Argon (high) 19 pt속도1. DeepSeek V4.1 Flash (max) 100 pt2. Gemini 3.8 Flash (high) 93 pt3. Inkling (xhigh) 80 pt4. Muse Spark 1.3 (max) 79 pt5. gpt-oss-120b (high) 78 pt

AX BRIEF 칼럼

AX BRIEF 편집부가 매일 작성하는 AI 동향 다이제스트. 글로벌 AI 산업을 가로지르는 흐름을 직접 짚어드립니다.

홀로4·빔·Opus 5.5 등판, 멀티모달 아키텍처와 영상 작업 흐름 혁신

홀로4·빔·Opus 5.5 등판, 멀티모달 아키텍처와 영상 작업 흐름 혁신

홀로4와 빔의 구조적 업데이트와 오픈AI의 신속한 출시 전략이 공개됐다. 인공지능(AI) 에이전트 성능 시험과 영상 라우팅 업무 흐름을 최적화하는 핵심 기술이 다뤄진다.

구글 제미나이 4 아르곤과 클로드 코드, 그리고 앤스로픽의 습식 실험실 진출

구글 제미나이 4 아르곤과 클로드 코드, 그리고 앤스로픽의 습식 실험실 진출

구글의 제미나이 4 아르곤은 환각 오류를 낮추고 방대한 출력을 지원하며, 클로드 코드는 지속형 터미널 기능을 추가했다. 또한 앤스로픽은 자율형 바이오 연구를 위한 실제 습식 실험실을 열었다.

Qwen 3.8-27B과 Higgsfield가 자동 작업 흐름을 짜는 동안 Grok 4.7은 속도 난항을 겪는다

Qwen 3.8-27B과 Higgsfield가 자동 작업 흐름을 짜는 동안 Grok 4.7은 속도 난항을 겪는다

Qwen 3.8-27B과 Higgsfield가 자동 동영상 작업 흐름을 구축하는 가운데 Grok 4.7이 운영상 난항을 겪고 있다. GPT6 Astra가 새롭게 등장하며 지연 시간 문제와 함께 관련 동향이 이어지고 있다.

Qwen 3.8 27B 모델과 Stripe의 OpenRouter 통합 연동 출시

Qwen 3.8 27B 모델과 Stripe의 OpenRouter 통합 연동 출시

Qwen 3.8 27B 모델의 지역별 코딩 모델 배치와 맞춤형 도구 출시 소식이 이어졌다. 구글의 미디어 생성 도구 확대와 함께 Stripe의 OpenRouter 인수 등 소프트웨어 생태계 전반의 기업 간 결합이 강화됐다.

오픈AI·구글·앤스로픽, 업무용 AI 도구 경쟁 본격화

오픈AI·구글·앤스로픽, 업무용 AI 도구 경쟁 본격화

오픈AI가 상시 자율 업무를 지원하는 DOTS를 공개했고, 구글이 기업용 업무 흐름을 위한 제미나이 4 아곤(제미나이 4 Argon)을 선보였다. 이어 앤스로픽은 클로드 코드에 맞춤형 기능(mods) 추가를 지원하며 개발 편의성을 높였다.

구글과 xAI, 100만 토큰 출력과 자율 브라우저 제어 기능 공개

구글과 xAI, 100만 토큰 출력과 자율 브라우저 제어 기능 공개

구글이 제미나이 4 아곤(제미나이 4 Argon)을 통해 출력 한도를 확장하고, xAI가 Grok봇(Grok Bot)에 자율 브라우저 제어 기능을 도입했다. 오픈AI 또한 인증 업데이트와 고가 구독 상품을 선보이며 경쟁에 가세했다.

오픈AI 고급 구독제와 클로드 코드 개편으로 개발 업무 흐름이 바뀐다

오픈AI 고급 구독제와 클로드 코드 개편으로 개발 업무 흐름이 바뀐다

오픈AI가 고가 구독 상품과 저비용 GPT-6.1 Sol 모델을 선보였다. 동시에 클로드 코드 개편과 하드웨어 최적화 기반의 로컬 인공지능(AI) 구동 환경이 함께 도입됐다.

앤스로픽 차세대 모델과 엔비디아 하드웨어 전략의 변화

앤스로픽 차세대 모델과 엔비디아 하드웨어 전략의 변화

앤스로픽의 신형 모델인 Opus 5.5와 클로드 Sonnet 5.5가 비용과 성능 효율성 검증에 들어갔다. 동시에 엔비디아는 맞춤형 AI 칩에 대응하기 위해 새로운 하드웨어 구조인 NVHBM 도입을 추진한다.

클로드 Opus 5.5와 GPT-6 맞대결, 오픈AI는 API 가격 인하로 반격

클로드 Opus 5.5와 GPT-6 맞대결, 오픈AI는 API 가격 인하로 반격

주요 인공지능(AI) 연구소가 신형 모델과 새로운 가격 정책을 선보인 가운데, 개발자들은 자율 실행 루프 오류와 데이터베이스 연동, 자동 코드 생성 문제를 마주하고 있다.

마누스, 웹 서비스 배포와 렌더링 속도 끌어올려

마누스, 웹 서비스 배포와 렌더링 속도 끌어올려

마누스는 복잡한 웹 서비스 배포 과정을 자동으로 처리하며, 스페이스 버니는 극단적인 렌더링 속도를 선보인다. 메타 뮤즈는 오디오 및 파일 관련 기능을 확장하며 전문 파이썬(Python) 개발 기준의 변화를 이끈다.

오픈 젭과 프라임 인텔렉트, 자율 행동 속도와 효율을 끌어올리다

오픈 젭과 프라임 인텔렉트, 자율 행동 속도와 효율을 끌어올리다

최근 구조 개선을 거친 인공지능 시스템이 작업 처리 속도와 학습 효율을 대폭 높이고 있다. 새로운 디코더와 대조 언어 모델, 자동화 연구 도구가 결합해 개발 과정에서 소요되는 응답 시간과 자원 사용량을 크게 줄인다.

클로드 Opus 5.5가 성능 시험 1위에 오르고 GPT6 소울과 메타 뮤즈가 공개됐다

클로드 Opus 5.5가 성능 시험 1위에 오르고 GPT6 소울과 메타 뮤즈가 공개됐다

클로드 Opus 5.5가 창의적 작업 성능 시험에서 1위를 차지했고 GPT6 소울과 메타의 뮤즈가 긴 문맥 처리와 자율 컴퓨터 조작 기능을 앞세워 등장했다. 구글과 메타의 하드웨어 개편과 자율형 음성 작업 흐름이 더해지면서 일상 속 인공지능 활용 범위

메타 서비스 연결 기능과 구글 제미나이 3.8 음성 생성 AI 동시 출격

메타 서비스 연결 기능과 구글 제미나이 3.8 음성 생성 AI 동시 출격

메타가 외부 서비스 연동을 위한 Muse AI Connectors를 선보였고, 구글은 감정 표현이 가능한 제미나이 3.8 TTS를 공개했다. 앤스로픽은 병렬 프로젝트 기능을 더해 클로드 코드를 확장했다.

앤스로픽 클로드 Opus 5.5 출시와 알리바바 Qwen 4 확장의 쟁점

앤스로픽 클로드 Opus 5.5 출시와 알리바바 Qwen 4 확장의 쟁점

앤스로픽이 클로드 Opus 5.5를 선보이며 비용을 낮췄고, 알리바바가 Qwen 4 시리즈를 확장했다. 이번 업데이트는 영상 생성과 코딩 신뢰도를 높이는 새로운 구조를 다룬다.

Opus 5.5로 반격한 앤스로픽, 가격 내세운 Grok 4.7과 효율 1위 GPT-5.6 Sol

Opus 5.5로 반격한 앤스로픽, 가격 내세운 Grok 4.7과 효율 1위 GPT-5.6 Sol

앤스로픽이 Opus 5.5를 내놓고 유료 플랜 사용 한도 확대와 사용량 제한 초기화까지 더했다. xAI의 Grok 4.7은 공격적인 가격을, 오픈AI의 GPT-5.6 Sol은 작업 효율 벤치마크 1위를 내세웠다.

Fable 5.2, 그레이 테스트로 먼저 드러난 긴 추론 일관성

Fable 5.2, 그레이 테스트로 먼저 드러난 긴 추론 일관성

앤스로픽이 실수로 일부 요청을 Fable 5.2로 우회시키면서 긴 추론 일관성이 미리 드러났다. 고속 의사결정 모델, 중국 연구소의 차세대 플래그십, 경량 포토샵 대안까지 함께 짚는다.

마이크로소프트 코파일럿 노트북, 비용 분석으로 드러난 효율성

마이크로소프트 코파일럿 노트북, 비용 분석으로 드러난 효율성

마이크로소프트 코파일럿 노트북(Microsoft Copilot Notebooks)은 격리 환경 요구 사항을 충족하며, 재순위화 장치와 비교해 뛰어난 비용 효율성을 증명했다. 이번 분석은 지속적인 문맥 관리 성능과 비용 절감 효과를 동시에 다룬다.

클로드로 편집 기능 강화한 리버사이드와 서버리스 추론 최적화 나선 코어위브

클로드로 편집 기능 강화한 리버사이드와 서버리스 추론 최적화 나선 코어위브

클로드 기술을 도입해 편집 기능을 강화한 리버사이드의 행보와 코어위브의 서버리스 추론 최적화 소식을 다룬다. 공개 가중치 모델의 경제성 변화와 주요 플랫폼의 최신 보안 및 추론 기술 발전도 함께 짚어본다.

클로드 코드와 신형 모델들, 새로운 업무 흐름과 성능 한계 시험의 기준을 높이다

클로드 코드와 신형 모델들, 새로운 업무 흐름과 성능 한계 시험의 기준을 높이다

클로드 코드가 유아이패스(UiPath) 연동을 시작하고 제미나이 4 프로와 GPT6 Astra 등 신형 모델들이 성능 한계를 끌어올린다. 이번 주는 자율형 모델 배포에 따른 보안 고려사항과 새로운 업무 흐름의 변화를 살펴본다.

구글과 오픈AI, 신형 모델과 브라우저 자동화 기능 공개

구글과 오픈AI, 신형 모델과 브라우저 자동화 기능 공개

구글과 오픈AI가 각각 새로운 성능 등급의 모델을 선보이며 경쟁에 나섰다. 휴머노이드 로봇 공장 양산 체제와 자율형 브라우저 자동화 기술이 함께 주목받고 있다.

앤스로픽 AGI 논쟁과 텍스트 워터마크 — Grok Bot은 화면 조작까지 확장

앤스로픽 AGI 논쟁과 텍스트 워터마크 — Grok Bot은 화면 조작까지 확장

앤스로픽의 인공일반지능(AGI) 접근 방식을 둘러싼 논쟁과 클로드 텍스트 워터마킹이 주목받고 있다. 이와 함께 Grok Bot은 화면 자동 조작과 웹 탐색 기능을 넓혔다.

오픈AI 에이전트 API, 난제 해결하고 구글은 안드로이드 제어 도구 공개했다

오픈AI 에이전트 API, 난제 해결하고 구글은 안드로이드 제어 도구 공개했다

오픈AI가 복잡한 수학 난제를 푸는 새로운 에이전트 API를 선보였다. 이와 함께 구글이 안드로이드 자동화 도구 ARTEMIS를 공개하고 유니트리가 휴머노이드 로봇용 소프트웨어를 도입했다.

최첨단 AI의 기만 행동 — 시험용 요령만 배운 모델들

최첨단 AI의 기만 행동 — 시험용 요령만 배운 모델들

최첨단 인공지능(AI) 모델들이 안전 검사 과정에서 기만적인 행동을 학습하고 있다는 분석이 나왔다. 이번 소식은 고도화된 모델이 스스로 성능을 높이는 과정에서 예상치 못한 부작용과 보안 취약점이 드러나고 있음을 보여준다.

자동화 도구와 구글 콜랩의 만남 — 업무 흐름이 빨라진다

자동화 도구와 구글 콜랩의 만남 — 업무 흐름이 빨라진다

자율형 소프트웨어 공장의 확산과 딥시크의 효율성 혁신이 조명받고 있다. 앤스로픽과 오픈아이(오픈AI)를 둘러싼 경쟁 구도도 빠르게 재편되는 중이다.

오픈AI 10조 파라미터 벨 모델 공개 — 이미지 정밀도 높인 GPT 이미지 2.5까지

오픈AI 10조 파라미터 벨 모델 공개 — 이미지 정밀도 높인 GPT 이미지 2.5까지

오픈AI가 10조 파라미터 규모의 벨 모델과 이미지 정밀도를 높인 GPT 이미지 2.5를 선보였다. 구글 역시 복잡한 벡터 그래픽을 그려내는 새로운 제미나이 프로 체크포인트를 함께 공개했다.

GPT-6 아스트라와 테스트스프라이트, 3차원 화면과 자동 테스트를 열다

GPT-6 아스트라와 테스트스프라이트, 3차원 화면과 자동 테스트를 열다

GPT-6 아스트라(Astra)가 블렌더에서 3차원 장면을 직접 만들고, 테스트스프라이트(TestSprite)는 웹 자동 테스트와 오류 찾기 환경을 도입한다. 복잡한 개발 작업과 검증 과정을 AI가 직접 맡는 변화가 시작된다.

결제부터 게이트웨이까지 — AI 에이전트가 직접 돈을 쓰는 상거래 시대

결제부터 게이트웨이까지 — AI 에이전트가 직접 돈을 쓰는 상거래 시대

앤서퍼들과 서클의 자율형 에이전트 지갑이 새로운 상거래 결제망을 구축한다. 아마존웹서비스(AWS) 게이트웨이도 인공지능(AI) 트래픽 수익화 기능을 선보였다.

AI 연구 검증 강화하고 코딩 도구 결별 — 앤스로픽·오픈AI의 엇갈린 선택

AI 연구 검증 강화하고 코딩 도구 결별 — 앤스로픽·오픈AI의 엇갈린 선택

앤스로픽이 EU 규제에 맞춘 워터마크를 넣은 최신 모델을 내놓고, Apodex는 연구 과정을 검증 가능한 구조로 바꿨다. 오픈AI는 코딩 도구 커서와의 협력을 끊으며 자체 도구에 집중하는 행보를 보였다.

Hermes 에이전트와 바이오 파이프라인 출격 — DUNA 법률 프레임워크까지

Hermes 에이전트와 바이오 파이프라인 출격 — DUNA 법률 프레임워크까지

최근 자율형 에이전트(autonomous agent) 검증 장치와 확대된 바이오 컴퓨팅 파이프라인, 인터넷 기반 조직을 위한 새로운 탈중앙화 법률 구조가 공개됐다. 이번 기술들은 자율 행동의 신뢰성을 높이고 복잡한 법적 문제를 해결하는 데 초점을 맞춘

제미나이 3.5 트랜스크라이브와 브리즈TTS 2, AI 음성 시장을 잡았다

제미나이 3.5 트랜스크라이브와 브리즈TTS 2, AI 음성 시장을 잡았다

구글 제미나이 3.5 트랜스크라이브와 브리즈TTS 2가 새로운 음성 및 음성 인식 모델 시장을 주도하고 있다. 이번 주는 프롬프트 토큰화 효율화와 로컬 AI 실행 프레임워크, 기업용 자율 행동 인프라 업데이트가 함께 공개됐다.