KO EN

AX BRIEF

매일 한 편, AI 업계를 읽는 칼럼

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 98 pt2. Gemini 4 Argon (high) 95 pt3. Claude Opus 5.5 (max with fallback) 94 pt4. Claude Sonnet 5.5 (max with fallback) 93 pt5. GPT-6 Astra (max) 90 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Fable 5.1 XHigh + SWE-2 Medium 88 pt3. GPT-6.1 Sol (xhigh) 69 pt4. Claude Sonnet 5.5 (max) 63 pt5. Claude Opus 5.5 (max) 63 pt이미지1. gpt-image-2.5-sunburst 85 pt2. gpt-image-2.5-flare 81 pt3. gpt-image-2 (medium) 78 pt4. grok-imagine-image-2.0 (canvas) 70 pt5. mai-image-2.6 70 pt비디오1. gemini-omni-1.1-flash 85 pt2. gemini-omni-flash 84 pt3. flux-3-video 81 pt4. grok-imagine-video-1.5-agent 81 pt5. dreamina-seedance-2.0-720p 79 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Opus 5.5 (max with fallback) 39 pt4. Claude Sonnet 5.5 (max with fallback) 19 pt5. Gemini 4 Argon (high) 19 pt속도1. Claude Haiku 5.5 (max) 100 pt2. DeepSeek V4.1 Flash (max) 87 pt3. Muse Spark 1.3 (max) 84 pt4. gpt-oss-120b (high) 71 pt5. Nemotron 3 Ultra 58 pt

AI 기술 블로그

엔지니어링·제품·전략 관점에서 기술 리더와 연구자들의 심층 인사이트를 큐레이션합니다.

Deep하드웨어 제약 없앤 범용 로봇 AI 'RLDX-1' 공개한 리얼월드

하드웨어 제약 없앤 범용 로봇 AI 'RLDX-1' 공개한 리얼월드

로봇이 물리적 환경을 이해하고 조작하는 피지컬 AI 시장이 빠르게 성장하고 있다. 리얼월드가 하드웨어에 구애받지 않는 범용 로보틱스 파운데이션 모델 'RLDX-1'을 공개했다. 5지 정밀 조작 기술과 크로스-엠바디먼트 구조를 통해 실제 산업 현장 적용

토큰 비용 0원, Gemma 4와 Claude Code로 구현하는 로컬 코딩 에이전트

토큰 비용 0원, Gemma 4와 Claude Code로 구현하는 로컬 코딩 에이전트

LLM API 비용 부담과 기업 코드 유출 우려가 로컬 에이전트 도입의 주된 걸림돌이었다. 구글이 Apache 2.0 라이선스로 공개한 Gemma 4 26B MoE는 툴 사용 벤치마크에서 86.4%를 기록했다. Ollama와 Claude Code를 연

Deep운전대 없는 로보택시, 안전은 '덧붙이는 것'이 아니라 '설계하는 것'

운전대 없는 로보택시, 안전은 '덧붙이는 것'이 아니라 '설계하는 것'

로보택시가 단순한 시범 운행을 넘어 상용화 단계로 진입했습니다. 안전 규제는 더 이상 성능만 보지 않고 시스템의 예측 가능성을 요구합니다. 엔비디아는 이를 위해 차량용 운영체제 Halos OS를 공개했습니다.

30명 1년 분량을 6명이 76일 만에 끝낸 아마존의 '프런티어 팀'

30명 1년 분량을 6명이 76일 만에 끝낸 아마존의 '프런티어 팀'

AI 코딩 도구를 써도 실제 배포 속도가 정체되는 병목 현상이 계속되고 있다. 아마존은 워크플로우를 재설계해 최대 10배의 생산성 향상을 기록한 '프런티어 팀'의 사례를 공개했다. 단순 코드 생성을 넘어 에이전트 중심의 목표 기반 개발 체계로 전환한

"수조 개 입자 추적" — 블랙홀 시뮬레이션 한계 뚫은 Codex 활용법

"수조 개 입자 추적" — 블랙홀 시뮬레이션 한계 뚫은 Codex 활용법

블랙홀 주변 플라즈마 시뮬레이션은 입자의 미세한 회전 경로를 모두 계산해야 하는 연산 부하가 컸다. 애리조나 대학의 치콴 찬 연구원은 Codex를 활용해 입자 궤적 추적 방식을 최적화하는 수학적 알고리즘 후보군을 빠르게 도출했다. AI가 제안한 수치

칩 설계 몰라도 Trainium 성능 끝까지 뽑아내는 AI 에이전트

칩 설계 몰라도 Trainium 성능 끝까지 뽑아내는 AI 에이전트

AI 모델이 커질수록 하드웨어 성능을 한계까지 쓰는 최적화 작업이 필수적이다. AWS가 Trainium과 Inferentia 전용 커널 개발을 돕는 'Neuron Agentic Development'를 공개했다. 코딩 에이전트가 NKI 커널 작성부터

"토큰 하나씩 안 쓴다" 구글이 공개한 4배 빠른 DiffusionGemma

"토큰 하나씩 안 쓴다" 구글이 공개한 4배 빠른 DiffusionGemma

LLM은 보통 단어를 하나씩 순차적으로 생성하며 속도 한계를 보입니다. 구글이 공개한 DiffusionGemma는 텍스트 블록 전체를 한 번에 찍어내 속도를 4배 높였습니다. 26B MoE 구조와 Apache 2.0 라이선스로 로컬 환경의 실시간 인터

개월 단위 로봇 학습을 시간 단위로, 엔비디아 Isaac Lab과 SageMaker AI의 결합

개월 단위 로봇 학습을 시간 단위로, 엔비디아 Isaac Lab과 SageMaker AI의 결합

물리 AI가 연구실을 넘어 실제 생산 현장으로 이동하며 고정밀 시뮬레이션의 중요성이 커졌다. 엔비디아 Isaac Lab과 아마존 SageMaker AI를 통해 Unitree H1 휴머노이드의 강화학습을 가속한다. 인프라 관리 부담을 없앤 하이퍼포드(H

토큰 1,000개/초 돌파, 엔비디아가 가속한 DiffusionGemma

토큰 1,000개/초 돌파, 엔비디아가 가속한 DiffusionGemma

대부분의 LLM은 한 단어씩 생성하는 순차적 방식으로 속도가 제한적이다. 구글 딥마인드의 DiffusionGemma는 텍스트 블록을 병렬로 생성해 지연 시간을 줄였다. 엔비디아 최적화 결과 H100 기준 초당 1,000토큰의 생성 속도를 구현했다.

"6개월 작업을 2주 만에" — LSEG, OpenAI로 금융 데이터 워크플로우 혁신

"6개월 작업을 2주 만에" — LSEG, OpenAI로 금융 데이터 워크플로우 혁신

글로벌 금융 인프라 기업 LSEG가 OpenAI 모델을 전사적으로 도입했다. 제품 출시 주기를 6개월에서 2주로 단축하며 리서치와 개발 속도를 높였다. Model Context Protocol을 통해 신뢰할 수 있는 금융 데이터와 AI를 결합했다.

코히어가 공개한 30B 코딩 모델 North Mini Code, 거대 모델 성능 추월

코히어가 공개한 30B 코딩 모델 North Mini Code, 거대 모델 성능 추월

코히어가 개발자 전용 첫 모델인 North Mini Code를 공개했다. 30B 파라미터 MoE 구조로 에이전트 기반 소프트웨어 엔지니어링에 최적화했다. 120B급 거대 모델을 제치고 코딩 벤치마크 상위권에 진입했다.

DeepKAIST, 영상 몇 개로 로봇 판단력 학습시키는 기술 개발

KAIST, 영상 몇 개로 로봇 판단력 학습시키는 기술 개발

KAIST 연구팀이 수천 건의 평가 데이터 없이 영상 몇 개만으로 AI가 인간의 선호를 학습하는 VOTP 기술을 공개했다. ICML 2026에서 상위 0.7% 구두 발표로 채택됐으며, 로봇·자율주행의 학습 비용을 획기적으로 줄일 수 있다. 피지컬 AI

Deep장애 대응 10분 단축, Amazon Quick으로 구현하는 자동 트리아지 에이전트

장애 대응 10분 단축, Amazon Quick으로 구현하는 자동 트리아지 에이전트

Amazon Quick과 New Relic을 연동해 장애 조사부터 보고서 작성까지 자동화합니다. 단 하나의 프롬프트로 근본 원인 분석(RCA)을 생성하고 Asana 티켓까지 생성합니다. 수동 데이터 수집 과정을 제거하여 온콜 엔지니어의 업무 부담을

구글, 톤·억양 유지하는 '제미나이 3.5 라이브 번역' 공개

구글, 톤·억양 유지하는 '제미나이 3.5 라이브 번역' 공개

실시간 음성 번역은 그동안 화자가 말을 끝낼 때까지 기다려야 하는 정적이 불가피했다. 구글이 70개 이상의 언어를 지원하며 화자의 톤과 속도를 그대로 유지하는 제미나이 3.5 라이브 번역을 출시했다. API 공개를 통해 외부 앱 구축이 가능하며 구글

개발 속도가 너무 빨라 전략이 병목이 된 Nextdoor의 Codex 활용법

개발 속도가 너무 빨라 전략이 병목이 된 Nextdoor의 Codex 활용법

AI 코딩 도구는 이제 단순한 코드 작성을 넘어 제품 전체를 설계하는 단계로 진입했다. Nextdoor는 Codex와 GPT-5.5를 도입해 3개 팀이 협업하던 기능을 엔지니어 한 명이 끝까지 구현한다. 기술적 구현보다 '무엇을 만들 것인가'라는 전략

젠슨 황이 주목한 피지컬 AI, 씨메스로보틱스가 구현한 풀스택 전략

젠슨 황이 주목한 피지컬 AI, 씨메스로보틱스가 구현한 풀스택 전략

AI가 화면 속 데이터를 넘어 실제 물리 세계에서 움직이는 '피지컬 AI' 시대가 열리고 있다. 씨메스로보틱스는 엔비디아의 B200, H100 GPU와 아이작 심(Isaac Sim)을 활용해 로봇 자동화 솔루션을 구축했다. 트리톤 인퍼런스 서버와 젯슨

Deep2개월 분량 코딩을 하루 만에—앤스로픽, 클로드 Fable 5 공개

2개월 분량 코딩을 하루 만에—앤스로픽, 클로드 Fable 5 공개

앤스로픽이 미토스급 성능을 일반 공개한 Claude Fable 5를 출시, SWE-bench Pro에서 GPT-5.5(58.6%)를 압도하는 80.3%를 기록했다. 스트라이프는 5,000만 줄 루비 코드 마이그레이션을 단 하루 만에 완료, 수작업 팀

DeepSDK 설치 없이 3D 갤러리 완성, 허깅페이스 'agents.md'가 바꾼 개발 문법

SDK 설치 없이 3D 갤러리 완성, 허깅페이스 'agents.md'가 바꾼 개발 문법

AI 에이전트가 이미지 생성부터 3D 복원, 웹 배포까지 전 과정을 스스로 수행했다. 허깅페이스 Spaces의 'agents.md'가 모델 호출 규격을 표준화해 에이전트의 조립 능력을 극대화했다. 별도 라이브러리 없이 모델들을 체이닝하여 복잡한 멀티미

"돌연변이보다 세포 상태" — MS가 암 치료 정밀도를 높이는 법

"돌연변이보다 세포 상태" — MS가 암 치료 정밀도를 높이는 법

암 치료는 그동안 세포 내 돌연변이 분석을 통해 약물을 매칭해 왔다. 마이크로소프트는 돌연변이가 같아도 반응이 다른 이유가 '세포 상태'에 있음을 밝혔다. Nature Methods에 발표된 이번 연구는 데이터 양보다 행동 다양성이 AI 성능을 결정함

제미나이 모델 입힌 유럽 로봇 15곳, 구글 딥마인드가 키운다

제미나이 모델 입힌 유럽 로봇 15곳, 구글 딥마인드가 키운다

AI가 디지털 세상을 넘어 물리적 세계로 확장되고 있다. 구글 딥마인드가 유럽의 초기 단계 로봇 스타트업 15곳을 선정해 3개월간 육성한다. 선정 기업은 제미나이(Gemini) 로봇 모델과 구글의 AI 스택을 활용해 상용화를 가속한다.

Deep자바스크립트 없이 웹을 완성하는 10가지 파이썬 프레임워크

자바스크립트 없이 웹을 완성하는 10가지 파이썬 프레임워크

파이썬은 데이터 분석을 넘어 웹 애플리케이션 개발의 핵심 도구로 자리 잡았다. 프론트엔드 지식 없이도 API부터 대시보드까지 구현 가능한 라이브러리가 늘고 있다. 실무 목적에 따라 최적화된 10가지 파이썬 기반 웹 프레임워크를 정리했다.

프롬프트 복붙 끝내는 앤스로픽의 '클로드 스킬' 공개

프롬프트 복붙 끝내는 앤스로픽의 '클로드 스킬' 공개

매번 새로운 채팅창에 스타일 가이드와 도메인 지식을 다시 입력해야 하는 번거로움이 있었다. 앤스로픽은 특정 작업 시 지침을 자동 로드하는 폴더 기반 시스템 '클로드 스킬'을 출시했다. 공식 저장소는 14만 개 이상의 별을 기록하며 AI 워크플로우 자산

"권한 오류 끝났다" — 아마존 퀵, ARN 체계로 마이그레이션 가속

"권한 오류 끝났다" — 아마존 퀵, ARN 체계로 마이그레이션 가속

AWS 계정 간 대시보드 이동 시 권한 설정이 초기화되는 고질적 문제가 있었다. 아마존 퀵은 ARN 구조 최적화와 에셋 번들 API로 리소스 참조를 자동 업데이트한다. 네임스페이스 기반 식별 체계를 통해 SaaS 기업의 멀티테넌트 격리 구현이 쉬워진다

데이터 복호화 없이 AI 추론 완료, AWS SageMaker의 동형암호(FHE) 적용

데이터 복호화 없이 AI 추론 완료, AWS SageMaker의 동형암호(FHE) 적용

클라우드 AI 추론 시 민감 데이터의 복호화 과정에서 발생하는 보안 리스크가 상존한다. Amazon Web Services(AWS)는 concrete-ml 라이브러리를 통해 데이터가 암호화된 상태로 연산되는 동형암호(FHE) 추론을 SageMaker

Deep규제는 지키고 속도는 높였다, AWS Bedrock '교차 리전 추론' 도입

규제는 지키고 속도는 높였다, AWS Bedrock '교차 리전 추론' 도입

AI 모델을 쓸 때 특정 지역 서버가 꽉 차면 응답이 느려지거나 끊깁니다. AWS Bedrock이 여러 지역의 자원을 자동 분배하는 '교차 리전 추론(CRIS)'을 제공합니다. 특히 EU 전용 프로필을 통해 데이터 규정을 준수하며 최적의 성능을 낼 수

"아마존 물류비 수천만 달러 절감" 예측 AI를 결정 AI로 바꾼 수학적 최적화

"아마존 물류비 수천만 달러 절감" 예측 AI를 결정 AI로 바꾼 수학적 최적화

기업의 복잡한 운영 결정은 직관이나 단순 규칙만으로 최적해를 찾기 어렵다. AWS는 확률적 예측을 넘어 수학적 확신을 주는 '연역적 AI'인 수학적 최적화를 제시한다. BMW 로봇 사이클 타임 10% 개선, 딜리버리히어로 물류비 24% 절감 등 실질적

2028년까지 AI가 연구하는 시대, OpenAI가 선언한 '개인용 AGI' 보급 계획

2028년까지 AI가 연구하는 시대, OpenAI가 선언한 '개인용 AGI' 보급 계획

AI를 전기와 같은 보편적 인프라로 전환해 모든 개인에게 보급한다. OpenAI는 연구-제품 단계를 넘어 AI의 풍요와 저렴한 보급을 뜻하는 '3단계'에 진입한다. 2028년 3월까지 내부 연구의 상당 부분을 AI 시스템이 직접 수행하는 체계를 구축한

마이크 없이 끝내는 음성 AI 검증 — 아마존 노바 소닉 테스트 하네스 공개

마이크 없이 끝내는 음성 AI 검증 — 아마존 노바 소닉 테스트 하네스 공개

음성 AI 에이전트의 성능을 확인하려면 사람이 직접 말하고 들어야 하는 수동 테스트의 한계가 있었다. 아마존이 노바 소닉(Nova Sonic)을 위해 마이크 없이 대화를 자동 수행하고 평가하는 오픈소스 프레임워크를 공개했다. LLM 판정 모델을 통해

OpenAI, AI 경제 영향 검증 위해 외부 연구 플랫폼 '리서치 익스체인지' 공개

OpenAI, AI 경제 영향 검증 위해 외부 연구 플랫폼 '리서치 익스체인지' 공개

AI가 노동 시장과 기업 운영 방식을 빠르게 바꾸고 있다. OpenAI가 외부 연구자와 협력해 AI의 경제적 효과를 분석하는 '리서치 익스체인지'를 출시했다. 선정된 연구자는 OpenAI의 도구와 데이터를 활용해 독립적인 실증 증거를 도출한다.

노트북 닫아도 멈추지 않는 코딩 에이전트, 아마존 베드락 에이전트코어 공개

노트북 닫아도 멈추지 않는 코딩 에이전트, 아마존 베드락 에이전트코어 공개

코딩 에이전트를 로컬 노트북에서 실행하며 겪던 전원 및 환경 제약 문제를 해결한다. 아마존 베드락 에이전트코어는 격리된 microVM과 영구 워크스페이스를 제공하는 전용 런타임이다. 모델에 상관없이 MCP 엔드포인트를 통해 도구 연결과 기업급 보안,