KO EN

AX BRIEF

매일 한 편, AI 업계를 읽는 칼럼

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 98 pt2. Gemini 4 Argon (high) 95 pt3. Claude Opus 5.5 (max with fallback) 94 pt4. Claude Sonnet 5.5 (max with fallback) 93 pt5. GPT-6 Astra (max) 90 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Fable 5.1 XHigh + SWE-2 Medium 88 pt3. GPT-6.1 Sol (xhigh) 69 pt4. Claude Sonnet 5.5 (max) 63 pt5. Claude Opus 5.5 (max) 63 pt이미지1. gpt-image-2.5-sunburst 85 pt2. gpt-image-2.5-flare 81 pt3. gpt-image-2 (medium) 78 pt4. grok-imagine-image-2.0 (canvas) 70 pt5. mai-image-2.6 70 pt비디오1. gemini-omni-1.1-flash 85 pt2. gemini-omni-flash 84 pt3. flux-3-video 81 pt4. grok-imagine-video-1.5-agent 81 pt5. dreamina-seedance-2.0-720p 79 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Opus 5.5 (max with fallback) 39 pt4. Claude Sonnet 5.5 (max with fallback) 19 pt5. Gemini 4 Argon (high) 19 pt속도1. Claude Haiku 5.5 (max) 100 pt2. DeepSeek V4.1 Flash (max) 90 pt3. Muse Spark 1.3 (max) 84 pt4. gpt-oss-120b (high) 68 pt5. Nemotron 3 Ultra 56 pt

AI 기술 블로그

엔지니어링·제품·전략 관점에서 기술 리더와 연구자들의 심층 인사이트를 큐레이션합니다.

DeepLLM에 '하네스'를 입혀야 에이전트가 된다, 용어의 재정의

LLM에 '하네스'를 입혀야 에이전트가 된다, 용어의 재정의

AI 에이전트를 구성하는 하네스와 스캐폴드의 개념적 차이를 분석한다. 모델 단독으로는 불가능한 루프 실행과 도구 호출의 작동 원리를 설명한다. 단순한 텍스트 생성을 넘어 행동하는 시스템으로 진화하는 구조를 다룬다.

앤스로픽, 바티칸서 AI 모델 내 '공포·슬픔' 상태 발견 시인

앤스로픽, 바티칸서 AI 모델 내 '공포·슬픔' 상태 발견 시인

교황 레오 14세가 AI 시대의 인간 보호를 위한 회칙 'Magnifica humanitas'를 발표했다. 앤스로픽 공동창업자 크리스 올라는 AI 모델 내부에서 인간의 감정과 유사한 상태가 발견됨을 밝혔다. 앤스로픽은 KPMG와 글로벌 동맹을 체결하고

가상 데이터로 AI 모델의 편향성을 검증하는 Mimesis의 방식

가상 데이터로 AI 모델의 편향성을 검증하는 Mimesis의 방식

Mimesis는 가상 데이터를 생성해 AI 모델의 편향성을 감사하는 오픈소스 라이브러리다. 동일 조건에서 특정 속성만 바꾼 대조군 데이터를 생성해 모델의 차별 여부를 판별한다. 민감한 실제 데이터 노출 없이 모델의 공정성을 검증할 수 있는 실무적 대안

Deep로보터블, F&B 특화 양팔 휴머노이드 '제스트' 공개

로보터블, F&B 특화 양팔 휴머노이드 '제스트' 공개

로보터블이 2026 NRA 쇼에서 조리 특화 휴머노이드 플랫폼 '제스트'를 선보였다. VLA 모델과 멀티모달 센서를 결합해 실시간 환경 인식 기반의 조리 동작을 구현했다. 실제 주방 데이터 수집 루프를 통해 기존 시뮬레이션의 한계를 극복하는 전략을 취

±0.1mm 정밀 조립까지—엘리트로봇, 휠형 휴머노이드 '센토르 G1' 공개

±0.1mm 정밀 조립까지—엘리트로봇, 휠형 휴머노이드 '센토르 G1' 공개

엘리트로봇이 정밀 제조 특화 휠형 휴머노이드 '센토르 G1'을 발표했다. ±0.1mm 반복 정밀도와 6축 힘 센서로 광모듈 조립 등 초정밀 작업이 가능하다. 전용 임바디드 모델 '위안치 프리모'를 탑재해 자율 이동과 3D 맵핑을 수행한다.

AI 에이전트 보안의 핵심, MCP 인증 플랫폼 선택 가이드

AI 에이전트 보안의 핵심, MCP 인증 플랫폼 선택 가이드

MCP가 산업 표준으로 자리 잡으며 에이전트 보안이 필수 인프라로 부상했다. 워크OS, 스티치, 옥타 등 주요 인증 플랫폼의 MCP 지원 전략을 분석했다. 기업의 기존 환경과 에이전트 확장성에 따른 최적의 솔루션 선택 기준을 제시한다.

DeepWorkOS, 에이전트 등록 표준 'auth.md' 공개

WorkOS, 에이전트 등록 표준 'auth.md' 공개

WorkOS가 AI 에이전트 전용 등록 프로토콜인 auth.md를 발표했다. 마크다운 기반 표준 파일을 통해 에이전트가 스스로 서비스에 등록한다. API 키 공유 방식의 보안 취약점을 해결하고 ID-JAG 기반 검증을 제안한다.

DeepLangfuse, LLM 트레이싱부터 평가까지 통합 파이프라인 구현

Langfuse, LLM 트레이싱부터 평가까지 통합 파이프라인 구현

Langfuse(오픈소스 LLM 엔지니어링 플랫폼) 기반의 관측성 및 평가 파이프라인 구축법을 분석한다. 트레이싱, 프롬프트 관리, 스코어링, 데이터셋 실험을 아우르는 전체 워크플로우를 구현한다. OpenAI API 키 없이도 모의 LLM을 통해 파이

Deep음성 감정까지 읽어내는 엔드투엔드 모델, 스텝오디오 2.5 리얼타임 공개

음성 감정까지 읽어내는 엔드투엔드 모델, 스텝오디오 2.5 리얼타임 공개

상하이 AI 연구소 스텝펀이 실시간 음성 대화 모델인 스텝오디오 2.5 리얼타임을 발표했다. 기존 파이프라인 방식과 달리 음성 입출력을 단일 모델로 통합해 지연 시간을 획기적으로 줄였다. 특히 비언어적 음향 정보를 분석해 화자의 감정과 의도까지 파악하

좌표 찍기 대신 코딩한다, MS Webwright가 끌어올린 웹 에이전트 성능 60.1%

좌표 찍기 대신 코딩한다, MS Webwright가 끌어올린 웹 에이전트 성능 60.1%

마이크로소프트 리서치가 터미널 기반 웹 에이전트 프레임워크 Webwright를 공개했다. 브라우저를 직접 조작하는 대신 자동화 코드를 작성해 실행하는 방식으로 추론 효율을 높였다. Odysseys 벤치마크에서 기존 최고 기록을 35.1% 경신하며 60

NVIDIA, Gated DeltaNet-2 공개... 선형 어텐션의 '삭제-쓰기' 분리

NVIDIA, Gated DeltaNet-2 공개... 선형 어텐션의 '삭제-쓰기' 분리

NVIDIA가 선형 어텐션의 메모리 편집 병목을 해결한 Gated DeltaNet-2를 공개했다. 기존 스칼라 게이트를 채널별 삭제 및 쓰기 게이트로 분리해 정보 손실을 최소화했다. Mamba-3 등 경쟁 모델 대비 롱컨텍스트 리트리벌 성능에서 우위를

토큰 61% 줄이고 성능 높인 텐센트의 '4단계 메모리' 공개

토큰 61% 줄이고 성능 높인 텐센트의 '4단계 메모리' 공개

텐센트가 AI 에이전트의 컨텍스트 비대화 문제를 해결하는 4단계 메모리 시스템을 공개했다. 대화 내용을 피라미드 구조로 압축해 저장하며, 불필요한 로그를 외부 파일로 오프로딩한다. WideSearch 기준 토큰 사용량을 61% 줄이면서도 통과율을 33

Deep마크다운 기반 프롬프트 구조화 레이어 'SuperClaude' 프레임워크 공개

마크다운 기반 프롬프트 구조화 레이어 'SuperClaude' 프레임워크 공개

Anthropic API 위에 마크다운 기반의 커맨드와 에이전트를 결합한 SuperClaude 프레임워크가 공개되었다. 파이썬 브리지를 통해 시스템 프롬프트를 동적으로 구성하며 세션 저장 및 로드 기능을 지원한다. 단순 챗봇을 넘어 코딩, 보안 분석,

Deep모델 가중치 수정 없이 거부 반응 제어하는 CNA 기법 공개

모델 가중치 수정 없이 거부 반응 제어하는 CNA 기법 공개

Nous Research가 특정 MLP 뉴런을 식별해 모델의 거부 반응을 조절하는 CNA를 발표했다. SAE 학습이나 가중치 수정 없이 뉴런 활성화 차이만으로 모델의 행동을 정밀하게 제어한다. Llama와 Qwen 모델에서 거부율을 50% 이상 낮추면

Deep재난 현장 투입된 현대차 무인소방로봇, 붕괴 건물 진입 성공

재난 현장 투입된 현대차 무인소방로봇, 붕괴 건물 진입 성공

현대차그룹이 2026 안전한국훈련에서 무인소방로봇을 실전 투입했다. 지진으로 인한 건물 붕괴 상황에서 로봇이 진입해 화재 진압을 수행했다. 민관 협력을 통해 재난 대응 역량을 강화하겠다는 의지를 밝혔다.

Deep가리 탄, AI 에이전트 기억력 높이는 오픈소스 메모리 'GBrain' 공개

가리 탄, AI 에이전트 기억력 높이는 오픈소스 메모리 'GBrain' 공개

Y Combinator의 가리 탄이 지식 그래프 기반 메모리 레이어 GBrain을 공개했다. 마크다운과 PGLite를 결합해 검색 정밀도를 기존 대비 31.4%p 끌어올렸다. MCP를 통해 클로드 코드 등 주요 AI 에이전트 도구와 즉시 연동 가능하다

DeepPerplexity, 개발자 PC 공급망 스캐너 'Bumblebee' 오픈소스 공개

Perplexity, 개발자 PC 공급망 스캐너 'Bumblebee' 오픈소스 공개

Perplexity가 개발자 로컬 환경의 패키지와 AI 설정을 점검하는 Bumblebee를 공개했다. 빌드 결과물이 아닌 로컬 파일 시스템의 메타데이터를 읽어 취약점을 빠르게 찾아낸다. Go 언어로 작성되어 의존성이 없으며, 설치 스크립트를 실행하지

Deep구글, '특수 목적 AI' 넘어 '자율 연구 에이전트'로 전략 수정

구글, '특수 목적 AI' 넘어 '자율 연구 에이전트'로 전략 수정

구글이 특정 과학 문제 해결 도구에서 자율적으로 연구를 수행하는 에이전트 중심으로 전략을 수정했다. 제미나이 포 사이언스 패키지를 통해 가설 생성과 알고리즘 최적화를 통합하는 체계를 구축했다. 단순 도구를 넘어 인간 과학자와 협업하거나 독자적으로 성과

Deep20kg 미만 체급으로 8m/s 구현한 딥로보틱스 Lynx S10 출시

20kg 미만 체급으로 8m/s 구현한 딥로보틱스 Lynx S10 출시

딥로보틱스가 산업용 소형 휠-레그 로봇 Lynx S10을 공식 출시했다. 20kg 미만 무게에 16개 관절과 IP66 등급의 내구성을 갖춘 것이 특징이다. 전방위 인지 시스템과 고속 주행 능력을 통해 산업 현장 배치를 목표한다.

Deep제조·로봇 결합한 '피지컬 AI'로 한국 AI 3강 도약 추진

제조·로봇 결합한 '피지컬 AI'로 한국 AI 3강 도약 추진

류정혜 위원이 한국 AI 3강 도약을 위한 국가 전략과 미래 방향성을 발표했다. 단순 대화를 넘어 업무를 수행하는 에이전틱 AI와 피지컬 AI로의 전환을 강조했다. 한국의 강점인 제조업과 로봇 산업을 AI와 결합하는 생태계 전략이 핵심이다.

Deep30억 파라미터의 반란, 거대 모델 꺾은 DharmaOCR의 '특화 전략'

30억 파라미터의 반란, 거대 모델 꺾은 DharmaOCR의 '특화 전략'

Dharma가 구조화된 OCR 특화 소형 모델 DharmaOCR과 벤치마크를 공개했다. 30억 파라미터 모델이 GPT-5.4와 Claude Opus 4.6 등 프런티어 모델의 성능을 앞질렀다. 파라미터 규모보다 작업 중심의 '맥락적 특화'가 성능과 비

DeepGemma 4, 로컬 파일 탐색과 파이썬 실행으로 '에이전틱' 구현

Gemma 4, 로컬 파일 탐색과 파이썬 실행으로 '에이전틱' 구현

Gemma 4의 e2b 변체 모델을 활용해 로컬 시스템과 상호작용하는 툴 콜링 에이전트를 구현한다. 샌드박스형 파일 탐색기와 제한된 파이썬 인터프리터로 모델의 추론 한계를 보완한다. 단순 API 호출을 넘어 환경을 인식하고 결정하는 실무적 에이전트 설

DeepGoogle I/O 2026 'Dialogues' 공개 — 기술적 돌파구와 사회적 영향 논의

Google I/O 2026 'Dialogues' 공개 — 기술적 돌파구와 사회적 영향 논의

Google I/O 2026에서 기술적 돌파구를 논의한 Dialogues 스테이지가 운영되었다. 구글 리더와 과학자, 비전가들이 모여 기술이 사회와 미래에 미치는 영향을 분석했다. 해당 세션의 전체 내용은 유튜브를 통해 글로벌 개발자에게 공개되었다.

Deep마이크로소프트 Fara1.5 공개, OpenAI 오퍼레이터 제치고 브라우저 제어권 확보

마이크로소프트 Fara1.5 공개, OpenAI 오퍼레이터 제치고 브라우저 제어권 확보

MS가 브라우저 제어 AI 모델 Fara1.5 시리즈를 전격 공개했다. 벤치마크 결과 OpenAI와 구글의 최신 에이전트를 모두 앞섰다. 샌드박스 환경과 합성 데이터 파이프라인으로 안전성과 성능을 잡았다.

Deep환자 정보 다루는 AI 에이전트 허용, 아마존 노바 액트 HIPAA 적격성 확보

환자 정보 다루는 AI 에이전트 허용, 아마존 노바 액트 HIPAA 적격성 확보

아마존이 브라우저 기반 AI 에이전트 서비스인 노바 액트의 HIPAA 적격성을 확보했다. 이제 의료기관은 민감한 환자 건강 정보가 포함된 복잡한 행정 워크플로우를 자동화할 수 있다. 예약 관리부터 보험 청구까지, 사람이 수동으로 하던 브라우저 작업을

Deep추론 시간 42.47% 부풀린 '텍스트 퇴행'의 실체 — Qwen2.5-VL 분석

추론 시간 42.47% 부풀린 '텍스트 퇴행'의 실체 — Qwen2.5-VL 분석

소수 요청의 무한 루프가 전체 시스템 추론 효율을 급격히 저하시킨다. 최대우도 추정 학습 방식이 초래한 구조적 결함이 원인으로 분석된다. vLLM 등 동적 배칭 환경에서 정상 요청의 지연 시간까지 전이된다.

Deep단순 추론 넘어 에이전틱 AI로, Aetina가 재편하는 엣지 AI 지형

단순 추론 넘어 에이전틱 AI로, Aetina가 재편하는 엣지 AI 지형

Aetina가 COMPUTEX 2026에서 NVIDIA 기반 엣지 AI 솔루션 포트폴리오를 공개한다. 단일 추론 모델에서 물리적·시각적·에이전틱 AI가 통합된 컨텍스트 지능으로 진화한다. 로보틱스와 기업 자동화를 위한 4종의 엣지 제품군으로 실시간 처

Deep다운타임 줄이는 원격 관제, 빅웨이브로보틱스 '솔링크 인더스트리얼 허브' 앱 공개

다운타임 줄이는 원격 관제, 빅웨이브로보틱스 '솔링크 인더스트리얼 허브' 앱 공개

빅웨이브로보틱스가 산업 현장 통합 운영 서비스인 솔링크 인더스트리얼 허브 모바일 앱을 출시했다. 클라우드 기반으로 설비와 로봇 데이터를 통합 관제하며 실시간 알림과 원격 대응 기능을 제공한다. 보안 정책에 따른 데이터 분리 운영과 권한 관리를 통해 산

DeepRobot.com, 자율주행 로봇 기반 광고 플랫폼 'R-ads' 공개

Robot.com, 자율주행 로봇 기반 광고 플랫폼 'R-ads' 공개

Robot.com이 자율주행 로봇을 활용한 광고 플랫폼 R-ads를 출시했다. 전 세계 20개국 이상에서 100회 이상의 브랜드 활성화 사례를 확보했다. 물리적 옥외 광고를 디지털 광고처럼 측정 가능한 네트워크로 전환한다.

Deep토큰 비용 10배 낮춘 Vera Rubin NVL72, 컴퓨텍스 골든 어워드 석권

토큰 비용 10배 낮춘 Vera Rubin NVL72, 컴퓨텍스 골든 어워드 석권

NVIDIA가 COMPUTEX에서 Vera Rubin NVL72 등 AI 핵심 인프라 3종으로 주요 부문 상을 수상했다. Vera Rubin NVL72는 전성비 10배 향상과 토큰당 비용 10배 절감을 통해 추론 효율을 극대화했다. Jetson Tho