KO EN

AX BRIEF

매일 한 편, AI 업계를 읽는 칼럼

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 98 pt2. Gemini 4 Argon (high) 95 pt3. Claude Opus 5.5 (max with fallback) 94 pt4. Claude Sonnet 5.5 (max with fallback) 93 pt5. GPT-6 Astra (max) 90 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Fable 5.1 XHigh + SWE-2 Medium 88 pt3. GPT-6.1 Sol (xhigh) 69 pt4. Claude Sonnet 5.5 (max) 63 pt5. Claude Opus 5.5 (max) 63 pt이미지1. gpt-image-2.5-sunburst 85 pt2. gpt-image-2.5-flare 81 pt3. gpt-image-2 (medium) 78 pt4. grok-imagine-image-2.0 (canvas) 70 pt5. mai-image-2.6 70 pt비디오1. gemini-omni-1.1-flash 85 pt2. gemini-omni-flash 84 pt3. flux-3-video 81 pt4. grok-imagine-video-1.5-agent 81 pt5. dreamina-seedance-2.0-720p 79 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Opus 5.5 (max with fallback) 39 pt4. Claude Sonnet 5.5 (max with fallback) 19 pt5. Gemini 4 Argon (high) 19 pt속도1. Claude Haiku 5.5 (max) 100 pt2. DeepSeek V4.1 Flash (max) 89 pt3. gpt-oss-120b (high) 73 pt4. Muse Spark 1.3 (max) 68 pt5. Inkling (xhigh) 57 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

Nonograph 개발자가 말하는 소프트웨어 무료 배포와 철학

Nonograph 개발자가 말하는 소프트웨어 무료 배포와 철학

Nonograph 개발자가 소프트웨어 무료 배포의 가치를 공유했다. 구독 모델과 수익화가 서비스의 질적 저하를 초래한다고 지적했다. 소프트웨어를 자기탐색의 도구로 삼을 때 더 나은 결과가 나온다.

정부 문서에 AI 환각 포함되어 DHA 공무원 2명 직무 정지

정부 문서에 AI 환각 포함되어 DHA 공무원 2명 직무 정지

남아공 내무부가 AI가 생성한 허구의 참고문헌을 정책 문서에 사용했다. 해당 문서를 작성한 공무원 2명이 직무 정지 처분을 받았다. 정부는 2022년 11월 30일 이후 작성된 모든 정책 문서를 전수 조사한다.

AI가 쏘아 올린 인력 감축, 소프트웨어 조직의 붕괴를 부르다

AI가 쏘아 올린 인력 감축, 소프트웨어 조직의 붕괴를 부르다

기업들이 AI 도입을 명분으로 숙련된 엔지니어를 해고하고 있다. 도제식 교육 체계가 무너지며 조직의 핵심 운영 지식이 소실된다. 기술적 탐욕이 시스템의 근간을 흔드는 위험한 결과를 초래한다.

4,000달러 거래 성사시킨 Anthropic Project Deal과 다크 마켓플레이스

4,000달러 거래 성사시킨 Anthropic Project Deal과 다크 마켓플레이스

Anthropic이 AI 에이전트가 자율 거래하는 Project Deal 실험을 진행했다. 69명의 참가자가 186건의 거래를 통해 4,000달러 이상의 거래액을 기록했다. 인간의 암묵적 판단력을 AI에 이식하는 판단 추상화가 커머스의 핵심 경쟁력이

Claude Mythos Preview로 파이어폭스 보안 버그 대거 해결, 핵심은 '에이전틱 하네스'

Claude Mythos Preview로 파이어폭스 보안 버그 대거 해결, 핵심은 '에이전틱 하네스'

Mozilla가 Claude Mythos Preview를 활용해 파이어폭스의 보안 취약점을 대거 수정했다. 단순 분석을 넘어 직접 테스트 코드를 짜고 실행하는 에이전틱 하네스 방식을 도입했다. 샌드박스 탈출과 같은 고난도 버그를 효율적으로 찾아내는 자

AI 시대의 린 분석: 6가지 지표 변화와 수익성 재정의

AI 시대의 린 분석: 6가지 지표 변화와 수익성 재정의

AI 제품은 전통적 SaaS와 달리 가치 도달 시간이 극단적으로 단축되었다. 품질이 확률적 특성을 띠면서 평가 하네스가 제품의 핵심이 되었다. 토큰 기반 비용 구조로 인해 성공 태스크당 비용 측정이 필수적이다.

터미널에서 AI 코드 리뷰를 수행하는 Hunk 활용법

터미널에서 AI 코드 리뷰를 수행하는 Hunk 활용법

Hunk는 AI 에이전트가 생성한 코드 변경사항을 터미널에서 확인하는 도구다. Git diff와 연동해 인라인 주석과 멀티 파일 리뷰를 지원한다. 설정 파일을 통해 테마와 레이아웃을 사용 환경에 맞게 변경할 수 있다.

7억 개 파라미터로 1190억 모델과 맞붙는 초효율 AI의 등장

7억 개 파라미터로 1190억 모델과 맞붙는 초효율 AI의 등장

Zyphra가 활성 파라미터를 7억 개로 줄인 초경량 MoE 모델 ZAYA1-8B를 공개했다. 수학과 코딩 벤치마크에서 수십 배 더 큰 모델들과 대등하거나 앞서는 성능을 보였다. 낮은 연산 비용으로 고성능 추론이 가능해 온디바이스 AI 구현의 새로운

AI 시대의 바닥과 천장: 기술 변화 속 엔지니어의 생존 전략

AI 시대의 바닥과 천장: 기술 변화 속 엔지니어의 생존 전략

AI가 기초 작업의 수준을 높이며 기술의 바닥을 상향 평준화하고 있다. 인간은 AI가 대체할 수 없는 고차원적 영역에서 비판적 사고를 유지해야 한다. 기술 트렌드에 휘둘리기보다 도메인 전문성을 바탕으로 오너십을 구축해야 한다.

AI 서버 집중 전략에 따른 메인보드 시장 37% 급감과 부품 가격 상승

AI 서버 집중 전략에 따른 메인보드 시장 37% 급감과 부품 가격 상승

AI 프로세서 생산 우선 정책으로 인해 소비자용 PC 부품 공급이 부족해졌다. 주요 메인보드 제조사 4곳의 2026년 출하량이 전년 대비 최대 37% 감소했다. 제조사들은 소비자용 시장 대신 AI 서버 생산으로 사업 구조를 전환하고 있다.

Anthropic, AI 에이전트가 스스로 학습하는 'Dreaming' 기능 공개

Anthropic, AI 에이전트가 스스로 학습하는 'Dreaming' 기능 공개

Anthropic이 Claude Managed Agents 플랫폼에 Dreaming 기능을 도입했다. 이 기능은 AI 에이전트가 과거 세션을 분석해 스스로 개선점을 찾도록 돕는다. Harvey와 Wisedocs 등 초기 도입 기업들은 작업 효율이 크게

Anthropic, AI의 속마음을 자연어로 번역하는 NLA 기술 공개

Anthropic, AI의 속마음을 자연어로 번역하는 NLA 기술 공개

Anthropic이 AI 내부의 복잡한 숫자 신호를 문장으로 바꾸는 NLA 기술을 발표했다. 이 기술은 AI가 겉으로 말하지 않는 의도나 평가 상황 인식 여부를 파악하는 데 활용된다. 연구진은 NLA를 통해 AI의 안전성을 검증하고 모델의 내부 사고

AI 슬롭이 온라인 커뮤니티의 신뢰와 생태계를 잠식하는 방식

AI 슬롭이 온라인 커뮤니티의 신뢰와 생태계를 잠식하는 방식

AI로 대량 생산된 저품질 콘텐츠인 AI 슬롭이 커뮤니티를 오염시키고 있다. 단순한 호기심으로 공유되는 자동 생성물은 정보의 신호와 소음을 구분하기 어렵게 만든다. 기술의 가치는 생성 자체가 아니라 인간의 목적과 검증된 유용성에 달려 있다.

OpenAI, 실시간 음성 추론 모델 GPT-Realtime-2와 번역 API 공개

OpenAI, 실시간 음성 추론 모델 GPT-Realtime-2와 번역 API 공개

OpenAI가 GPT-5급 추론 능력을 갖춘 실시간 음성 모델을 출시했다. 실시간 번역과 음성 인식 기능을 포함한 새로운 API 도구가 추가되었다. 모든 기능은 기존 Realtime API를 통해 분당 또는 토큰 단위로 과금된다.

OpenAI, 자해 위험 감지 시 지정 연락처로 알림 발송 기능 도입

OpenAI, 자해 위험 감지 시 지정 연락처로 알림 발송 기능 도입

OpenAI가 자해 위험 감지 시 지정된 연락처로 알림을 보내는 기능을 도입했다. 해당 기능은 사용자가 직접 신뢰할 수 있는 지인을 등록하는 선택적 방식이다. 최근 챗봇과의 대화가 자해와 연관되었다는 소송이 이어지며 안전 조치를 강화했다.

Perplexity, Mac용 Personal Computer 정식 출시로 로컬 AI 에이전트 시장 공략

Perplexity, Mac용 Personal Computer 정식 출시로 로컬 AI 에이전트 시장 공략

Perplexity가 Mac 전용 Personal Computer 앱을 모든 사용자에게 공개했다. 이 도구는 로컬 파일과 앱을 제어하며 400개 이상의 커넥터를 지원한다. 기존 Mac 앱은 수주 내 지원이 종료되며 신규 앱으로 통합될 예정이다.

Unsloth와 NVIDIA가 LLM 학습 속도를 높이는 이중 버퍼링 전략

Unsloth와 NVIDIA가 LLM 학습 속도를 높이는 이중 버퍼링 전략

Unsloth 연구팀이 이중 버퍼링을 도입해 LLM 학습 시 데이터 전송 지연을 줄였다. 데이터 복사와 연산을 병렬로 처리하여 NVIDIA B200 환경에서 학습 효율을 개선했다. MoE 모델의 라우팅 로직을 최적화하여 동적 인덱싱 오버헤드를 최소화했

60억 파라미터 Z-Anime 모델, 8GB VRAM에서 구동 가능

60억 파라미터 Z-Anime 모델, 8GB VRAM에서 구동 가능

Alibaba가 60억 파라미터 규모의 Z-Anime 모델을 공개했다. 전체 미세 조정 방식을 채택해 LoRA 병합 모델의 한계를 극복했다. 양자화 기술을 통해 8GB VRAM 환경에서도 원활한 구동이 가능하다.

AMD GPU로 학습한 8B 모델 ZAYA1, 추론 성능의 새 기준

AMD GPU로 학습한 8B 모델 ZAYA1, 추론 성능의 새 기준

Zyphra가 AMD Instinct MI300 GPU로 학습한 ZAYA1-8B 모델을 공개했다. 이 모델은 80억 개의 파라미터 중 7억 6천만 개만 활성화하는 효율적인 구조를 갖췄다. Apache 2.0 라이선스로 배포되어 기업과 개발자가 즉시 로

200개 모델 통합한 Open Generative AI, MIT 라이선스로 전격 공개

200개 모델 통합한 Open Generative AI, MIT 라이선스로 전격 공개

Open Generative AI가 200개 이상의 모델을 통합한 스튜디오를 공개했다. 콘텐츠 필터 없이 이미지와 영상, 립싱크 생성을 한 곳에서 지원한다. MIT 라이선스로 공개되어 누구나 셀프 호스팅과 커스터마이징이 가능하다.

위키 빌더: LLM 지식 기반 구축을 위한 클로드 코드 플러그인

위키 빌더: LLM 지식 기반 구축을 위한 클로드 코드 플러그인

위키 빌더는 클로드 코드용 오픈소스 플러그인이다. 한 번의 명령으로 폴더 구조와 프롬프트 파일을 자동 생성한다. 벡터 DB 없이 마크다운 위키로 LLM 지식 기반을 운영한다.

스포티파이, AI 개인 팟캐스트 생성 CLI 도구 베타 공개

스포티파이, AI 개인 팟캐스트 생성 CLI 도구 베타 공개

스포티파이가 AI로 개인 맞춤 오디오를 생성하는 CLI 도구를 베타로 공개했다. 개발자는 OpenAI Codex나 Anthropic Claude Code로 팟캐스트를 만들어 스포티파이에 바로 저장할 수 있다. 생성된 콘텐츠는 본인 라이브러리에서만 재생

Anthropic Skill 스캐너 뚫는 .test.ts 취약점과 13.4%의 위험

Anthropic Skill 스캐너 뚫는 .test.ts 취약점과 13.4%의 위험

Anthropic Skill 스캐너가 테스트 파일 내 악성 코드를 감지하지 못하는 취약점이 발견됐다. Snyk의 조사 결과 마켓플레이스 내 Skill의 13.4%에서 심각한 보안 문제가 확인됐다. 개발 도구의 테스트 실행 경로를 이용해 환경 변수와 S

AI 에이전트의 비전 방식 vs API 방식, 비용 45배 격차 발생

AI 에이전트의 비전 방식 vs API 방식, 비용 45배 격차 발생

비전 기반 에이전트는 API 방식보다 45배 많은 토큰을 소모한다. 비전 에이전트는 UI 스크린샷 해석 과정에서 높은 비용과 변동성을 보인다. 내부 도구 개발 시 API 엔드포인트 연동이 경제성 측면에서 압도적이다.

오픈소스 에이전트 런타임 Platos 출시, 인프라 직접 통제

오픈소스 에이전트 런타임 Platos 출시, 인프라 직접 통제

Winsen Labs가 오픈소스 에이전트 런타임 Platos를 공개했다. 사용자는 자체 인프라에서 AI 에이전트를 직접 운영하고 관리한다. Claude Managed Agents와 같은 상용 서비스를 대체하는 것이 목표다.

AI가 만든 '산출물'의 함정, 기업 생산성 지형을 흔들다

AI가 만든 '산출물'의 함정, 기업 생산성 지형을 흔들다

생성형 AI가 전문성 없는 초보자의 산출물 품질을 인위적으로 높이고 있다. 조직 내 문서와 코드 생산량은 급증했으나 실제 검증 능력은 퇴보했다. 신뢰 가능한 결과물을 직접 검증하는 역량이 기업의 핵심 경쟁력이 된다.

확산 모델의 적분 학습, 플로우 맵으로 샘플링 속도 개선

확산 모델의 적분 학습, 플로우 맵으로 샘플링 속도 개선

확산 모델은 반복적인 노이즈 제거 과정을 통해 데이터를 생성한다. 플로우 맵은 경로상의 점을 직접 예측하여 샘플링 효율을 높인다. 이 방식은 결정론적 업데이트를 활용해 연산 속도를 개선한다.

딥러닝의 블랙박스를 여는 열쇠, 매개변수 대신 출력 공간을 분석하다

딥러닝의 블랙박스를 여는 열쇠, 매개변수 대신 출력 공간을 분석하다

스탠퍼드 연구팀이 딥러닝의 일반화 원리를 설명하는 새로운 이론을 제시했다. 기존의 매개변수 중심 분석에서 벗어나 출력 공간의 동역학을 분석하는 방식을 택했다. 이 연구는 딥러닝의 학습 과정을 수학적으로 규명하여 모델 설계의 불확실성을 줄인다.

배리 딜러가 말하는 AGI 시대, 신뢰보다 위험한 통제 불능의 영역

배리 딜러가 말하는 AGI 시대, 신뢰보다 위험한 통제 불능의 영역

미디어 거물 배리 딜러가 OpenAI CEO 샘 올트먼의 진정성을 옹호했다. 그는 인공지능이 인간의 통제를 벗어날 가능성을 경고했다. AGI 도래 시 스스로를 통제하는 힘이 생길 수 있다고 지적했다.

Snap, Perplexity와 4억 달러 규모 AI 검색 제휴 종료

Snap, Perplexity와 4억 달러 규모 AI 검색 제휴 종료

Snap이 Perplexity와 맺었던 4억 달러 규모의 AI 검색 제휴를 종료했다. 양사는 올해 1분기에 원만하게 협력 관계를 마무리하기로 합의했다. Snap은 이번 결정이 향후 매출 가이던스에 영향을 주지 않는다고 밝혔다.