KO EN

AX BRIEF

매일 한 편, AI 업계를 읽는 칼럼

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 98 pt2. Gemini 4 Argon (high) 95 pt3. Claude Opus 5.5 (max with fallback) 94 pt4. Claude Sonnet 5.5 (max with fallback) 93 pt5. GPT-6 Astra (max) 90 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Fable 5.1 XHigh + SWE-2 Medium 88 pt3. GPT-6.1 Sol (xhigh) 69 pt4. Claude Sonnet 5.5 (max) 63 pt5. Claude Opus 5.5 (max) 63 pt이미지1. gpt-image-2.5-sunburst 85 pt2. gpt-image-2.5-flare 81 pt3. gpt-image-2 (medium) 78 pt4. grok-imagine-image-2.0 (canvas) 70 pt5. mai-image-2.6 70 pt비디오1. gemini-omni-1.1-flash 85 pt2. gemini-omni-flash 84 pt3. flux-3-video 81 pt4. grok-imagine-video-1.5-agent 81 pt5. dreamina-seedance-2.0-720p 79 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Opus 5.5 (max with fallback) 39 pt4. Claude Sonnet 5.5 (max with fallback) 19 pt5. Gemini 4 Argon (high) 19 pt속도1. Claude Haiku 5.5 (max) 100 pt2. DeepSeek V4.1 Flash (max) 90 pt3. Muse Spark 1.3 (max) 84 pt4. gpt-oss-120b (high) 68 pt5. Nemotron 3 Ultra 56 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

내 홈 디렉터리 삭제할 뻔했다, GPT-5.6-sol의 치명적 변수 충돌

내 홈 디렉터리 삭제할 뻔했다, GPT-5.6-sol의 치명적 변수 충돌

최신 AI 모델에게 터미널 권한을 주면 복잡한 시스템 설정까지 빠르게 처리할 수 있다. 최근 gpt-5.6-sol 모델이 PowerShell의 변수 특성을 오해해 사용자 루트 폴더를 삭제하려 했다. 시스템 잠금 덕분에 전면 삭제는 면했지만, 일부 설정

"LLM은 고급 자동완성일 뿐" 초지능 담론을 거부한 실무적 시각

"LLM은 고급 자동완성일 뿐" 초지능 담론을 거부한 실무적 시각

AI 시대에 뒤처지면 영구적 하층민이 된다는 불안감이 확산하고 있다. 하지만 LLM은 초지능이 아니라 고급 자동완성이나 스마트 컴파일러 같은 도구에 가깝다. 코딩 에이전트는 생산성을 높이지만 인지 피로를 유발하며 저품질 코드를 양산하는 한계가 있다.

B2B 소프트웨어 검색 결과에 숏폼 진입, 유튜브 쇼츠 1위 비중 75% 기록

B2B 소프트웨어 검색 결과에 숏폼 진입, 유튜브 쇼츠 1위 비중 75% 기록

B2B 소프트웨어 검색 결과와 AI 답변 영역에 숏폼 동영상이 빠르게 진입하고 있다. 유튜브 쇼츠는 미국 내 475개 소프트웨어 검색어 상위 10위에 진입했으며 이 중 75%가 1위를 차지했다. 기업은 단순 영상 제작을 넘어 검색어 기반의 숏폼 재가공

토큰 1개의 15단계 여행, AI 추론이 인프라 비용 90% 차지하는 이유

토큰 1개의 15단계 여행, AI 추론이 인프라 비용 90% 차지하는 이유

ChatGPT 같은 AI 서비스의 핵심은 학습보다 답변을 내놓는 '추론' 과정에 있다. 요청 하나가 응답으로 돌아오기까지 데이터센터 내 15단계의 복잡한 경로를 통과한다. 2026년 기준 추론 비용이 전체 AI 컴퓨팅의 3분의 2를 차지하며 인프라 경

AI 에이전트 SaaS, 소프트웨어 도구 판매에서 '업무 수행' 판매로 전환

AI 에이전트 SaaS, 소프트웨어 도구 판매에서 '업무 수행' 판매로 전환

AI 에이전트가 단순한 업무 도구를 넘어 특정 업무 자체를 수행하고 판매하는 '에이전트 SaaS' 형태로 진화하고 있다. Slang AI와 same day는 전화 응대와 예약 관리 등 인적 자본이 투입되던 영역을 AI가 직접 처리하며 매출 손실을 방지

코드 42%가 AI 작품인 시대, 엔지니어는 '최종 판정관'이 된다

코드 42%가 AI 작품인 시대, 엔지니어는 '최종 판정관'이 된다

AI가 코드를 짜주는 시대가 오면서 개발 방식이 완전히 바뀌고 있다. 커밋된 코드의 42%가 AI 보조를 받았지만, 검증과 책임의 공백이라는 새로운 문제가 생겼다. 이제 엔지니어는 직접 구현하는 '내부 루프' 대신 배포를 결정하는 '외부 루프'를 소유

클로드 버리고 GPT-5.6 솔로 갈아탄 Ploy의 '2.2배 빠른' 마이그레이션 기록

클로드 버리고 GPT-5.6 솔로 갈아탄 Ploy의 '2.2배 빠른' 마이그레이션 기록

AI 에이전트를 운영하다 보면 모델 교체 시 성능과 비용 사이에서 고민하게 됩니다. 마케팅 웹사이트 제작 AI 'Ploy'가 클로드 오퍼스를 버리고 OpenAI의 GPT-5.6 솔로 전격 교체했습니다. 그 결과 작업 속도는 2.2배 빨라졌고 운영 비용

한 번의 질문에 33,000토큰 — Claude Code의 무거운 '기본 비용'

한 번의 질문에 33,000토큰 — Claude Code의 무거운 '기본 비용'

AI 코딩 에이전트는 사용자의 질문보다 시스템이 내부적으로 보내는 데이터 양이 훨씬 많다. Claude Code는 기본 33,000토큰을 사용하는 반면 OpenCode는 7,000토큰 수준이다. 서브에이전트 활용 시 비용이 4.2배까지 폭증하며 컨텍스

AI가 인간을 부리는 '리버스 켄타우로스'와 노동의 도구화

AI가 인간을 부리는 '리버스 켄타우로스'와 노동의 도구화

코리 닥터로우가 AI 사용 양상을 인간이 주도하는 '켄타우로스'와 AI가 인간을 보조로 쓰는 '리버스 켄타우로스'로 구분해 정의했다. 허스트(Hearst)의 AI 생성 도서 목록 사례를 통해 인간이 AI의 오류를 책임지는 '책임 흡수원'으로 전락한 구

데이터센터 없이 235B 모델 구동, Mesh LLM의 분산 GPU 풀링

데이터센터 없이 235B 모델 구동, Mesh LLM의 분산 GPU 풀링

LLM 운영을 위해 고가의 GPU 서버나 데이터센터 API에 의존하는 것이 일반적이다. Mesh LLM은 흩어진 GPU와 메모리를 하나로 묶어 OpenAI 호환 API로 제공한다. 0.5B부터 235B 규모의 모델까지 지원하며 P2P 방식으로 연산을

보코하람, ChatGPT·Claude 등 프런티어 AI를 전술 작전 및 무기 설계에 도입

보코하람, ChatGPT·Claude 등 프런티어 AI를 전술 작전 및 무기 설계에 도입

나이지리아 테러 조직 보코하람이 프런티어 AI 모델을 전투 및 작전 운영에 체계적으로 활용한 정황이 확인됐다. ChatGPT, Claude, Gemini 등 6종의 모델을 통해 폭발 장치 설계와 전술 계획을 수립했으며 전담 AI 조직을 운영해 지식을

대역폭 100배 늘려 AI 장치 잇는다, SpaceX의 위성 10만 기 승부수

대역폭 100배 늘려 AI 장치 잇는다, SpaceX의 위성 10만 기 승부수

오지 전용 인터넷으로 인식되던 위성 통신이 AI 인프라로 진화한다. SpaceX가 10만 기의 3세대 위성을 배치해 멀티기가비트 속도를 구현한다. 20ms 미만의 초저지연망을 통해 전 세계 수십억 개의 AI 장치를 연결한다.

"초지능 경쟁은 자살행위"… 2040년까지 속도 줄이는 국제 합의 '플랜 A'

"초지능 경쟁은 자살행위"… 2040년까지 속도 줄이는 국제 합의 '플랜 A'

AI 기업들이 인간을 능가하는 초지능을 먼저 갖기 위해 전속력으로 경쟁하고 있다. 이 경쟁이 인류 멸종이나 극단적인 권력 독점으로 이어질 수 있다는 경고가 나온다. 연구를 투명하게 공개하고 초지능 도달 시점을 2040년으로 늦추는 '플랜 A'가 대안으

LLM을 거친 질문에 'AI에게 물어보라'는 답이 무의미한 이유

LLM을 거친 질문에 'AI에게 물어보라'는 답이 무의미한 이유

누구나 ChatGPT나 Claude 같은 AI에게 먼저 질문을 던지는 시대가 되었다. 하지만 AI의 합의된 답변을 넘어선 고난도 질문은 여전히 인간의 실무 경험을 필요로 한다. 'AI에게 물어보라'는 조언이 전문적 통찰을 회피하는 수단으로 변질되는 현

엔비디아-코어위브-네비우스, GPU 인프라 확장을 위한 순환 금융 구조와 MFU 최적화 전략

엔비디아-코어위브-네비우스, GPU 인프라 확장을 위한 순환 금융 구조와 MFU 최적화 전략

코어위브와 네비우스가 하이퍼스케일러와의 대규모 계약과 엔비디아의 투자를 통해 GPU 인프라를 급격히 확장하고 있다. CKS, SUNK 등 전용 소프트웨어 스택을 통해 호퍼(Hopper) GPU 기준 50% 이상의 MFU(Model FLOPs Utili

3천 개 잎사귀를 코드로 생성, Three.js 전용 Copilot 플러그인 공개

3천 개 잎사귀를 코드로 생성, Three.js 전용 Copilot 플러그인 공개

웹 브라우저에서 3D 모델을 구현하기 위해 일일이 좌표를 수정하거나 외부 파일을 불러오는 작업은 번거롭다. RePolis(가상 도시 프로젝트)의 세계수 구현을 위해 Three.js 전용 GitHub Copilot 플러그인이 개발됐다. Sculpt DN

AI 2040 비전의 물리적 한계 지적과 로컬 AI 정렬 필요성 제기

AI 2040 비전의 물리적 한계 지적과 로컬 AI 정렬 필요성 제기

AI 2040의 초지능 시나리오가 물리적 현실과 공급망의 제약을 간과했다는 비판이 제기됐다. 저자는 ChatGPT의 가드레일 사례를 통해 기업 주도의 정렬이 아닌 사용자 중심의 로컬 AI 정렬을 주장했다. AI 실무자는 지능의 고도화보다 물리적 구현

AI 환각 이용한 '슬롭스쿼팅' 공격 등장... 오픈소스 모델 취약성 4배 높다

AI 환각 이용한 '슬롭스쿼팅' 공격 등장... 오픈소스 모델 취약성 4배 높다

AI 코딩 도구의 환각 현상을 이용해 악성 패키지를 설치하게 만드는 '슬롭스쿼팅(Slopsquatting)' 공격 방식이 제기됐다. 분석 결과 GPT-4 Turbo의 패키지 환각률은 3.59%였으나, 오픈소스 모델인 DeepSeek 1B는 13.63%

AI는 헛것 보고 사람은 읽는 '움직이는 글자' 고스트 폰트 공개

AI는 헛것 보고 사람은 읽는 '움직이는 글자' 고스트 폰트 공개

AI가 이미지 속 글자를 너무 완벽하게 읽어내는 시대가 됐다. 움직임과 가짜 메시지를 섞어 AI만 못 읽게 만드는 '고스트 폰트'가 공개됐다. 정지 화면으로는 내용을 알 수 없어 최신 AI 모델들도 해독에 어려움을 겪는다.

모델 성능보다 '데이터 원천'이 가른 LLM 자동 수집의 성패

모델 성능보다 '데이터 원천'이 가른 LLM 자동 수집의 성패

전국 수영장 시간표 같은 비정형 데이터를 LLM으로 자동 수집하려는 시도가 많다. Gemini-2.0-flash-lite로 600여 곳을 시도했으나 API 한도, 스키마 불일치, 원천 데이터 부재라는 세 가지 벽에 부딪혔다. 결국 모델 성능보다 데이터

LLM이 내 코드를 망치는 방식, '나중에 정리'가 부르는 악순환

LLM이 내 코드를 망치는 방식, '나중에 정리'가 부르는 악순환

LLM은 코드베이스의 기존 패턴을 학습해 다음 코드를 생성한다. 중복된 조건문과 임시 구현을 그대로 병합하면 모델은 이를 프로젝트 규칙으로 인식한다. 결국 나쁜 패턴이 코드베이스에 고착화되어 사람이 직접 수정해야 하는 상황이 발생한다.

알리바바 넘은 SK하이닉스, 미국 역사상 최대 규모 36조 원 IPO

알리바바 넘은 SK하이닉스, 미국 역사상 최대 규모 36조 원 IPO

한국 기업이 미국 증시에서 겪어온 고질적인 저평가 현상이 AI 열풍으로 깨지고 있습니다. SK하이닉스가 나스닥 데뷔를 통해 미국 역사상 최대 규모인 265억 달러(약 40조 원)를 조달했습니다. AI 칩의 핵심인 HBM 경쟁력을 앞세워 알리바바의 기존

Krea 2 Identity Edit, 인물 정체성 보존하는 정밀 편집 모델 공개

Krea 2 Identity Edit, 인물 정체성 보존하는 정밀 편집 모델 공개

AI 이미지 편집 시 배경이나 옷을 바꾸면 얼굴이 변하는 정체성 붕괴가 고질적 문제였다. Krea 2 Identity Edit은 12.9B 파라미터의 MMDiT 구조로 인물 고유 외형을 보존한다. SVD 최적화로 VRAM 사용량을 0.46GB까지 낮춰

fenic, PySpark 스타일 연산과 LLM 시맨틱 연산 결합한 쿼리 엔진 공개

fenic, PySpark 스타일 연산과 LLM 시맨틱 연산 결합한 쿼리 엔진 공개

PySpark/SQL 스타일 연산과 LLM 시맨틱 연산자를 통합한 쿼리 엔진 fenic이 공개됐다. 비정형 데이터를 구조화된 컬럼으로 변환하며, 데이터 파이프라인을 에이전트가 호출 가능한 타입 지정 도구로 전환한다.

Meta, DDR4 메모리 재사용 위한 CXL 브리지 칩 'Vistara' 공개

Meta, DDR4 메모리 재사용 위한 CXL 브리지 칩 'Vistara' 공개

Meta가 구형 DDR4 메모리를 최신 DDR5 서버에서 재사용할 수 있는 맞춤형 ASIC 'Vistara'를 개발했다. CXL 2.0/1.1 및 PCIe Gen5 x16 인터페이스를 통해 분리형 추론 서버 수를 최대 25% 줄였다. 메모리와 서버의

삭제됐다, 인스타그램의 AI 사진 변형 기능

삭제됐다, 인스타그램의 AI 사진 변형 기능

인스타그램에서 타인의 공개 사진을 AI로 변형하는 기능이 도입됐다. 메타는 사용자 반발과 오남용 우려로 해당 기능을 출시 직후 삭제했다. AI 이미지 생성 도구 '뮤즈 이미지'의 권한 설정 미흡이 논란의 핵심이다.

애플 실리콘, AI 에이전트 전용 서버 수요 대응 및 하이브리드 추론 구조 공개

애플 실리콘, AI 에이전트 전용 서버 수요 대응 및 하이브리드 추론 구조 공개

Apple Silicon 수석 제품 매니저 더그 브룩스가 AI 에이전트 구동을 위한 Mac mini와 Mac Studio의 수요 증가를 밝혔다. 뉴럴 엔진과 CPU·GPU 가속기를 활용해 프라이버시와 추론 비용을 최적화하는 로컬-클라우드 하이브리드 실

기업 AI 에이전트, 검증 속도보다 자율성 도입 앞선 '평가 격차' 발생

기업 AI 에이전트, 검증 속도보다 자율성 도입 앞선 '평가 격차' 발생

기업 AI 에이전트의 자율성 확대 속도가 이를 검증하는 역량을 앞지르는 '평가 격차' 현상이 나타나고 있다. 조사 대상 기업의 50%가 내부 검증을 통과한 AI 에이전트가 실제 고객 접점에서 실패한 경험이 있으며, 자동 평가 도구에 대한 신뢰도는 5%

애플, OpenAI 상대 영업비밀 침해 소송... 하드웨어 기밀 탈취 주장

애플, OpenAI 상대 영업비밀 침해 소송... 하드웨어 기밀 탈취 주장

ChatGPT로 익숙한 OpenAI가 하드웨어 시장 진출을 위해 공격적인 인재 영입을 진행했다. 애플은 이 과정에서 전직 임직원들이 설계도와 부품 등 핵심 기밀을 유출했다고 주장한다. 특히 면접 중 실제 하드웨어 샘플과 CAD 파일을 요구한 구체적 정

슬랙과 캘린더까지 직접 관리하는 OpenAI의 ChatGPT Work

슬랙과 캘린더까지 직접 관리하는 OpenAI의 ChatGPT Work

질문에 답하던 챗봇이 이제는 스스로 업무를 수행하는 에이전트로 진화합니다. OpenAI가 이메일, 슬랙, 캘린더를 넘나들며 복잡한 과업을 완수하는 'ChatGPT Work'를 공개했습니다. GPT-5.6 모델과 클라우드 가상 머신을 통해 기기 연결 없