매일 한 편, AI 업계를 읽는 칼럼
글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

Nonograph 개발자가 소프트웨어 무료 배포의 가치를 공유했다. 구독 모델과 수익화가 서비스의 질적 저하를 초래한다고 지적했다. 소프트웨어를 자기탐색의 도구로 삼을 때 더 나은 결과가 나온다.

남아공 내무부가 AI가 생성한 허구의 참고문헌을 정책 문서에 사용했다. 해당 문서를 작성한 공무원 2명이 직무 정지 처분을 받았다. 정부는 2022년 11월 30일 이후 작성된 모든 정책 문서를 전수 조사한다.

기업들이 AI 도입을 명분으로 숙련된 엔지니어를 해고하고 있다. 도제식 교육 체계가 무너지며 조직의 핵심 운영 지식이 소실된다. 기술적 탐욕이 시스템의 근간을 흔드는 위험한 결과를 초래한다.

Anthropic이 AI 에이전트가 자율 거래하는 Project Deal 실험을 진행했다. 69명의 참가자가 186건의 거래를 통해 4,000달러 이상의 거래액을 기록했다. 인간의 암묵적 판단력을 AI에 이식하는 판단 추상화가 커머스의 핵심 경쟁력이

Mozilla가 Claude Mythos Preview를 활용해 파이어폭스의 보안 취약점을 대거 수정했다. 단순 분석을 넘어 직접 테스트 코드를 짜고 실행하는 에이전틱 하네스 방식을 도입했다. 샌드박스 탈출과 같은 고난도 버그를 효율적으로 찾아내는 자

AI 제품은 전통적 SaaS와 달리 가치 도달 시간이 극단적으로 단축되었다. 품질이 확률적 특성을 띠면서 평가 하네스가 제품의 핵심이 되었다. 토큰 기반 비용 구조로 인해 성공 태스크당 비용 측정이 필수적이다.

Hunk는 AI 에이전트가 생성한 코드 변경사항을 터미널에서 확인하는 도구다. Git diff와 연동해 인라인 주석과 멀티 파일 리뷰를 지원한다. 설정 파일을 통해 테마와 레이아웃을 사용 환경에 맞게 변경할 수 있다.

Zyphra가 활성 파라미터를 7억 개로 줄인 초경량 MoE 모델 ZAYA1-8B를 공개했다. 수학과 코딩 벤치마크에서 수십 배 더 큰 모델들과 대등하거나 앞서는 성능을 보였다. 낮은 연산 비용으로 고성능 추론이 가능해 온디바이스 AI 구현의 새로운

AI가 기초 작업의 수준을 높이며 기술의 바닥을 상향 평준화하고 있다. 인간은 AI가 대체할 수 없는 고차원적 영역에서 비판적 사고를 유지해야 한다. 기술 트렌드에 휘둘리기보다 도메인 전문성을 바탕으로 오너십을 구축해야 한다.

AI 프로세서 생산 우선 정책으로 인해 소비자용 PC 부품 공급이 부족해졌다. 주요 메인보드 제조사 4곳의 2026년 출하량이 전년 대비 최대 37% 감소했다. 제조사들은 소비자용 시장 대신 AI 서버 생산으로 사업 구조를 전환하고 있다.

Anthropic이 Claude Managed Agents 플랫폼에 Dreaming 기능을 도입했다. 이 기능은 AI 에이전트가 과거 세션을 분석해 스스로 개선점을 찾도록 돕는다. Harvey와 Wisedocs 등 초기 도입 기업들은 작업 효율이 크게

Anthropic이 AI 내부의 복잡한 숫자 신호를 문장으로 바꾸는 NLA 기술을 발표했다. 이 기술은 AI가 겉으로 말하지 않는 의도나 평가 상황 인식 여부를 파악하는 데 활용된다. 연구진은 NLA를 통해 AI의 안전성을 검증하고 모델의 내부 사고

AI로 대량 생산된 저품질 콘텐츠인 AI 슬롭이 커뮤니티를 오염시키고 있다. 단순한 호기심으로 공유되는 자동 생성물은 정보의 신호와 소음을 구분하기 어렵게 만든다. 기술의 가치는 생성 자체가 아니라 인간의 목적과 검증된 유용성에 달려 있다.

OpenAI가 GPT-5급 추론 능력을 갖춘 실시간 음성 모델을 출시했다. 실시간 번역과 음성 인식 기능을 포함한 새로운 API 도구가 추가되었다. 모든 기능은 기존 Realtime API를 통해 분당 또는 토큰 단위로 과금된다.

OpenAI가 자해 위험 감지 시 지정된 연락처로 알림을 보내는 기능을 도입했다. 해당 기능은 사용자가 직접 신뢰할 수 있는 지인을 등록하는 선택적 방식이다. 최근 챗봇과의 대화가 자해와 연관되었다는 소송이 이어지며 안전 조치를 강화했다.

Perplexity가 Mac 전용 Personal Computer 앱을 모든 사용자에게 공개했다. 이 도구는 로컬 파일과 앱을 제어하며 400개 이상의 커넥터를 지원한다. 기존 Mac 앱은 수주 내 지원이 종료되며 신규 앱으로 통합될 예정이다.

Unsloth 연구팀이 이중 버퍼링을 도입해 LLM 학습 시 데이터 전송 지연을 줄였다. 데이터 복사와 연산을 병렬로 처리하여 NVIDIA B200 환경에서 학습 효율을 개선했다. MoE 모델의 라우팅 로직을 최적화하여 동적 인덱싱 오버헤드를 최소화했

Alibaba가 60억 파라미터 규모의 Z-Anime 모델을 공개했다. 전체 미세 조정 방식을 채택해 LoRA 병합 모델의 한계를 극복했다. 양자화 기술을 통해 8GB VRAM 환경에서도 원활한 구동이 가능하다.

Zyphra가 AMD Instinct MI300 GPU로 학습한 ZAYA1-8B 모델을 공개했다. 이 모델은 80억 개의 파라미터 중 7억 6천만 개만 활성화하는 효율적인 구조를 갖췄다. Apache 2.0 라이선스로 배포되어 기업과 개발자가 즉시 로

Open Generative AI가 200개 이상의 모델을 통합한 스튜디오를 공개했다. 콘텐츠 필터 없이 이미지와 영상, 립싱크 생성을 한 곳에서 지원한다. MIT 라이선스로 공개되어 누구나 셀프 호스팅과 커스터마이징이 가능하다.

위키 빌더는 클로드 코드용 오픈소스 플러그인이다. 한 번의 명령으로 폴더 구조와 프롬프트 파일을 자동 생성한다. 벡터 DB 없이 마크다운 위키로 LLM 지식 기반을 운영한다.

스포티파이가 AI로 개인 맞춤 오디오를 생성하는 CLI 도구를 베타로 공개했다. 개발자는 OpenAI Codex나 Anthropic Claude Code로 팟캐스트를 만들어 스포티파이에 바로 저장할 수 있다. 생성된 콘텐츠는 본인 라이브러리에서만 재생

Anthropic Skill 스캐너가 테스트 파일 내 악성 코드를 감지하지 못하는 취약점이 발견됐다. Snyk의 조사 결과 마켓플레이스 내 Skill의 13.4%에서 심각한 보안 문제가 확인됐다. 개발 도구의 테스트 실행 경로를 이용해 환경 변수와 S

비전 기반 에이전트는 API 방식보다 45배 많은 토큰을 소모한다. 비전 에이전트는 UI 스크린샷 해석 과정에서 높은 비용과 변동성을 보인다. 내부 도구 개발 시 API 엔드포인트 연동이 경제성 측면에서 압도적이다.

Winsen Labs가 오픈소스 에이전트 런타임 Platos를 공개했다. 사용자는 자체 인프라에서 AI 에이전트를 직접 운영하고 관리한다. Claude Managed Agents와 같은 상용 서비스를 대체하는 것이 목표다.

생성형 AI가 전문성 없는 초보자의 산출물 품질을 인위적으로 높이고 있다. 조직 내 문서와 코드 생산량은 급증했으나 실제 검증 능력은 퇴보했다. 신뢰 가능한 결과물을 직접 검증하는 역량이 기업의 핵심 경쟁력이 된다.

확산 모델은 반복적인 노이즈 제거 과정을 통해 데이터를 생성한다. 플로우 맵은 경로상의 점을 직접 예측하여 샘플링 효율을 높인다. 이 방식은 결정론적 업데이트를 활용해 연산 속도를 개선한다.

스탠퍼드 연구팀이 딥러닝의 일반화 원리를 설명하는 새로운 이론을 제시했다. 기존의 매개변수 중심 분석에서 벗어나 출력 공간의 동역학을 분석하는 방식을 택했다. 이 연구는 딥러닝의 학습 과정을 수학적으로 규명하여 모델 설계의 불확실성을 줄인다.

미디어 거물 배리 딜러가 OpenAI CEO 샘 올트먼의 진정성을 옹호했다. 그는 인공지능이 인간의 통제를 벗어날 가능성을 경고했다. AGI 도래 시 스스로를 통제하는 힘이 생길 수 있다고 지적했다.

Snap이 Perplexity와 맺었던 4억 달러 규모의 AI 검색 제휴를 종료했다. 양사는 올해 1분기에 원만하게 협력 관계를 마무리하기로 합의했다. Snap은 이번 결정이 향후 매출 가이던스에 영향을 주지 않는다고 밝혔다.