매일 한 편, AI 업계를 읽는 칼럼
글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

LLM 학습 시 긴 컨텍스트와 큰 어휘집으로 발생하는 메모리 부족 문제를 해결하는 FLCE 기법이 공개되었다. 포워드 패스 내에서 각 청크의 그래디언트를 즉시 계산해 피크 메모리를 낮춘다.

ChatGPT 같은 AI가 코드를 짜주는 시대가 왔습니다. 이제 개발자는 단순 코딩보다 문제 정의와 작업 설계에 집중해야 합니다. AI 산출물을 검토하고 지속 가능한 제품으로 다듬는 능력이 핵심 경쟁력이 됩니다.

모델 성능이 올라가면 복잡한 도구 호출 스키마도 더 정확하게 따를 것이라 기대한다. 그러나 Claude Opus 4.8과 Sonnet 5는 Pi의 edit 도구 호출 시 스키마 외 가짜 필드를 추가하는 오류를 보였다. 특정 하네스에 최적화된 후학습이

AI 모델 학습을 위해 사람이 데이터를 분류하는 라벨링 작업은 필수적이었다. 아마존이 2026년 7월 30일부터 Mechanical Turk의 신규 고객 가입을 중단한다. 작업자의 LLM 사용으로 인한 데이터 오염과 봇 문제는 서비스의 존립 근거를 없

앤스로픽의 클로드 디자인 시스템 프롬프트와 스킬 라이브러리가 MIT 라이선스로 공개됐다. 20개 챕터의 디자인 철학과 14개의 절차적 스킬을 통해 전형적인 AI 생성 디자인의 정형성을 탈피한다. LLM을 단순 생성 도구가 아닌 구체적인 철학을 가진 디

AI 에이전트의 메모리 관리 비용이 실무자와 학생들에게 부담이 되고 있다. Codex 구독 할당량을 API 요청처럼 전환해 주는 honcho-codex-gateway가 공개됐다. 로컬 임베딩 모델 BGE-M3를 결합해 외부 API 의존도와 비용을 동시

구글 리서치가 별도의 미세 조정 없이 표 데이터를 처리하는 파운데이션 모델 TabFM 1.0.0을 공개했다. 탭아레나(TabArena) 51개 데이터셋 평가에서 튜닝된 GBDT 모델보다 높은 성능을 기록했으며, 최대 10개 클래스의 분류와 회귀 작업을

LLM Wiki가 멀티에이전트 시스템의 토큰 과소비와 컨텍스트 유실 문제를 해결하기 위한 '신문 편집국' 구조를 공개했다. LLM 판단은 '데스크' 역할로 한정하고 규칙 기반 파이썬 린트와 컨텍스트 격리를 통해 문서의 중복과 부풀림을 제어한다. 개발자

웹 개발자는 코드를 수정하고 브라우저에서 결과를 확인하는 과정을 수없이 반복한다. Safari Technology Preview 247에 코딩 에이전트를 브라우저에 직접 연결하는 MCP 서버가 추가됐다. 에이전트가 DOM, 네트워크 요청, 스크린샷에

AI 추론 수요 급증으로 NVIDIA GPU 공급 부족과 토큰 비용 상승이 이어지고 있다. AMD MI355X는 B300 대비 2.75배 저렴하며 B200 성능의 80% 수준을 구현했다. 소프트웨어 지원 격차는 존재하나 성능 대비 비용 효율성에서 강력

복잡한 코딩 작업에서 AI의 답변 정확도가 떨어지는 현상이 관찰된다. GPT-5.5 모델이 추론 토큰을 516개 등 특정 수치에서 강제로 멈추는 패턴이 발견됐다. 이는 자연스러운 추론 과정이 아니라 인위적인 예산 제한이나 절단 가능성을 시사한다.

구글 워크스페이스의 협업 기능이 역사적 사건과 만났습니다. 제미나이(Gemini)를 활용해 미국 독립선언서를 작성하는 가상 광고를 공개했습니다. AI 시각화와 자동 회의록 등 실무 기능이 강조됐으나, 정치적 협업 도구로서의 효용성 논란이 제기됐습니다.

Unanimous AI가 하이퍼 커뮤니케이션 기술을 활용해 277명의 미국인을 대상으로 한 실시간 집단 토론을 진행했다. Thinkscape 플랫폼의 AI 에이전트가 소그룹 간 연결을 최적화해 94개의 아이디어를 3개의 핵심 혁신 사례로 압축했다. A

디즈니와 워너브라더스 등 할리우드 스튜디오들이 미드저니를 저작권 침해로 고소했다. 미드저니는 스튜디오들이 내부적으로 AI를 어떻게 활용하는지 모든 기록을 공개하라고 맞섰다. 내부 스토리보드 제작 등 비공개 AI 활용 사례가 입증되면 '업계 관행'이라는

미국 중심의 AI 생태계에서 유럽의 기술 주권 확보 움직임이 거세지고 있다. Mistral AI는 단순 챗봇을 넘어 기업·정부 맞춤형 배포 전략으로 ARR 10억 달러를 정조준한다. 자체 데이터센터 구축과 오픈 웨이트 모델 전략으로 폐쇄형 AI의 대안

ChatGPT 같은 AI에게 일을 맡길 때 얼마나 믿고 맡길지 고민하는 경우가 많습니다. 이제는 단순한 프롬프트 작성을 넘어 에이전트의 자율성 수준을 설계하는 운영 단계로 진화하고 있습니다. 앤스로픽의 데이터에 따르면 사람은 계획의 70%를, AI는

매 이터레이션마다 새로운 세션을 생성해 코드를 개선하는 retry-now가 공개됐다. 분석, 개선, 검증 단계를 반복하며 코드베이스를 점진적으로 최적화한다. opencode, Codex CLI, Claude Code와 연동해 사용할 수 있다.

AI 에이전트를 통한 업무 자동화는 모든 기업의 화두다. 메타는 이를 위해 수천 명을 해고하며 조직 구조를 개편했다. 마크 저커버그는 최근 에이전트 개발 궤적이 기대만큼 가속하지 않았음을 인정했다.

AI 코딩 도구는 이제 개발자의 필수품이 됐다. 알리바바가 보안 위험을 이유로 사내 Claude Code 사용을 전면 금지했다. 미국 AI 기업의 추적 기능과 중국의 모델 증류 갈등이 촉발한 조치다.

AI 코딩 에이전트를 써도 결과물이 만족스럽지 않은 이유는 프롬프트 부족이 아니다. Claude Fable은 사용자가 정의하지 못한 '미지(Unknowns)'를 찾는 과정이 품질을 결정한다고 분석한다. 블라인드 스팟 패스와 구현 노트를 통해 지도와 영

ChatGPT 같은 모델만 좋다고 AI 에이전트가 똑똑하게 일하는 것은 아닙니다. 작업을 반복하고 검증하며 스스로 개선하는 4단계 '루프' 설계가 핵심입니다. 랭체인의 도구들을 활용해 단순 자동화를 넘어 자가 발전하는 시스템을 구축합니다.

AI 에이전트에게 과거 대화 기록을 기억시키면 더 똑똑해질 것이라 믿어왔습니다. 하지만 실제 테스트 결과, 세션 기록 검색 권한을 줘도 코딩 작업 성능 향상은 전혀 없었습니다. 오히려 불필요한 정보가 섞이며 토큰 비용만 늘고 모델 품질은 저하되는 결과

대규모 언어 모델의 상용화 단계에서 메모리 점유율과 추론 속도는 늘 해결해야 할 과제다. NVIDIA가 4비트 부동 소수점 양자화를 적용해 효율을 극대화한 Qwen3.6-27B NVFP4를 공개했다. 262K의 방대한 컨텍스트 윈도우와 멀티모달 능력을

AI 에이전트가 삶을 바꿨다는 과장된 성과를 공유하는 'AI 신뢰 극장(Confidence Theater)' 현상이 확산하고 있다. 전문 용어는 능숙하게 사용하지만 실제로는 단순 요약 수준의 워크플로우에 그치는 사례가 많으며, 이는 기업 내 성과 부풀

페디버스 서버 sukhi-fedi가 JSON-LD 조립과 HTTP 서명을 담당하던 fedify 라이브러리를 제거하고 Elixir로 자체 구현했다. Bun 워커의 메모리 부족(OOM) 문제와 프로세스 간 데이터 전송 오버헤드를 해결하기 위해 12개 파일

누구나 아는 샌드위치 가게가 상장 준비 서류에 AI를 언급했다. 저지 마이크스는 IPO 서류(S-1)에서 'AI'라는 단어를 22번이나 사용했다. 구체적인 활용법 없이 투자자 유혹을 위해 AI를 마케팅 도구로 쓴 사례다.

AI 에이전트가 코드를 다 짜준다는 '자동화 환상'이 개발 현장에서 퍼지고 있다. 하지만 보안이 중요한 시스템에서는 AI가 짠 비효율적인 코드가 치명적인 결함이 된다. AI를 린터로 쓰고 인간이 최종 검토하는 '숏리쉬' 방식이 대안이다.

AI 모델 하나에만 의존하는 것은 서비스 중단이라는 치명적인 리스크를 동반한다. 최근 Claude Fable 5의 갑작스러운 서비스 중단으로 벤더 종속 문제가 현실화됐다. 조사 대상 기업의 66%는 이미 폐쇄형과 오픈 웨이트 모델을 혼용하는 헷징 전략

AI 코딩 에이전트 변경 시 규칙과 맥락을 유지하는 CLI 하네스 VHK가 공개됐다. 규칙 파일 자동 동기화와 기계적 증거 기반의 완료 검증 기능을 제공한다.

AI 코딩 도구가 단순한 코드 작성을 넘어 실제 개발자의 업무를 대체하려 합니다. 시니어 엔지니어의 복잡한 기능 개발과 버그 수정을 평가하는 'Senior SWE-Bench'가 공개되었습니다. 최상위 모델인 Claude Opus 4.8조차 정답률 24