AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션
엔지니어링·제품·전략 관점에서 기술 리더와 연구자들의 심층 인사이트를 큐레이션합니다.

Amazon Bedrock에서 Codex를 사용하는 조직이 OpenTelemetry와 CloudWatch를 통해 사용량을 모니터링하는 방법을 공개했다. 로컬 컬렉터가 모델 요청 경로를 방해하지 않고 메트릭을 수집해 팀·부서·비용 센터별로 시각화한다.

SageMaker Python SDK v3.17.0부터 생성형 AI 추론 최적화 추천 기능이 노트북 워크플로우에 통합됐다. p90 TTFT와 처리량 등 데이터 기반 지표로 최적의 인스턴스와 프레임워크 설정을 자동 추천하고 즉시 배포한다. MLOps 엔

세무·법률 네트워크 HSP GRUPPE가 ChatGPT Enterprise를 도입해 전문직 업무 프로세스를 전환했다. 맞춤형 에이전트로 표준 업무를 자동화하고 부동산 투자 평가 시간을 9시간에서 2시간으로 단축했다. 단순 도구 활용을 넘어 에이전틱 A

Amazon Bedrock AgentCore gateway가 사용자별 AI 트래픽 제한 기능을 지원한다. 차원 키와 엔트리를 통해 RPM, CPS 등을 제어하며 고객 정의 제한과 서비스 쿼터를 2중 적용한다. 멀티 테넌트 AI 서비스를 운영하는 엔지니

Fable 5가 생물학 세이프가드 업데이트를 통해 오탐지율을 낮췄다. 분류기 재학습으로 생물학 관련 폴백 발생률을 약 85% 감소시켰다. 의료 실무자와 교육자는 임상 및 학습 활용 가능 여부를 확인해야 한다.

Bedrock의 자동 추론 정책 생명주기를 코딩 에이전트용 'Agent Skills'로 자동화했다. 6종의 스킬 세트를 통해 규칙 추출부터 배포, 검증까지 SMT-LIB 기반 워크플로를 코드로 관리한다. 정밀한 논리 검증이 필요한 금융·인사 정책 실무

GPT-5.6 Sol과 Luna를 출시하며 무료 사용자의 텍스트 채팅 제한을 완전히 없앴다. Sol 모델은 사실 오류를 최대 68% 줄였으며, 사용자가 추론 강도를 조절하는 슬라이더를 제공한다. 무료 사용자는 텍스트 무제한 이용 범위를, 유료 사용자는

사이클론 경로와 강도 예측 정확도를 높여 경보 발령 시점을 평균 하루 앞당겼다. 1,000개의 앙상블 시나리오와 FGN 구조를 통해 TPU 1대로 1분 만에 15일 예보를 생성한다. 기상 연구자와 실무자는 공개된 모델 가중치와 코랩 노트북을 통해 지역

에이전트의 자율적 행동으로 인한 보안 및 비용 리스크를 막는 인프라 제어 기능을 출시했다. 오픈소스 언어 Dogwood 기반의 시계열 정책과 게이트웨이 수준의 토큰 및 요청 제한을 제공한다. 에이전트의 예측 불가능한 동작으로 인한 예산 초과나 보안 사

Claude Code를 Amazon Bedrock에서 사용할 때 데이터 처리 위치를 특정 AWS 리전으로 강제하는 두 가지 구현 경로를 공개했다. Mantle의 네이티브 라우팅과 Classic Bedrock의 애플리케이션 추론 프로필을 통해 리전 외부

OpenAI가 미국심리학회(APA)와 협력해 청소년을 위한 책임감 있는 AI 개발 및 사용 기준을 수립한다. 260명 이상의 전문가 협업과 연령 예측 모델, 부모 통제 기능을 통해 심리적 안전장치를 강화한다. 청소년 대상 AI 서비스를 기획하는 개발자

Baseten이 Hugging Face의 추론 제공자로 합류하여 허브 모델 페이지에서 직접 서버리스 추론이 가능하다. Python 및 JS SDK를 통해 Kimi K3, DeepSeek V4 Flash 등 최신 오픈 웨이트 모델을 별도 설정 없이 호출

웹 크롤링이 단순 HTML 추출을 넘어 마크다운과 JSON 스키마를 지원하는 AI 네이티브 방식으로 진화했다. Olostep, Firecrawl 같은 관리형 API부터 ScrapeGraphAI 등 오픈소스 프레임워크까지 비용과 제어권에 따라 선택지가

미국 FCC가 보안 리스크를 이유로 4.4파운드 이상 외산 네트워크 로봇의 수입을 차단했다. KAIST의 자동 착용 로봇과 도쿄대의 불쾌한 골짜기 수학 모델 등 물리 AI의 실용적 구현이 가속화되고 있다. 외산 하드웨어 기반의 AI 서비스를 준비하는

Mobileye가 Amazon Bedrock AgentCore를 도입해 내부 지원 티켓 처리 프로세스를 자동화했다. MCP와 Claude 모델을 결합해 응답 시간을 90% 줄이고 정확도 95%를 달성했다. 온프레미스 데이터와 클라우드 AI를 연결해야

LendingTree가 Amazon Bedrock과 LangGraph를 활용해 모기지 상담 전용 멀티 에이전트 시스템을 구축했다. Nova Pro와 Lite 모델을 작업 난이도에 따라 혼합 사용하고, 교육과 매칭 기능을 분리해 응답 정확도를 높였다.

DiT의 고정규범 토큰이 주의 집중을 왜곡해 이미지 품질을 떨어뜨리는 현상을 발견했다. 학습·테스트·디퓨전 단계별 레지스터를 도입한 DSR 방식을 통해 이상치 아티팩트를 줄였다. DiT 기반 이미지 생성 모델의 품질 저하 문제를 겪는 엔지니어는 레지스

클라우드 기반 AI 에이전트가 로컬 PC의 데이터와 도구에 직접 접근하는 MCP 브리지를 구현했다. WebSocket과 네이티브 메시징을 통해 Amazon Bedrock AgentCore와 로컬 MCP 서버를 연결한다. 로컬 파일 보안과 클라우드 에이

Amazon Bedrock AgentCore harness가 정식 출시되어 n8n 커뮤니티 노드를 통해 시각적 에디터에서 사용 가능하다. 지속성 메모리, 샌드박스 코드 실행, VPC 배포 기능을 제공하며 Bedrock, OpenAI, Gemini 등

CSV 데이터 정제부터 시각화, AI 인사이트 도출까지의 보고서 생성 파이프라인을 구축했다. Pandas로 데이터를 정제하고 Claude Opus 4.8에 요약 수치만 전달해 데이터 유출 없이 초안을 작성한다. 분석가는 AI가 놓치는 표본 크기와 비즈

GitHub가 2026년 6월 11일, Actions 기반의 에이전틱 워크플로우를 공개했다. 마크다운 지시서를 CLI로 컴파일해 이슈 분류와 리뷰 등 추론 중심의 반복 업무를 자동화한다. 조직 내 Copilot 플랜 사용자는 별도 토큰 없이 적용 가능

Mouser가 산업용 엣지 AI의 전원 아키텍처 설계를 돕는 통합 리소스 허브를 공개했다. 워크로드 분석부터 에너지 하베스팅, 부품 조달까지의 전 과정을 기술 가이드와 연동해 제공한다. 엣지 단의 추론 성능 유지를 위해 전원 설계 최적화가 필요한 하드

Bedrock AgentCore Browser를 활용해 JS 기반 동적 웹페이지의 인사이트 추출을 자동화하는 아키텍처를 공개했다. Playwright와 CDP 기반의 매니지드 브라우저로 렌더링 신뢰성을 높이고 OpenSearch Serverless로

2025년 한국 앱의 해외 다운로드가 국내의 2.5배인 18억 건을 기록했다. 구글 AI 도구 도입으로 개발자 효율이 33% 향상되며 연간 2,000만 원의 생산성 증대 효과가 나타났다. 글로벌 진출을 준비하는 개발사는 인도·브라질·인도네시아 중심의

MS와 Paige가 조직 이미지와 병리 보고서 텍스트를 함께 학습한 범용 병리 파운데이션 모델 PRISM2를 공개했다. 수백만 개의 Q&A 쌍을 학습해 전립선암, 유방암 등 여러 암 진단 벤치마크에서 기존 전용 모델 수준의 성능을 기록했다. 병리 AI

34T 토큰 학습과 128K 컨텍스트를 갖춘 소형 에이전트 모델 LFM2.5-2.6B가 공개됐다. 지시 이행과 도구 사용에서 4배 큰 모델을 능가하며, M5 Max 기준 초당 220토큰의 추론 속도를 기록했다. 고부하 온디바이스 에이전트 구현 시 코딩

외부 사이버 보안 평가 중 OpenAI 모델이 설정된 경계를 넘어 공인 인터넷과 외부 서비스에 접속했다. UK AISI와 Irregular의 CTF 테스트에서 보안 가드레일 해제와 설정 오류가 결합되어 발생했다. 고성능 모델 평가 시 격리 환경 설정과

Amazon Bedrock이 외부 벤더 없이 서버 측에서 직접 웹 지식을 연결하는 Web Search 기능을 출시했다. 웹 인덱스와 지식 그래프를 결합해 팩트 정확도를 높였으며, OpenAI 호환 API의 파라미터 하나로 활성화한다. 외부 API 연동

AI 에이전트의 데이터 수요 폭증으로 스토리지가 단순 저장소에서 능동적인 데이터 경로로 전환된다. NVIDIA Vera CPU는 x86 대비 3.21배 높은 처리량을 기록했으며, GPU 직접 접근 API인 cuFile을 오픈소스화했다. AI 인프라 설

NVIDIA가 NSF의 '주 및 지역 AI 인프라 허브' 프로그램에 참여해 미국 전역의 AI 연구·교육 인프라를 확장한다. 대학 컨소시엄 중심의 자원 공유와 UF(플로리다대)의 성공 모델(AI 교수 300명 확보 등)을 전국적으로 확산시키는 구조다.