Agent Stack Radar
에이전트 스택 변화를 한 줄 판단으로
◑
지금 에이전트 스택에서 바뀐 것
모든 판정은 최소 2개의 확인 가능한 출처를 요구하며, 커뮤니티 반응만으로 채택·회피를 내리지 않습니다.
편집 원칙 →
접근은 막혔지만 구조는 바뀌었다 — Fable 5·Mythos 5가 에이전트 빌더에게 주는 전망
출시 사흘 만에 전 세계에서 꺼졌다 — 미 정부가 Claude Fable 5·Mythos 5를 수출규제로 중단시킴
Fable 5엔 thinking budget을 손으로 못 준다 — 새 최상위 모델에서 프롬프트가 바뀐 지점
무료 체험이었는데 $1,081 청구서가 왔다
Claude Code를 만든 사람은 더 이상 프롬프트를 치지 않는다
토큰 청구서가 왔다: 코딩 에이전트의 다음 병목은 회계다
루프 엔지니어링: 이제 프롬프트하는 시스템을 설계한다
AI 에이전트의 첫 대중 인터페이스는 IDE가 아니라 메시지일 수 있다
OpenAI AgentKit 종료 신호는 코드 소유 Agents SDK 경로를 우선하게 만든다
Copilot SDK GA는 코딩 에이전트를 앱 안에 넣는 경계를 열었다
MCP 2026-07-28 RC는 최종 스펙이 아니라 거버넌스 변화를 예고했다
NSA의 MCP 보안 고려사항은 프로토콜 운영 점검표가 필요하다는 신호다
Claude Managed Agents self-hosted sandbox는 실행 경계를 사용자 인프라로 옮긴다
MCP Atlas는 실제 서버 기반 도구 평가를 에이전트 품질 기준으로 올렸다
Docker MCP Custom Catalogs와 Profiles GA는 도구 배포 거버넌스를 구체화했다
노션은 메모 앱이 아니라 에이전트 작업장이 되려 한다
METR time horizon은 에이전트 평가를 인간 작업 길이 기준으로 읽게 했다
프롬프트는 PR 설명이 됐다: AI 코드 리뷰는 의도부터 본다
에이전트 회계학: 토큰을 많이 쓴 사람이 생산적인 사람은 아니다
Cursor TypeScript SDK는 코딩 에이전트 실행 환경을 제품 안으로 열었다
Devin CLI는 로컬 터미널과 클라우드 에이전트 사이의 인계 흐름을 드러냈다
세션 기억 vs 제품 기억: supermemory는 agentmemory를 대체할 수 있을까
Cloudflare Browser Run은 에이전트용 브라우저 실행을 Cloudflare 계정 안으로 넣었다
Cloudflare Project Think는 장기 실행 에이전트 기반을 넓힌다
E2B의 OpenAI Agents SDK 통합은 에이전트 실행환경을 제품 기능으로 올렸다
HIL-Bench는 에이전트가 언제 질문해야 하는지를 평가 대상으로 만들었다
Microsoft Agent Framework 1.0은 Semantic Kernel/AutoGen 수렴의 생산 단계 신호다
Google ADK for Java 1.0.0은 기존 Java 백엔드에 에이전트 선택지를 열었다
177,000개 MCP 도구 연구는 도구 계층 평가가 필수 게이트가 됐다는 최신 신호다
Dapr Agents 1.0 GA는 분산 시스템 기반 에이전트 프레임워크를 전면에 세웠다
A2A v1.0.0은 에이전트 간 상호운용 프로토콜을 구체화했다
에이전트 정책 파일은 시스템 프롬프트를 대신하지 않는다
NIST AI Agent Standards Initiative는 에이전트 표준 논의를 공공 의제로 올렸다
WebMCP는 웹앱이 브라우저 안에서 에이전트 도구를 노출하는 방향을 열었다
Vercel Sandbox GA는 에이전트 코드 실행을 Vercel 앱 흐름 안으로 가져왔다
에이전트 시대의 취향: 무엇을 버릴지 아는 사람이 이긴다
MCP Apps는 도구 결과를 대화형 UI로 바꾸는 첫 공식 MCP 확장이다
APEX Agents는 전문직 장기 멀티앱 업무 자동화 주장에 현실성 검사를 요구한다
Mastra 1.0은 TypeScript agent framework의 production API 고정 신호다
Vercel AI SDK 6는 TypeScript 앱 안의 Agent 추상화를 실전 표면으로 만들었다
Gemini Interactions API는 모델 호출과 관리형 에이전트를 한 표면으로 묶기 시작했다
OWASP Agentic Top 10 2026은 에이전트 보안을 별도 위험 목록으로 정리했다
운영의 첫 화면이 바뀐다: 대시보드보다 에이전트에게 먼저 묻는다
Amazon Nova Act는 브라우저 조작 에이전트를 AWS 제품선 안으로 넣었다
MCP 2025-11-25는 tasks, elicitation, authorization을 운영 기준으로 올렸다
Google Antigravity는 코딩 에이전트 경쟁을 개발 표면 전체로 넓혔다
Terminal-Bench 2는 터미널 에이전트 평가를 더 현실적인 작업군으로 넓혔다
Langfuse for Agents는 에이전트 실행 추적을 평가의 앞단으로 끌어왔다
OpenHands Software Agent SDK는 연구용 에이전트 구성 요소를 제품 코드 쪽으로 끌어왔다
Rule of Two는 에이전트 보안 설계를 현실적인 분리 원칙으로 낮췄다
Stagehand v3는 브라우저 에이전트를 Playwright 스크립트와 블랙박스 사이에 세웠다
LangSmith 멀티턴 평가는 에이전트 품질 판단을 단일 실행 기록에서 전체 대화로 옮겼다
LangChain 1.0 GA는 표준 에이전트 API를 안정화 기준으로 올렸다
LangGraph 1.0 GA는 장기 실행 에이전트의 지속 상태를 제품 기준으로 올렸다
Anthropic Agent Skills는 에이전트 지식을 무한 컨텍스트가 아니라 파일 단위로 포장했다
Amazon Bedrock AgentCore GA는 에이전트 프레임워크 비교를 운영 계층 비교로 바꾼다
HAL은 에이전트 순위보다 평가 하네스의 신뢰성을 전면에 둔다
Gemini 2.5 Computer Use는 브라우저 조작을 모델 기능으로 끌어올렸다
OpenAI Apps SDK는 MCP 서버를 ChatGPT 안의 대화형 앱 표면으로 확장했다
GitHub Copilot coding agent 정식 공개는 저장소 작업 위임을 기본 선택지로 올렸다
Chrome DevTools MCP는 브라우저 진단을 에이전트 도구 경계 안으로 넣었다
SWE-bench Pro는 코딩 에이전트 평가 난도를 다시 끌어올렸다
MCP Registry 프리뷰는 서버 발견 문제를 공식 인프라 문제로 끌어올렸다
Cloudflare Signed Agents는 봇 인증을 선언이 아니라 서명 검증 문제로 바꿨다
Agent Client Protocol은 편집기와 에이전트 사이의 교체 가능한 경계를 제안했다
Playwright MCP는 브라우저 자동화 에이전트의 실용 기준점이 됐다
Temporal의 OpenAI Agents SDK 통합은 에이전트 실행을 내구 작업으로 바꾼다
OSWorld-Verified는 컴퓨터 사용 평가의 과제 품질 문제를 드러냈다
보안 에이전트를 속이는 악성코드: 프롬프트 주입은 스캐너도 겨냥한다
Gemini CLI 공개는 구글 에이전트 개발 경험을 터미널에서 시작하게 했다
MCP 2025-06-18 스펙은 원격 전송과 권한 경계를 표준 논의 중심으로 올렸다
promptfoo 에이전트 레드팀 기능은 도구 사용 실패를 보안 검사 대상으로 올렸다
Dagger Container Use는 에이전트 작업을 컨테이너 단위로 격리하는 실험을 제시했다
MLflow 3는 에이전트 평가와 관측성을 실험 관리 안으로 합쳤다
RedTeamCUA는 컴퓨터 사용 에이전트의 위험 행동을 직접 겨냥했다
Claude Code Agent SDK는 터미널형 코딩 에이전트를 외부 앱에 붙이는 통로가 됐다
Azure AI Foundry Agent Service GA는 기업형 에이전트 서비스를 Azure 표준 후보로 올렸다
NLWeb은 웹사이트가 대화형 질의 경계를 직접 제공하는 방향을 제시했다
AWS Strands Agents는 모델 주도 도구 호출을 AWS식 운영 선택과 함께 가져온다
OpenAI Codex는 클라우드 코딩 에이전트를 제품 표면으로 만들었다
AG-UI는 MCP/A2A 옆의 에이전트-프론트엔드 상호작용 계층으로 봐야 한다
WASP는 웹 에이전트 보안을 평가할 수 있는 공격 과제를 공개했다
BrowseComp는 웹 탐색 능력을 긴 검색 과제로 재측정했다
IBM BeeAI는 다중 에이전트 상호운용을 거버넌스 문제로 끌어올린다
OpenAI의 2025-03-11 Agents SDK 공개는 코드 중심 작업 조율과 실행 추적을 묶었다
OpenTelemetry GenAI 규약은 에이전트 관측성을 벤더 밖으로 꺼낸다
Vertex AI Agent Engine GA는 관리형 에이전트 배포를 구글 클라우드 기준으로 만들었다
AgentHarm은 에이전트 안전성 평가를 악성 작업 수행 여부까지 확장했다
LlamaIndex AgentWorkflow는 데이터 중심 앱에 더 선명한 에이전트 작업 흐름을 준다
Modal Sandboxes GA는 코드 에이전트의 격리 실행을 제품 기능으로 만든다
AutoGen v0.4는 Microsoft 에이전트 경로의 전환점을 남겼다
smolagents는 작은 Python 코드 에이전트를 빠르게 실험하게 한다
Inngest AgentKit과 step.ai는 에이전트를 내구 백엔드 단계로 본다
AISI 평가 저장소 공개는 에이전트 벤치마크를 재사용 가능한 체계로 묶었다
Pydantic AI는 Python 빌더에게 타입과 평가를 먼저 잡는 에이전트 프레임워크다
CrewAI는 역할 기반 설명성이 있지만 로그/실행 추적 마찰 커뮤니티 신호가 있다