Cursor 3.3 Bugbot Effort Levels + Claude Code Agent View 같은 날(5/11) 출시 — AWS MCP 서버 GA·AWS for SAP MCP·Copilot CLI 1.0.42 묶여 '코딩 에이전트 거버넌스 레이어'가 표준화된 한 주
2026년 5월 12일 화 · 5월 11일 Cursor가 Bugbot Effort Levels(Default/High/Custom)를 풀어 PR 리뷰의 정확도·비용 트레이드오프를 사용자 단위 자연어로 설정하게 했고, 같은 날 Anthropic은 Claude Code Agent View를 풀어 다중 병렬 세션을 하나의 CLI 대시보드에서 관리하게 했습니다. 같은 주 AWS MCP 서버 GA(IAM·CloudTrail·CloudWatch 가드레일), AWS for SAP MCP·Copilot CLI 1.0.42·QwenPaw v1.1.6과 묶여 '코딩 에이전트가 IAM/감사 레이어 아래에서 돈다'는 거버넌스 표준이 한 주에 동시 도착했습니다.
코딩 도구
Cursor가 5월 11일 Bugbot Effort Levels를 풀어 PR 리뷰의 추론 깊이를 Default·High·Custom 세 단계로 직접 설정할 수 있게 했습니다. Default는 기존 효율 최적화 수준(평균 0.7 bugs/run·머지 시점 해결율 79%+), High는 추론 시간이 길어지는 대신 평균 0.95 bugs/run의 발견율을 제공하고, Custom은 '핫픽스 브랜치는 High, 디자인 문서 PR은 Default'처럼 자연어로 트리거 규칙을 적습니다. Teams Admin·Individual 둘 다 가능하지만 사용량 기반 빌링이 전제이고, 같은 날 풀린 Claude Code Agent View·5/7의 Cursor 3.3 Composer 2·PR Review·Split PRs와 묶이며 '코드 리뷰 자체가 토큰 단위로 가격 차별화되는 첫 분기'가 본격 시작됐습니다.
Cursor Changelog 원문 (새 창)Anthropic이 5월 11일 Claude Code Agent View를 Research Preview로 풀어, 그동안 tmux 그리드·다중 터미널 탭으로 운영하던 병렬 에이전트 동선을 하나의 CLI 화면으로 통합했습니다. 좌측 화살표 키 또는 'claude agents' 명령으로 진입하면 각 행에 세션·입력 대기 여부·마지막 응답 요지·마지막 상호작용 시각이 표시되고, 입력 대기 중인 세션에는 인라인으로 답하거나 Enter로 풀 트랜스크립트에 attach할 수 있습니다. 5/10 Claude Code 데스크톱 리디자인(드래그앤드롭 워크스페이스·내장 터미널)에 이은 'CLI 쪽 응답'이고, Pro·Max·Team·Enterprise·Claude API에서 동일하게 켜져 '에이전트 다중 운영'이 단일 플랜 차별점이 아닌 카테고리 표준이 됐다는 신호로 읽힙니다.
Anthropic / Claude Blog 원문 (새 창)GitHub Copilot CLI가 5월 첫째 주 1.0.40~1.0.42를 연속 풀었습니다. 5/6 1.0.42는 MCP 서버 기동 실패 시 경고가 서버 이름에 공백이 포함된 경우에도 정확한 '/mcp show <name>' 명령을 그대로 복사·실행 가능하게 제안하도록 다듬어졌고, 5/5 1.0.41은 CLI가 인증을 백그라운드에서 처리하고 UI를 먼저 렌더하도록 바뀌어 콜드 스타트 체감 속도가 크게 개선됐습니다. 5/1 1.0.40은 모델 이름 길이와 무관하게 PR 브랜치 데코레이션이 푸터에 정확히 표시되도록 처리됐고, 6/1 사용량 기반 빌링 전환을 앞두고 '실패 경고가 즉시 실행 가능해야 한다'는 CLI 에이전트 UX 표준이 굳어진 릴리즈로 묶여 있습니다.
GitHub Copilot CLI Changelog 원문 (새 창)프레임워크/오케스트레이터
AWS가 5월 6일 AWS MCP Server를 GA로 풀어, Claude Code·Cursor·Kiro 같은 코딩 에이전트가 IAM 가드레일·CloudWatch 메트릭·CloudTrail 감사 로깅 아래에서 AWS API 전 범위를 단일 툴로 호출할 수 있게 했습니다. re:Invent 2025 프리뷰 대비 파일 업로드·롱러닝 작업 호출이 추가됐고, 샌드박스 Python 실행이 들어와 로컬 파일시스템·셸 접근 없이도 멀티스텝 자동화가 가능합니다. Agent Toolkit for AWS의 코어 컴포넌트로 위치하고 서비스 자체는 추가 비용 없이 실제 AWS 리소스 사용량만 과금돼, '코딩 에이전트의 클라우드 자격증명 노출' 문제가 매니지드 서버 레이어로 표준 해결되는 첫 1st-party 사례가 됐습니다.
AWS News Blog 원문 (새 창)AWS가 같은 주 AWS for SAP MCP Server를 Amazon Bedrock AgentCore에서 GA로 풀어, AWS MCP Server GA의 'SAP 워크로드 전용 버전'을 별도 매니지드 서버로 분리해 출시했습니다. SAP 시스템 운영·통합 작업을 코딩 에이전트가 IAM 가드레일·감사 로깅 아래에서 호출할 수 있는 첫 1st-party 채널이고, AgentCore 위에서 도는 에이전트들이 SAP RFC·BAPI·OData를 직접 호출하는 동선이 표준화됐습니다. 같은 주 Claude Finance Agent Templates·ServiceNow Build Agent와 묶이며 'IDE 외부의 도메인 에이전트' 라인이 ERP·SaaS 거버넌스 양쪽에서 같은 시기에 출하된 한 주가 됐습니다.
AWS What's New 원문 (새 창)AgentScope 그룹이 5월 9일 QwenPaw v1.1.6을 풀어, 자체호스팅 Qwen 기반 에이전트를 사내 채팅 도구와 묶어 운영하는 동선을 한층 다듬었습니다. LLM이 자동으로 세션 제목을 부여하고, 토큰 사용 트렌드를 시계열로 보여주며, Mermaid 다이어그램 렌더·Feishu/WeCom 인터랙티브 승인 카드가 들어와 '에이전트가 액션을 제안하면 사내 메신저에서 바로 승인'하는 워크플로가 오픈웨이트 라인에서도 표준화됐습니다. 같은 주 AWS MCP Server GA(IAM/CloudTrail)와 묶이며 '코딩 에이전트 거버넌스'가 폐쇄 클라우드와 오픈웨이트 자체호스팅 양쪽에서 동시에 표준화된 한 주가 됐습니다.
AgentScope / GitHub 원문 (새 창)모델 출시/업데이트
Air Street Press 'State of AI: May 2026' 정기 보고서가 5월 첫째 주에 4개 중국 랩이 12일 윈도우 안에 오픈웨이트 코딩 모델을 동시에 풀었다고 정리했습니다. Z.ai GLM-5.1·MiniMax M2.7·Moonshot Kimi K2.6·DeepSeek V4가 agentic engineering 벤치에서 사실상 같은 천장에 도달했고, 폐쇄 프론티어 대비 의미 있게 낮은 추론 단가로 출시됐습니다. GLM-5.1 출시일 Zhipu 종가 +15.92%, MiniMax의 시연은 M2.7이 자기 스캐폴드를 100+ 라운드 자가 최적화하는 트레이스였고, Kimi K2.6의 시연은 12시간 연속 툴 사용으로 인퍼런스 엔진을 Zig로 포팅한 트레이스로 풀렸습니다. 5/1 DeepSeek V4-Pro 1.6T·1M 컨텍스트와 묶이며 '오픈웨이트 5사 동시 출하'가 폐쇄 갭을 분기 단위로 좁힌 첫 측정 시점이 됐습니다.
Air Street Press / LLM Stats 원문 (새 창)Anthropic의 Claude Mythos Preview가 5월 발표된 측정에서 32-step 엔드투엔드 사이버 공격 레인지를 한 달 안에 클리어해 보였습니다. OpenAI GPT-5.5도 같은 레인지를 3주 후 통과하며, 두 프론티어 모델이 단일 측정으로 같은 천장을 단기간에 함께 넘은 첫 사례가 됐습니다. 5/9 Claude Security 퍼블릭 베타(Opus 4.7 기반 취약점 스캔)·5/8 'Is Vibe Coding Safe?' arXiv(SWE-Agent+Claude 4 Sonnet 보안 통과율 10.5%)와 묶이며, '에이전트의 공격 능력'과 '에이전트 생성 코드의 보안 통과율' 두 축이 같은 분기에 동시 측정 가능해진 첫 시점으로 정리됩니다. red.anthropic.com 측 자료에 따라 일부 능력 디테일은 RSP(Responsible Scaling Policy) 평가의 일부로 단계적 공개됩니다.
Anthropic Research / red.anthropic.com 원문 (새 창)엔지니어링 기법
Education Week가 5월에 발표한 케이스 스터디에 따르면 미국 Peninsula 학군이 Claude Code를 바이브 코딩 워크플로로 활용해 AI 레슨 피드백 도구 'LessonLens'를 사내 구축했고, 같은 도구를 외주·SaaS로 도입했을 때 대비 연 약 $220,000을 절감할 것으로 예상한다고 밝혔습니다. 'PM·교사가 직접 자연어로 코드를 의뢰하고 검토'하는 동선이 비-기술 조직의 IT 예산을 정량적으로 줄인 첫 카테고리 측정 사례로, 같은 주 Simon Willison의 '바이브 코딩과 agentic engineering 경계 흐려짐' 진단·CSA SSLab의 91.5% 취약 데이터와 묶여 '바이브 코딩이 ROI를 입증한 첫 분기지만 보안 부채는 동시에 표면화되는 분기'라는 양면 구도를 굳혔습니다.
Education Week 원문 (새 창)