OpenAI Codex가 Chrome 확장으로 진입·주간 활성 4M(연초比 8x) + AWS Agent Toolkit·ServiceNow Build Agent GA — '코딩 에이전트 인프라'가 클라우드·SaaS 거버넌스 레이어로 한 주에 굳어졌다
2026년 5월 10일 일 · 5월 7일 OpenAI가 Codex Chrome 확장을 풀며 LinkedIn·Salesforce·Gmail 등 사인인 세션 위에서 동작하는 브라우저 네이티브 에이전트를 표준화했고, 같은 주 주간 활성 사용자가 4M(연초比 8x)·$100 Pro 티어가 함께 발표됐습니다. 5/6 AWS Agent Toolkit이 Claude Code·Cursor·Codex·Windsurf용 MCP 서버·스킬·플러그인 번들로 풀렸고, ServiceNow Build Agent도 같은 날 모든 메이저 코딩 툴에 GA로 들어가며 코딩 에이전트의 인프라 레이어가 클라우드·SaaS 양쪽에서 거버넌스와 함께 굳어진 한 주였습니다.
코딩 도구
OpenAI가 5월 7일 Codex Chrome 확장을 풀며 macOS·Windows의 백그라운드 탭에서 동작하는 브라우저 네이티브 에이전트로 Codex를 확장했습니다. 사용자의 사인인 세션을 그대로 활용해 LinkedIn·Salesforce·Gmail·내부 툴에 접근하고, 멀티 탭 컨텍스트를 읽어 웹 앱 테스트·DevTools 조작·플러그인이나 API로 처리 못 하던 브라우저 작업을 끝까지 돌립니다. 데스크톱 Codex의 Computer Use에서 '대부분의 워크플로가 브라우저에서 일어난다'는 관찰에 기반해 풀린 동선이고, Cursor 3.3 PR 리뷰 통합·ServiceNow Build Agent의 Cursor/Copilot 임베드와 같은 주에 발표되며 '에이전트가 IDE를 넘어 브라우저·SaaS 표면에 그대로 들어간다'는 5월 첫째 주 흐름의 정점이 됐습니다.
OpenAI Developers / MacRumors 원문 (새 창)Coder가 5월 6일 Coder Agents 베타를 풀며 '셀프 호스팅 + 모델 무관' 네이티브 코딩 에이전트 아키텍처를 처음으로 일반에 공개했습니다. 클라우드 VPC·온프렘·완전 에어갭 배포까지 같은 코드베이스로 돌아가고, 워크플로가 기업 네트워크 경계 안에서만 실행돼 모델·소스·프롬프트가 외부로 나가지 않습니다. 개발자는 대화형 인터페이스·API로 코드 작성·테스트 생성·레포 분석·PR 오픈을 위임하고, 플랫폼 팀은 모델 액세스를 중앙화·정책 강제·사용량 가시성을 한 곳에서 관리합니다. 4월 1일 $90M 펀딩 직후 풀린 이번 GA-급 베타는 SaaS·클라우드 메가벤더가 깔고 있는 매니지드 에이전트 레이어와 정확히 반대편에서 '온프렘·에어갭 코딩 에이전트' 카테고리를 처음 표준화한 사례입니다.
Coder / GlobeNewswire 원문 (새 창)Cursor가 5월 8일 Bugbot에 Learned Rules·MCP 통합을 풀며 'PR 리뷰가 사용자 피드백으로 자가 진화'하는 단계로 옮겼습니다. Bugbot이 자기 코멘트에 달린 리액션·답글, 그리고 사람 리뷰어 코멘트를 보고 후보 룰을 만들어 시그널이 누적되면 자동 프로모트, 신호가 약해지면 비활성화합니다. Teams·Enterprise 플랜은 Bugbot 대시보드에서 MCP 서버를 추가해 코드 리뷰 컨텍스트를 직접 확장할 수 있고, 해상도(resolution rate)는 80%에 근접하며 차순위 AI 코드 리뷰 제품 대비 +15pp를 기록합니다. 5/7 Cursor 3.3의 PR 리뷰 탭·Build in Parallel과 결합되며 'IDE 안 코드 리뷰가 사람·머신 시그널을 모두 내재화하는 진화 루프'가 처음 표준화됐습니다.
Cursor Changelog 원문 (새 창)Cognition(Devin 팀)에 인수된 Windsurf가 5월 'Fast and Comprehensive Code Review'를 풀며 Devin Review·Quick Review를 같은 워크스페이스 안에 통합했습니다. 자체 SWE-1.5 모델은 Sonnet 4.5 대비 13배 빠르고, SWE-grep 기반 Fast Context는 코드 검색을 10배 가속하며, 새 Codemaps는 코드 구조를 시각 지도로 그려 그룹·트레이스 가이드·라인 단위 링크를 제공합니다. Cursor Bugbot Learned Rules·5/7 Cursor 3.3 PR 리뷰 탭과 같은 주에 풀리며 '코드를 쓰는 모델 + 코드를 검사하는 모델 + 코드를 매핑하는 모델'이 한 IDE 안에 묶이는 새 IDE 표준이 메이저 3사 모두에 깔렸습니다.
Windsurf Changelog 원문 (새 창)OpenAI가 5월 7일 Codex Chrome 확장 출시와 함께 주간 활성 사용자 4M, 연초比 8배 성장 지표를 공개했고, 신규 $100/월 Pro 티어가 ChatGPT Plus($20/월) 대비 5배 사용량을 제공한다고 발표했습니다. 같은 발표에서 Auto-Review가 액션을 별도 에이전트가 정책 기준으로 검증해 인터럽션을 제거하며 200배 효율을 냈다고 공개했고, 백그라운드 세션이 더 이상 사용자 컨펌으로 멈추지 않게 됐습니다. Cursor의 $2B ARR(연초)·Lovable의 $300M ARR(1월)과 함께 '바이브 코딩이 SaaS 카테고리로 매스마켓 진입'을 정량 데이터로 처음 확정한 주가 됐고, 가격은 위로($100 Pro), 효율은 옆으로(Auto-Review), 분포는 아래로(WAU 4M) 동시에 확장되는 곡선이 굳어졌습니다.
OpenAI Developers / Engadget 원문 (새 창)프레임워크/오케스트레이터
AWS가 5월 6일 Agent Toolkit for AWS를 풀며 Claude Code·Cursor·Codex·Kiro·Cline·Windsurf 등 모든 메이저 코딩 에이전트가 AWS 위에서 빌드할 수 있는 공식 MCP 서버·Skills·Plugins 번들을 공급하기 시작했습니다. 플래그십은 AWS 서비스 API를 MCP 툴 콜로 노출하는 매니지드 MCP 서버로, 셀프 호스팅 없이 AWS가 직접 호스팅합니다. 기본 read-only 모드와 리소스 변경 액션에 대한 approval gate가 들어가 있어 엔터프라이즈 거버넌스를 OS 레벨에서 강제하고, 같은 주 ServiceNow Build Agent의 Cursor/Windsurf/Claude Code/Copilot 임베드와 함께 '클라우드·SaaS 벤더가 코딩 에이전트 인프라의 기본 레이어를 깐다'는 패턴이 표준 GA로 굳어졌습니다.
AWS / andrew.ooo 원문 (새 창)ServiceNow가 Knowledge 2026에서 Build Agent를 ServiceNow Studio에 GA로 풀고, 코어 스킬을 Cursor·Windsurf·Claude Code·GitHub Copilot에 SDK로 확장했습니다. Build Agent는 Anthropic 모델로 구동되며, '에이전트가 어느 IDE에 있든 ServiceNow AI Platform의 컨텍스트와 거버넌스를 그대로 끌고 들어간다'는 패턴을 표준화했습니다. App Engine Management Center가 무료로 풀려 배포 전 거버넌스를 강제하고, 재설계된 AI Agent Studio가 빌더가 에이전트를 만들고 스케일하는 동선을 단순화합니다. AWS Agent Toolkit과 같은 날 풀리며 'SaaS 플랫폼이 코딩 에이전트의 행동 영역을 정의·통제한다'는 5월 첫 주의 핵심 흐름을 굳혔습니다.
ServiceNow Newsroom 원문 (새 창)Prime Intellect가 5월 7일 Lab을 베타에서 일반 공개로 풀고, 자가 개선 에이전트의 트레이닝 환경을 단일 시스템으로 통합한 풀스택 플랫폼을 정식 가용하게 했습니다. 태스크 정의·평가 환경 구성·모델 평가·리워드 시그널 트레이닝·실행 트레이스 리뷰·LoRA 어댑터 배포·추론까지 한 파이프라인에서 처리하고, prime-rl 오픈소스 트레이닝 라이브러리를 기반으로 14개 모델·메이저 프로바이더에 걸친 파인튜닝을 지원합니다. 베타 기간 1만 회+ 트레이닝 런이 수학·소프트웨어 개발·엔터프라이즈 자동화 도메인에서 누적됐고, '포스트 트레이닝 + RL'이 일반 개발자가 GPU 클러스터·저수준 알고리즘을 만지지 않고 PaaS로 쓸 수 있는 첫 표준 GA가 됐습니다.
Prime Intellect 원문 (새 창)모델 출시/업데이트
5월 7일 기준 SWE-bench Verified 리더보드에서 Anthropic Claude Mythos Preview가 93.9%를 기록하며 Claude Opus 4.7 (Adaptive) 87.6%·GPT-5.3 Codex 85%를 모두 앞섰습니다. Mythos는 일반 공개 없이 방어/보안 컨소시엄(Project Glasswing)에만 풀리는 closed-for-defense 카테고리 모델인데, 5월 첫 주에 Mozilla Firefox 150 사전 빌드에서 271개 제로데이를 발견한 정량 사례와 함께 SWE-bench 정상까지 차지하며 '같은 모델이 코드 작성과 코드 보안 양쪽에서 동시에 SOTA'를 첫 공개 데이터로 보였습니다. 같은 리더보드에서 SWE-bench Pro(Scale AI)는 톱 모델이 아직 57%에 머물러 'Verified는 거의 푸는데 Pro는 절반대'라는 새 갭 구간이 또렷해졌습니다.
SWE-bench Leaderboard 원문 (새 창)엔지니어링 기법
OpenAI가 기증해 Linux Foundation Agentic AI Foundation(AAIF)이 스튜어드하는 AGENTS.md가 5월 첫 주 기준 6만 개+ 오픈소스 프로젝트에 채택됐습니다. Amp·Codex·Cursor·Devin·Factory·Gemini CLI·GitHub Copilot·Jules·VS Code 등 거의 모든 메이저 코딩 에이전트가 같은 포맷을 읽고, README와 분리된 빌드·테스트·컨벤션·툴체인 가이드를 단일 파일로 명세합니다. 같은 AAIF 산하 MCP·goose와 묶여 'AI 코딩 에이전트의 표준 트리오: MCP(연결 프로토콜) + AGENTS.md(레포 가이드) + goose(에이전트 프레임워크)'가 자리 잡았고, 5/6 AWS Agent Toolkit·ServiceNow Build Agent·Coder Agents 같은 인프라 출시들이 모두 AGENTS.md를 기본 입력으로 읽는 동선으로 풀려 표준 채택 곡선이 한 번 더 가속됐습니다.
AGENTS.md / Agentic AI Foundation 원문 (새 창)