Claude Code 2.1.138 MCP 영속성 픽스 + 데스크톱 앱 풀 리디자인·SpaceX 컴퓨트로 5h 리밋 2배 + Claude Security 퍼블릭 베타 — '바이브 코딩 보안 부채'가 SSLab 35 CVE·91.5% 취약 데이터로 같은 주 동시에 터졌다

2026년 5월 11일 월 · Anthropic이 5월 9~10일 사이 Claude Code 2.1.138(/clear 후 MCP 사라짐·OAuth 토큰 동시 갱신 픽스), 병렬 세션·드래그 워크스페이스를 깐 데스크톱 앱 풀 리디자인, SpaceX 컴퓨트 계약을 기반으로 한 5시간 리밋 2배 확장, 그리고 Claude Security 퍼블릭 베타(Opus 4.7 기반 취약점 스캔)를 한 주에 묶어 풀었습니다. 같은 주 CSA·Georgia Tech SSLab가 'AI 생성 코드 91.5%가 1개 이상 취약점·SWE-Agent+Claude 4 Sonnet 기능 정답률 61%지만 보안 통과율 10.5%' 데이터를 공개해, '바이브 코딩의 보안 부채'가 카테고리 차원의 측정 가능한 위협으로 첫 표면화된 한 주가 됐습니다.

코딩 도구

Claude Code 2.1.138 (5/9) — /clear 후 MCP 서버·플러그인·커넥터 사일런트 사라짐 픽스, OAuth 토큰 동시 갱신 손실 픽스, VS Code·JetBrains·Agent SDK 공통
RELEASE9/10

Anthropic이 5월 9일 Claude Code 2.1.138을 풀며 SDK 시대 워크플로의 가장 잦은 '에이전트 컨텍스트 유실' 버그를 한 번에 처리했습니다. VS Code 확장·JetBrains 플러그인·Agent SDK에서 .mcp.json·플러그인·claude.ai 커넥터가 /clear 직후 사일런트로 사라지던 버그가 픽스됐고, 여러 MCP 서버가 동시에 OAuth 리프레시 토큰을 갱신할 때 토큰이 유실돼 강제 재로그인 루프가 발생하던 희소 버그도 정리됐습니다. 인디크 결합·ZWJ 이모지 줄바꿈에서 Ctrl+E/A/K/U 커서 깨짐, Cursor·VS Code 1.92~1.104의 xterm.js 휠 가속 버그, JetBrains 2025.2 터미널 휠도 같은 릴리즈에서 처리돼 'SDK 위에서 도는 멀티-MCP 워크플로'가 처음으로 안정 등급으로 굳어졌습니다.

Claude Code GitHub Releases 원문 (새 창)
Claude Code 데스크톱 앱 풀 리디자인 — 세션 사이드바·드래그앤드롭 워크스페이스·내장 터미널·파일 에디터·Mac SSH, 'IDE 외부 코딩 에이전트 클라이언트'가 본격화
RELEASE8/10

Anthropic이 같은 주 Claude Code 데스크톱 앱을 풀 리디자인해 풀었습니다. 세션 사이드바로 다중 세션을 좌측에서 동시 관리하고, 드래그앤드롭 워크스페이스로 폴더·파일을 그대로 끌어 넣을 수 있고, 내장 터미널·파일 에디터·확장된 미리보기·고속 diff·맥 SSH 지원까지 들어와 IDE 외부에서도 '코딩 에이전트 클라이언트' 자체로 완결됩니다. 5/7 Cursor 3.3 PR 리뷰·Build in Parallel·Windsurf Devin Review와 묶이며 '코딩 에이전트 UI가 IDE 안과 밖 두 갈래로 동시에 분기'한다는 5월 첫 주 흐름의 Anthropic 쪽 응답이 됐습니다.

Anthropic / Claude Code Docs 원문 (새 창)
Anthropic × SpaceX 컴퓨트 계약 + Claude Code 5시간 리밋 2배 확장 — Pro·Max·Team·Enterprise(좌석) 동일 적용, 피크아워 감축 폐지
RELEASE8/10

Anthropic이 SpaceX와의 신규 컴퓨트 계약을 포함한 일련의 인프라 딜로 Claude API·Claude Code의 가용 컴퓨트를 큰 폭으로 확보하고, Claude Code 5시간 윈도우 사용량 한도를 Pro·Max·Team·좌석형 Enterprise 전체에서 2배로 늘렸습니다. 같은 발표에서 Pro·Max 계정의 피크아워 한도 감축 정책이 폐지돼 시간대별 부하 분산을 사용자에게 떠넘기던 동선이 사라졌습니다. OpenAI Codex가 5/7 WAU 4M·연초比 8x를 공개한 같은 주에 풀린 응답이고, '코딩 에이전트 매스마켓 진입기 = 인프라 확보전'이라는 구조가 처음 가격·정량 양쪽에서 동시 노출된 한 주가 됐습니다.

Anthropic / Releasebot 원문 (새 창)
Claude Security 퍼블릭 베타 (Enterprise) — Opus 4.7 기반 코드 취약점 스캔·자동 픽스 제안, 스케줄/타깃 스캔·트리아지 추적·익스포트·워크플로 통합
RELEASE8/10

Anthropic이 Claude Enterprise 고객 대상 Claude Security를 퍼블릭 베타로 풀며 'AI 생성 코드 자체에 대한 보안 진단'을 메인 제품 카테고리로 진입시켰습니다. Opus 4.7 기반으로 코드 취약점을 식별하고 자동 픽스를 제안하며, 스케줄 스캔·특정 디렉토리/PR 타깃 스캔·트리아지 추적·익스포트·기존 SDLC 워크플로 통합을 갖춥니다. 같은 주 Snyk×Anthropic 파트너십과 묶이며 'Claude가 코드를 쓰고, Claude가 코드를 진단하고, Snyk가 코드를 거버넌스한다'는 3-레이어 보안 동선이 표준화되기 시작했고, 5/9의 Vibe Security Radar·CSA 보고서와 같은 주에 풀려 '바이브 코딩 보안 부채'에 대한 첫 벤더 응답이 됐습니다.

Anthropic Release Notes 원문 (새 창)
GitHub Copilot Usage-Based Billing 6/1 전환 — 5월 초 '프리뷰 빌' 가시화, Copilot Enterprise $39/seat 유지·6~9월 한시적 7,000 AI Credits 부스트
RELEASE9/10

GitHub가 5월 초 모든 Copilot 플랜의 6월 1일 사용량 기반 과금 전환을 앞두고 '프리뷰 빌' 경험을 풀어 사용자·관리자가 github.com Billing Overview에서 전환 후 예상 비용을 미리 확인할 수 있게 했습니다. Copilot Enterprise는 $39/user/월 단가가 유지되고 같은 금액의 AI Credits($39)가 포함되며, 기존 Enterprise 고객은 6/1~9/1까지 한시적으로 표준 3,900 대비 약 7,000 크레딧을 받습니다. 토큰(입력·출력·캐시드) 단위 모델 API 레이트로 계산되고, 코드 컴플리션·Next Edit suggestions는 모든 플랜에서 크레딧 소비 없이 포함됩니다. OpenAI Codex 4M WAU·$100 Pro 티어와 묶이며 'AI 코딩 도구의 가격 모델이 좌석제→토큰제로 한 주에 동시 전환'한다는 흐름이 굳어졌습니다.

GitHub Blog / GitHub Docs 원문 (새 창)

엔지니어링 기법

CSA × Georgia Tech SSLab 'Vibe Security Radar' (5월) — 3월 한 달간 AI 생성 코드 직접 원인 신규 CVE 35건, Q1 200+ 바이브 코딩 앱 91.5%가 환각 기인 취약점 보유
8/10

Cloud Security Alliance가 Georgia Tech의 Systems Software & Security Lab과 공동 운영하는 Vibe Security Radar의 첫 분기 측정치가 5월에 공개됐습니다. 2026년 3월 한 달 동안 디스클로즈된 35건의 신규 CVE가 AI 생성 코드의 직접 결과로 확인됐고, Q1 동안 200개 이상의 바이브 코딩 앱을 측정한 결과 91.5%가 AI 환각에 기인한 취약점을 한 개 이상 갖고 있었으며 60% 이상이 API 키·DB 자격증명을 퍼블릭 레포에 노출했습니다. 'SWE-bench가 푸는 문제'와 '실제 안전한 코드' 사이의 정량 갭이 처음으로 카테고리 단위 데이터로 노출됐고, 5/9의 Snyk×Anthropic·Opsera×Cursor 보안 파트너십과 같은 주에 풀려 '바이브 코딩 보안 부채'가 측정 가능한 위협으로 첫 표면화됐습니다.

CSA Research / Cloud Security Alliance Labs 원문 (새 창)
arXiv 2512.03262 'Is Vibe Coding Safe?' — SWE-Agent+Claude 4 Sonnet 기능 정답률 61% vs 보안 통과율 10.5%, '에이전트 생성 코드의 실제 취약성' 벤치마크 첫 공개
8/10

arXiv에 5월 초 공개된 'Is Vibe Coding Safe? Benchmarking Vulnerability of Agent-Generated Code in Real-World Tasks' 논문이 에이전트가 자율적으로 생성한 코드의 실제 취약성을 카테고리 단위로 측정해 보였습니다. SWE-Agent를 Claude 4 Sonnet로 돌렸을 때 61%의 솔루션이 기능적으로 정답이지만 보안 측면에서 통과하는 비율은 10.5%에 그쳐 'functionally correct ≠ secure'라는 갭을 정량 입증했습니다. 같은 주 CSA Vibe Security Radar 데이터(91.5% 취약·35 CVE)와 묶이며 SWE-bench Verified 80%대를 자랑하는 모델들이 실제 프로덕션 안전성에서는 어디에 위치하는지 처음 비교 가능한 기준으로 노출된 사례가 됐고, Snyk×Anthropic·Claude Security 베타가 풀린 직접적 배경이 됐습니다.

arXiv / OpenReview 원문 (새 창)
Simon Willison '바이브 코딩과 agentic engineering이 내가 원한 것보다 더 가까워지고 있다' (5/6) — 카테고리 명명자가 직접 경계 흔들림 진단
9/10

'바이브 코딩'이라는 용어를 만든 Simon Willison이 5월 6일 본인 블로그에 'Vibe coding and agentic engineering are getting closer than I'd like'를 올려, 본인이 원래 의도한 '결과만 받고 코드는 안 읽는다'는 바이브 코딩과 '코드를 읽고 검증하며 도구를 쓰는' agentic engineering이 5월 들어 카테고리 경계가 빠르게 흐려지고 있다고 진단했습니다. 그는 OpenAI Codex Chrome 확장·Cursor 3.3·Windsurf Devin Review 같은 5월 첫 주 출시들이 두 패러다임을 동일 UI 안으로 강제 융합시키는 압력으로 작용했다고 짚고, 사용자·기업이 '어느 모드로 일하고 있는가'를 명시하지 못하면 보안 부채(91.5% 취약·10.5% 보안 통과율)와 직결된다고 경고했습니다. CSA·SSLab 데이터와 같은 주에 풀린 '카테고리 명명자의 자체 점검'으로, 5월 둘째 주의 디스코스 기준점이 됐습니다.

Simon Willison's Weblog 원문 (새 창)

프레임워크/오케스트레이터

Anthropic Finance Agent Templates — 피치북 빌드·KYC 스크리닝·시장 분석 즉시 가용, '코딩 에이전트 → 도메인 에이전트' 첫 공식 템플릿 라인
RELEASE8/10

Anthropic이 5월 둘째 주 금융 서비스 도메인용 'ready-to-run' 에이전트 템플릿 라인을 공개하며, 코딩 에이전트 인프라가 도메인별 작업 자동화로 직접 응용되는 동선을 표준화했습니다. 첫 번째 라인업은 피치북 빌드·KYC 파일 스크리닝·시장 분석 등 금융권 시간 소비가 가장 큰 작업에 맞춰져 있고, Claude Code·MCP·Skills·Subagents 같은 SDK 시대 프리미티브 위에서 도는 도메인 특화 에이전트 패키지로 제공됩니다. 5/6 ServiceNow Build Agent의 'SaaS 거버넌스 + Anthropic 모델' 동선과 묶이며 'Anthropic이 IDE를 넘어 산업별 에이전트 템플릿 벤더로 본격 진입'하는 첫 공식 신호로 읽힙니다.

Anthropic Release Notes 원문 (새 창)

모델 출시/업데이트

DeepSeek V4-Pro (1.6T/49B 활성·1M 컨텍스트) Claude Opus 4.6에 근접 — Qwen 3.6 Plus 1M·Qwen3.6-27B 멀티모달 4/24, '오픈웨이트 프론티어 코딩'이 폐쇄 모델과 갭 좁힌 5월
8/10

5월 1일자 LLM Stats·BenchLM 측정에서 DeepSeek-V4-Pro(총 1.6T·활성 49B·1M 컨텍스트)가 '오픈웨이트 최강 코더'로 자리잡으며 Claude Opus 4.6에 근접한 SWE-bench Verified·코딩 벤치 점수를 기록했습니다. 동시 출시된 DeepSeek-V4-Flash(284B 총·13B 활성)는 비용 효율 옵션으로 같은 1M 컨텍스트를 제공합니다. Qwen 3.6 Plus도 1M 컨텍스트·툴 사용 신뢰성으로 '폐쇄 프론티어에 가장 가까운 오픈웨이트' 자리에 올랐고, 4월 24일 공개된 Qwen3.6-27B는 덴스 멀티모달 27B로 플래그십급 코딩 성능을 더 단순한 배포 폼팩터로 제공합니다. 4월 말~5월 초 Z.ai GLM-5.1·MiniMax M2.7·Moonshot Kimi K2.6과 묶이며 '오픈웨이트 5사 동시 출하'가 폐쇄 모델 갭을 분기 단위로 좁힌 첫 측정 시점이 됐습니다.

LLM Stats / BenchLM 원문 (새 창)