Claude Opus 4.7 SWE-bench 87.6% 정상 탈환과 VS Cloud Agent 통합 — 프론티어 코딩 경쟁 재가열

2026년 5월 1일 금 · Anthropic이 Opus 4.7을 출시해 SWE-bench Verified 87.6%, SWE-bench Pro 64.3%로 GPT-5.4·Gemini 3.1 Pro를 모두 제쳤고, Microsoft는 4월 29일 Visual Studio에 GitHub Copilot Cloud Agent를 정식 통합해 IDE에서 원격 코딩 세션을 직접 띄울 수 있게 했습니다. Anthropic Managed Agents 퍼블릭 베타와 ant CLI까지 공개되며 호스팅 에이전트 인프라 표준화 경쟁이 본격화됐습니다.

모델 출시/업데이트

Anthropic Claude Opus 4.7 출시 — SWE-bench Verified 87.6%로 GPT-5.4·Gemini 3.1 Pro 제침
RELEASE10/10

Anthropic이 4월 16일 Claude Opus 4.7을 출시했습니다. SWE-bench Verified가 80.8%에서 87.6%로, SWE-bench Pro는 53.4%에서 64.3%로 뛰어 GPT-5.4(57.7%)와 Gemini 3.1 Pro(54.2%)를 모두 제쳤고 OSWorld-Verified도 78.0%로 75.0%의 GPT-5.4를 앞섰습니다. 가격은 $5/$25로 동결됐지만 토크나이저 변경과 이미지 처리 해상도 3.3배 확대(2,576px) 등 실측 비용에는 영향이 있습니다. AWS Bedrock·Vertex AI·Microsoft Foundry에서 모두 가용합니다.

Anthropic 원문 (새 창)
Mistral Medium 3.5 + Vibe CLI — Devstral 2 대체, SWE-Bench Verified 77.6% 단일 모델 통합
RELEASE9/10

Mistral AI가 Mistral Medium 3.5를 공개하며 자사 Vibe CLI의 기본 모델을 Devstral 2에서 교체했습니다. 128B 단일 덴스 모델로 인스트럭션 팔로잉·추론·코딩을 통합 처리하며 SWE-Bench Verified 77.6%, 256K 컨텍스트, 네이티브 함수 호출, 설정 가능한 추론 강도를 지원합니다. Vibe CLI는 파일 read/write/patch, grep 검색, 셸 실행, todo 관리 툴을 내장해 별도 에이전트 SDK 없이도 단일 진입점으로 코딩 자동화가 가능합니다.

Mistral AI 원문 (새 창)
Mistral Small 4 — Magistral·Pixtral·Devstral 통합 단일 모델로 추론·멀티모달·에이전틱 코딩 일원화
8/10

Mistral이 Small 4를 공개해 추론(Magistral), 멀티모달(Pixtral), 에이전틱 코딩(Devstral)의 능력을 처음으로 단일 모델에 통합했습니다. 별도 가중치를 유지하던 전략에서 '하나로 다 처리하는' 통합 모델 트렌드로 전환한 첫 사례이며, 동시에 발표된 Mistral Medium 3.5와 같이 산업 전반의 '특화 모델→통합 모델' 흐름을 가속한다는 평가를 받고 있습니다.

Serenities AI 원문 (새 창)

코딩 도구

Microsoft Visual Studio 4월 업데이트 — GitHub Copilot Cloud Agent 통합과 Debugger Agent 신설
RELEASE10/10

Microsoft가 4월 29일 Visual Studio April Update를 공개해 GitHub Copilot Chat의 에이전트 피커에서 'Cloud'를 선택해 원격 인프라에서 격리·확장 가능한 코딩 세션을 시작할 수 있도록 정식 통합했습니다. 에이전트는 이슈 생성 권한을 받아 PR을 직접 제출하고 IDE 안에서 검토·브라우저 열기를 지원하며, 같은 업데이트로 런타임 검증을 수행하는 Debugger Agent와 C++ Code Editing Tools 일반공급, 사용자 레벨 Custom Agents가 추가됐습니다.

Visual Studio Blog 원문 (새 창)
Copado Agentia 출시 — Salesforce DevOps에 거버넌스 내장된 컨텍스트 인지 AI 에이전트
RELEASE9/10

Copado가 4월 14일 Agentia를 공식 출시했습니다. Plan·Build·Test·Release·Operate 라이프사이클 각 단계에 특화 에이전트를 내장하고 고객 메타데이터·파이프라인 이력·의존성·고객 지식으로 컨텍스트를 주입해 일반 AI 코딩 도구가 메우지 못하는 거버넌스 격차를 노립니다. 정책 기반 통제, 승인 게이트, 역할 기반 접근, 감사 추적이 에이전트 레이어에 기본 탑재돼 엔터프라이즈 컴플라이언스 요구를 직격하며 Agentia Advanced·Pro 에디션이 즉시 가용합니다.

SiliconANGLE 원문 (새 창)
Windsurf v2.0.61 — Adaptive 모델 라우터로 작업별 모델 자동 선택, MCP OAuth 강화
RELEASE8/10

Windsurf가 4월 15~17일 v2.0.44~v2.0.61을 연속 배포하며 모델 피커에 Adaptive 옵션을 추가해 작업별로 최적 모델을 자동 선택, 동일 쿼터로 더 오래 가도록 했습니다. 이전 라우터 버그로 첫 요청 이후 모델 전환이 막히던 문제를 수정했고 영향받은 사용자에겐 쿼터 리셋과 초과분 복원이 적용됐습니다. 같은 사이클로 MCP 서버 OAuth 리소스 파라미터, .gitignore 처리, WSL/SSH/Dev Containers 안정성, 대용량 diff 영역 타이핑 성능이 강화됐습니다.

Windsurf 원문 (새 창)
Visual Studio Code Custom Agents — .agent.md 파일로 사용자 레벨 정의·프로젝트 간 재사용
RELEASE8/10

Microsoft가 GitHub Copilot Custom Agents의 사용자 레벨 정의를 정식 지원했습니다. 리포지토리 안에 .agent.md 파일로 특화 에이전트를 정의하던 방식에서 한발 더 나아가 프로젝트 간에도 설정이 유지되며, 동시에 도입된 find_symbol 도구는 C++·C#·Razor·TypeScript·LSP 지원 언어에서 참조 검색·타입 메타데이터·선언 범위 인식 같은 언어 인지 심볼 내비게이션을 에이전트에 제공합니다. 3월 정식 출시된 JetBrains Agent Mode와 결합해 멀티 IDE 표준화 흐름이 분명해졌습니다.

GitHub Changelog 원문 (새 창)

프레임워크/오케스트레이터

Anthropic Claude Managed Agents 퍼블릭 베타 + ant CLI 공개 — 호스팅 에이전트 인프라 표준화
RELEASE9/10

Anthropic이 4월 8일 Claude Managed Agents를 퍼블릭 베타로 출시하며 보안 샌드박스, 상태 관리, 크리덴셜 분리, SSE 스트리밍을 갖춘 풀매니지드 에이전트 하네스를 제공했습니다. 함께 공개된 Go 기반 'ant' CLI로 터미널에서 에이전트·환경·세션 생성과 YAML 버전관리가 가능하며 agent_toolset_20260401 도구 타입으로 bash·파일·웹검색 등 사전 빌드 툴 풀세트를 즉시 활용할 수 있습니다. 세션 비용은 시간당 $0.08(밀리초 단위 과금)에 표준 토큰 요금이 추가됩니다.

InfoQ 원문 (새 창)

엔지니어링 기법

Google·Kaggle 'AI Agents Vibe Coding' 5일 인텐시브 코스 — 6월 15~19일 무료 진행
9/10

Google과 Kaggle이 6월 15~19일 5일 무료 'AI Agents Intensive' 코스를 다시 연다고 4월 발표했습니다. 이번 회차는 신규 강사 라인업과 캡스톤 프로젝트가 추가됐고 AI 에이전트 설계·구현 실전 콘텐츠가 보강됐습니다. 글로벌 코드의 41%가 AI 생성, 미국 개발자 92%가 AI 도구를 매일 사용하는 상황에서 빅테크가 직접 무료 인텐시브로 인력 풀을 형성하려는 신호로 읽힙니다.

Google Blog 원문 (새 창)
Georgia Tech SSLab 'Vibe Security Radar' — 3월 AI 생성 코드 직접 원인 CVE 35건 공개
8/10

Georgia Tech의 Systems Software & Security Lab이 운영하는 Vibe Security Radar에 따르면 2026년 3월 한 달간 공개된 CVE 중 최소 35건이 AI 생성 코드에 직접 기인한 것으로 분류됐습니다. 같은 기간 Invicti의 2만 개 바이브코딩 앱 분석에선 1,182개 앱에서 'supersecretkey' 같은 하드코딩된 시크릿이 발견됐고, 전체 AI 생성 코드의 약 24.7%가 보안 결함을 가진다는 결과가 나오며 코드 리뷰 자동화·시크릿 매니저 강제 적용 요구가 커지고 있습니다.

Infosecurity Magazine 원문 (새 창)