GitHub, AI 코드 리뷰 에이전트 평가를 위한 ReviewBench 출시
GitHub의 공개 ReviewBench 벤치마크는 AI 코드 리뷰 에이전트를 테스트하는 더 명확한 방법을 제시하며, 개발자와 구매자에게 공통 평가 출발점을 제공한다.
코드 리뷰에 대한 최신 뉴스 및 분석
GitHub의 공개 ReviewBench 벤치마크는 AI 코드 리뷰 에이전트를 테스트하는 더 명확한 방법을 제시하며, 개발자와 구매자에게 공통 평가 출발점을 제공한다.
Anthropic은 Code Review for Claude Code를 출시했습니다. 이 다중 에이전트 AI 도구는 GitHub 풀 리퀘스트를 자동으로 분석해 논리적 오류를 찾아내고, 발견 내용을 심각도에 따라 우선순위를 매기며, 리뷰당 $15–$25의 비용이 듭니다 — 기업 환경에서 AI 생성 코드의 급증으로 생긴 심화되는 병목 문제를 해결하기 위한 것입니다.
Anthropic은 Claude Code용 새로운 다중 에이전트 코드 검토 도구를 출시했으며, 이는 소프트웨어 개발 파이프라인 전반에 걸쳐 증가하는 AI 생성 코드의 버그와 보안 취약점을 자동으로 탐지하도록 설계되었습니다.