OpenCodeReview는 Alibaba Group 내부에서 2년간 수만 명의 개발자에게 제공돼 수백만 건의 코드 결함을 찾은 AI 코드 리뷰 CLI를 오픈소스로 전환한 프로젝트임 Git diff와 변경 파일을 configurable LLM에 전달하며, 에이전트가 전체 파일·저장소·다른 변경 파일을 탐색해 라인 단위 리뷰 의견을 생성함 50개 오픈소스 저장소의 실제 PR 200개와 10개 언어를 대상으로 80명 이상의 시니어 엔지니어가 검증한 결과, Claude Code보다 Precision과 F1이 높고 토큰은 약 1/9만 사용했지만 Recall은 낮았음 파일 선택·관련 파일 묶음·규칙 매칭·의견 위치 보정은 결정론적 로직으로 통제하고, 동적 판단과 문맥 검색은 코드 리뷰 전용 프롬프트와 도구를 갖춘 에이전트가 담당함 ocr review는 작업 공간·브랜치 범위·커밋을 검토하고 ocr scan은 전체 파일을 감사하며, Delegation Mode에서는 별도 LLM 설정 없이 Claude Code·Codex·Cursor 같은 코딩 에이전트가 리뷰를 수행할 수 있음 OpenCodeReview의 역할 OpenCodeReview는 Git 변경 사항을 읽어 configurable LLM으로 검토하는 AI 코드 리뷰 CLI임 Alibaba Group의 공식 내부 AI 코드 리뷰 도우미로 시작해 지난 2년간 수만 명의 개발자에게 제공됨 대규모 환경에서 수백만 건의 코드 결함을 식별한 뒤 오픈소스 프로젝트로 전환됨 모델 엔드포인트를 설정하면 사용할 수 있음 에이전트는 도구를 사용해 전체 파일을 읽고, 저장소를 검색하며, 다른 변경 파일에서 문맥을 가져와 라인 단위 의견을 생성함 ocr scan은 의미 있는 diff가 없는 디렉터리나 익숙하지 않은 코드베이스를 감사할 수 있도록 파일 전체를 검토함 벤치마크와 정밀도 우선 전략 실제 환경 기반 벤치마크는 50개 인기 오픈소스 저장소, 실제 Pull Request 200개, 프로그래밍 언어 10개로 구성됨 80명 이상의 시니어 엔지니어가 교차 검증함 정답 데이터에는 주석 처리된 이슈 1,505개가 포함됨 같은 기반 모델을 사용한 범용 에이전트 Claude Code와 비교해 Precision과 F1이 더 높고, 토큰은 약 1/9만 소비하며 리뷰도 더 빠르게 완료함 Recall은 범용 에이전트보다 낮으며, 이는 노이즈를 줄이고 정밀도를 높이기 위한 의도적 절충임 평가 항목은 다음과...
OpenAI가 Codex Security를 방금 오픈소스로 공개함
1 week ago
23
Related
한 연구자가 noreply.net을 샀더니 기업 기밀이 쏟아짐
1 hour ago
1
프랑스, 사전 동의 없는 텔레마케팅 전화 금지
1 hour ago
0
GitHub Actions에 OIDC audience 제약이 필요한 이유
3 hours ago
0
H3-metal - Apple Silicon용 네이티브 MiniMax-H3 추론
3 hours ago
1
AI가 웹을 잠식하면서 인터넷의 집단 기억이 사라지고 있음
4 hours ago
1
Rails는 DHH 없이도 Rails일 수 있을까
6 hours ago
1
LLM은 PCB 배선을 어디까지 할 수 있을까? 숙련자와 Net 단위로 비교해봤습니다
6 hours ago
1
Hanami - Rails를 대체하는 Ruby 프레임워크
7 hours ago
2
Tips
click
Popular
What's New in SAP S/4HANA Cloud Public Edition 2608 | Releas...
3 weeks ago
209
Codex 사용량 한도 리셋 추적
3 weeks ago
88
NVIDIA·CoreWeave·Nebius가 만든 GPU 붐의 순환 금융 구조
4 weeks ago
62
'킬러들의 쇼핑몰2' 감독 "시즌3 고민 중"⋯이동욱 "시키면 ...
3 weeks ago
57
© Clint IT 2026. All rights are reserved









English (US) ·