Alibaba открыла исходный код Open Code Review, инструмента командной строки с ИИ для проверки кода. Open Code Review читает Git diff, передаёт изменённые файлы настраиваемой языковой модели через агента, который умеет вызывать инструменты, и выдаёт структурированные комментарии к строкам.
За отбор файлов, объединение связанных файлов и сопоставление правил отвечает фиксированная логика. Агент принимает решения во время анализа и запрашивает нужный контекст.
В собственном сравнении с Claude Code при той же модели Open Code Review показал более высокие Precision и F1 и расходовал около одной девятой токенов. При этом его Recall ниже, чем у универсальных агентов: разработчики назвали это компромиссом в пользу точности и меньшего числа ложных срабатываний.
Проверка утверждений:
- Alibaba открыла исходный код Open Code Review, инструмента командной строки с ИИ для проверки кода. (подтверждено самой публикацией: доказательство; «Open Code Review is an AI-powered code review CLI tool. It originated as Alibaba Group’s internal official AI code review assistant — over the past two years, it has served tens of thousands of developers and identified millions of code defects. After thorough validation at massive scale, we incubated it into an open source project for the community.»)
- Open Code Review читает Git diff, передаёт изменённые файлы настраиваемой языковой модели через агента, который умеет вызывать инструменты, и выдаёт структурированные комментарии к строкам. (подтверждено самой публикацией: доказательство; «It reads Git diffs, sends changed files to a configurable LLM via an agent with tool-use capabilities, and generates structured review comments with line-level precision.»)
- За отбор файлов, объединение связанных файлов и сопоставление правил отвечает фиксированная логика. (подтверждено самой публикацией: доказательство; «For review steps that must not go wrong , engineering logic — not the language model — guarantees correctness:»)
- Агент принимает решения во время анализа и запрашивает нужный контекст. (подтверждено самой публикацией: доказательство; «The agent’s strengths are concentrated where they matter most — dynamic decisions and dynamic context retrieval:»)
- В собственном сравнении с Claude Code при той же модели Open Code Review показал более высокие Precision и F1 и расходовал около одной девятой токенов. (подтверждено самой публикацией: доказательство; «Compared to general-purpose agents (Claude Code), Open Code Review achieves significantly higher Precision and F1 with the same underlying model, while consuming only ~1/9 of the tokens and completing reviews faster.»)
- При этом его Recall ниже, чем у универсальных агентов: разработчики назвали это компромиссом в пользу точности и меньшего числа ложных срабатываний. (подтверждено самой публикацией: доказательство; «Note that its Recall is lower than general-purpose agents — a deliberate trade-off favoring precision over noise.»)
Публикации:
Первоисточники:
оценка 68,2 из 100 · тип: анонс