Alibaba відкрила вихідний код Open Code Review, інструмента командного рядка з ШІ для перевірки коду. Open Code Review читає Git diff, передає змінені файли налаштовуваній мовній моделі через агента, який уміє викликати інструменти, і видає структуровані коментарі до рядків.
За відбір файлів, об’єднання пов’язаних файлів і зіставлення правил відповідає фіксована логіка. Агент ухвалює рішення під час аналізу та запитує потрібний контекст.
У власному порівнянні з Claude Code з тією самою моделлю Open Code Review показав вищі Precision і F1 та витратив близько однієї дев’ятої токенів. Водночас його Recall нижчий, ніж в універсальних агентів: розробники назвали це компромісом на користь точності й меншої кількості хибних спрацьовувань.
Перевірка тверджень:
- Alibaba відкрила вихідний код Open Code Review, інструмента командного рядка з ШІ для перевірки коду. (підтверджено самою публікацією: доказ; «Open Code Review is an AI-powered code review CLI tool. It originated as Alibaba Group’s internal official AI code review assistant — over the past two years, it has served tens of thousands of developers and identified millions of code defects. After thorough validation at massive scale, we incubated it into an open source project for the community.»)
- Open Code Review читає Git diff, передає змінені файли налаштовуваній мовній моделі через агента, який уміє викликати інструменти, і видає структуровані коментарі до рядків. (підтверджено самою публікацією: доказ; «It reads Git diffs, sends changed files to a configurable LLM via an agent with tool-use capabilities, and generates structured review comments with line-level precision.»)
- За відбір файлів, об’єднання пов’язаних файлів і зіставлення правил відповідає фіксована логіка. (підтверджено самою публікацією: доказ; «For review steps that must not go wrong , engineering logic — not the language model — guarantees correctness:»)
- Агент ухвалює рішення під час аналізу та запитує потрібний контекст. (підтверджено самою публікацією: доказ; «The agent’s strengths are concentrated where they matter most — dynamic decisions and dynamic context retrieval:»)
- У власному порівнянні з Claude Code з тією самою моделлю Open Code Review показав вищі Precision і F1 та витратив близько однієї дев’ятої токенів. (підтверджено самою публікацією: доказ; «Compared to general-purpose agents (Claude Code), Open Code Review achieves significantly higher Precision and F1 with the same underlying model, while consuming only ~1/9 of the tokens and completing reviews faster.»)
- Водночас його Recall нижчий, ніж в універсальних агентів: розробники назвали це компромісом на користь точності й меншої кількості хибних спрацьовувань. (підтверджено самою публікацією: доказ; «Note that its Recall is lower than general-purpose agents — a deliberate trade-off favoring precision over noise.»)
Публікації:
Першоджерела:
оцінка 68,2 зі 100 · тип: анонс