Alibaba отвори изходния код на Open Code Review, инструмент от командния ред с ИИ за преглед на код. Open Code Review чете Git diff, изпраща променените файлове към конфигурируем езиков модел чрез агент, който може да използва инструменти, и създава структурирани коментари за редове от кода.
Фиксирана логика избира файловете, обединява свързани файлове и съпоставя правила. Агентът взема решения по време на анализа и извлича нужния контекст.
В собственото сравнение на Alibaba с Claude Code при същия модел Open Code Review показа по-високи Precision и F1 и изразходва около една девета от токените. Неговият Recall е по-нисък от този на универсалните агенти, което разработчиците определят като компромис в полза на точността и по-малко фалшиви сигнали.
Проверка на твърденията:
- Alibaba отвори изходния код на Open Code Review, инструмент от командния ред с ИИ за преглед на код. (потвърдено от самата публикация: доказателство; «Open Code Review is an AI-powered code review CLI tool. It originated as Alibaba Group’s internal official AI code review assistant — over the past two years, it has served tens of thousands of developers and identified millions of code defects. After thorough validation at massive scale, we incubated it into an open source project for the community.»)
- Open Code Review чете Git diff, изпраща променените файлове към конфигурируем езиков модел чрез агент, който може да използва инструменти, и създава структурирани коментари за редове от кода. (потвърдено от самата публикация: доказателство; «It reads Git diffs, sends changed files to a configurable LLM via an agent with tool-use capabilities, and generates structured review comments with line-level precision.»)
- Фиксирана логика избира файловете, обединява свързани файлове и съпоставя правила. (потвърдено от самата публикация: доказателство; «For review steps that must not go wrong , engineering logic — not the language model — guarantees correctness:»)
- Агентът взема решения по време на анализа и извлича нужния контекст. (потвърдено от самата публикация: доказателство; «The agent’s strengths are concentrated where they matter most — dynamic decisions and dynamic context retrieval:»)
- В собственото сравнение на Alibaba с Claude Code при същия модел Open Code Review показа по-високи Precision и F1 и изразходва около една девета от токените. (потвърдено от самата публикация: доказателство; «Compared to general-purpose agents (Claude Code), Open Code Review achieves significantly higher Precision and F1 with the same underlying model, while consuming only ~1/9 of the tokens and completing reviews faster.»)
- Неговият Recall е по-нисък от този на универсалните агенти, което разработчиците определят като компромис в полза на точността и по-малко фалшиви сигнали. (потвърдено от самата публикация: доказателство; «Note that its Recall is lower than general-purpose agents — a deliberate trade-off favoring precision over noise.»)
Публикации:
Първоизточници:
оценка 68,2 от 100 · вид: анонс