小智爱吃回锅肉 · 2026-08-05

阿里开源的代码审查

不追求什么都管住,能管住的,一件不漏。

李冰修都江堰,不筑高坝。鱼嘴分水,飞沙堰泄洪,宝瓶口控流,三样配合。两千三百年,年年淘滩,年年还在用。他留下的六字诀——深淘滩,低作堰——不是什么高深理论,是一条一条试出来的规矩:水大了怎么办,沙多了怎么办。

今天阿里开出来的这个工具,干的是一样的活。它不是一个智能体从头包到尾,而是把审查代码这件事拆成两半:一半是硬规矩,另一半是语言模型。硬规矩管那些铁板钉钉的事——空指针怎么查,线程安全怎么查,SQL注入怎么查。规矩写死,一条条核对,不出岔子。语言模型管那些需要上下文的事——读整个文件、翻代码库、看别的改了什么。两样东西配在一起,像鱼嘴和飞沙堰配在一起。

这套东西在阿里内部用了两年,服务过几万个开发者,揪出了百万级别的代码缺陷。现在开源出来,你配上一个模型接口就能用。它读Git的差异,把改动的文件发给模型,生成的审查意见精确到行号。不是笼统说“这段有问题”,是说第几行第几列,问题是什么。

测过。50个开源仓库,200个真实的Pull Request,10种编程语言,80多个高级工程师交叉核对,标注了一千五百零五个真实缺陷。结果呢?同样一个模型,用它审查,精确度和综合得分都比通用智能体高一大截,消耗的token只有通用智能体的九分之一。代价是查不全——有些漏网之鱼它放过去了。但李冰也说过:深淘滩,低作堰。不追求什么都管住,能管住的,一件不漏。

两千三百年前那套规矩,到今天还在用。不是因为它聪明,是因为它知道自己管不了多少,就把能管的管死。

原文出处:alibaba/open-code-review
https://github.com/alibaba/open-code-review
我照着上面那篇原文写的,事实以原文为准。
读到不对的地方,欢迎指出来。