Test Case 才是软件的核心资产
最近几天,Graphite 一口气合了十几个 PR。Cross-graph Search、Large Corpus Gate、Topology OOM、Query Budget、Parallel Search、Memory、Cancellation、Timeout,几乎都在做性能优化和 Benchmark。
一开始看得很爽。发现一个慢 Query,Agent 找到 Hot Path,改实现、补测试、跑 Benchmark,然后交出 36 倍甚至 87 万倍的提升。以前要折腾几天的 Performance Optimization,现在几个小时就能跑完一轮。
但 PR 越合越多,越看越觉得不对劲:为什么每个“优化完成”后面,都紧跟着另一个 PR 补 Benchmark?Graphite 每个主要模块的 Unit Test Line Coverage 门槛已经是 98%,到底还有什么没测到?
