← 返回情报列表**测试背景**:Entelligence 构建了 Model Router(把每个编码任务交给能胜任的最便宜模型)和 Agent Insights(展示团队 AI 支出及其产出),本次测试数据与脚本均已公开。 **价格对比**:GPT-5.6 Luna 每百万输入/输出 token 分别为 0.20 美元和 1.20 美元,GPT-6 Astra 为 10 美元和 50 美元;审查同一个 PR,Luna 单次花费 0.0041 美元,Astra 为 0.113 美元,相差 28 倍。 **总体结果**:在 50 个 pull request 上,Luna 找到 69 个已验证 bug,整轮花费 0.20 美元;Astra 找到 92 个,花费 5.66 美元。 **误报差距**:Luna 的 93 项发现中有 24 项未通过验证,而 Astra 的 96 项中只有 4 项;安全漏洞方面,24 个漏洞中 Luna 找到 9 个,Astra 找到 19 个。 **基准构成**:测试沿用 Astra 与 GPT-5.6 Sol 对比的设置,使用 AI-Code-Review-Evals 组织的 50 个公开基准 PR,分别来自 Cal.com、Sentry、Discourse、Keycloak 和 Grafana 各 10 个,每个 PR 都在干净基础分支上人为引入缺陷。 **作者结论**:以该价格衡量,Luna 处理日常正确性 bug 已经足够,但他们不会让它单独审查认证(authentication)或权限(permission)相关代码。
📌 2026-09-15·Hacker News
GPT-5.6 Luna 对比 GPT-6 Astra:1.2美元的模型做代码审查够用吗?
#LLM#代码审查#成本