GPT-5.6 Luna 对比 GPT-6 Astra:$1.20 的模型做代码评审够用吗

来源:Hacker News:AI 热帖 2026年9月14日 03:56 AIHOT 评分:77 精选
摘要:Entelligence 在 50 个公开基准 PR 上用相同提示词对比 GPT-5.6 Luna 和 GPT-6 Astra 的代码评审能力,Luna 找到 69 个经验证 bug(Astra 92 个),总成本 $0.20 对 $5.66,精度 74% 对 96%。
# GPT-5.6 Luna 对比 GPT-6 Astra:$1.20 的模型做代码评审够用吗 - 来源:Hacker News:AI 热帖 - 作者:theanonymousone - 发布时间:2026-09-15 03:56 - AIHOT 分数:77 - AIHOT 标记:精选 - AIHOT 链接:https://aihot.news/items/cmu1rrthc04ffrovwf4kpknmm - 原文链接:https://entelligence.ai/blogs/gpt-5.6-luna-vs-gpt-6-astra-is-a-1.20-model-good-enough-for-code-review ## 精选理由 原文用公开基准和可复现脚本对比两档模型在代码评审上的召回、精度与成本,并给出按仓库和 bug 类别分层的可迁移测法。 ## AI 摘要 Entelligence 在 50 个公开基准 PR 上用相同提示词对比 GPT-5.6 Luna 和 GPT-6 Astra 的代码评审能力,Luna 找到 69 个经验证 bug(Astra 92 个),总成本 $0.20 对 $5.66,精度 74% 对 96%。 ## 正文 该来源未收录可展示正文,站内仅提供摘要。 > 站内仅提供摘要,全文见原文。