#1
当前簇头 · 第 1 任独立事件二手报道
实测称:OpenAI低价模型修复漏洞多于谷歌同档模型
Paweł Huryn称,在包含两个真实代码仓库、105个漏洞的盲测中,谷歌Gemini 3.7 Flash修复22个漏洞、耗时96分钟、成本8.43美元;OpenAI GPT-5.6 Luna修复33个、耗时86分钟、成本1.80美元。该实测显示,两者低价档在修复数量、速度和成本上存在明显差距,但结果仍受单轮测试设置影响。
去重判断LLM 复核 · 独立事件
在 CozeLoop 查看判断 簇级候选:8 个已有簇, 共 9 条代表。
最终结果已修正为“独立事件”,以当前持久化状态为准。