返回簇列表
传闻簇行为开启Mongo 实时数据

实测称:OpenAI低价模型修复漏洞多于谷歌同档模型

Paweł Huryn称,在包含两个真实代码仓库、105个漏洞的盲测中,谷歌Gemini 3.7 Flash修复22个漏洞、耗时96分钟、成本8.43美元;OpenAI GPT-5.6 Luna修复33个、耗时86分钟、成本1.80美元。该实测显示,两者低价档在修复数量、速度和成本上存在明显差距,但结果仍受单轮测试设置影响。

成员
1
换头
0
最近活动
08/25 11:32:33
CONTENT GOVERNANCE

内容治理

在线

下线会立即隐藏 Defomo 内容,并联动撤回 Elys 全部 Feed、详情和分享入口;恢复不会补推历史 Feed。 本操作覆盖整个事件簇及未来新成员。

MEMBERS

簇内帖子

按进入簇的先后排序 · duplicate 不隐藏
#1
当前簇头 · 第 1 任独立事件二手报道

实测称:OpenAI低价模型修复漏洞多于谷歌同档模型

Paweł Huryn称,在包含两个真实代码仓库、105个漏洞的盲测中,谷歌Gemini 3.7 Flash修复22个漏洞、耗时96分钟、成本8.43美元;OpenAI GPT-5.6 Luna修复33个、耗时86分钟、成本1.80美元。该实测显示,两者低价档在修复数量、速度和成本上存在明显差距,但结果仍受单轮测试设置影响。

Adam.GPT来源权威 4 级(1 级最高)发布于 08/25 11:04:48原帖 内容详情
去重判断LLM 复核 · 独立事件

簇级候选:8 个已有簇, 共 9 条代表

在 CozeLoop 查看判断
最终结果已修正为“独立事件”,以当前持久化状态为准。