Max For AImediumconfig v30

DeepSeek V4 Pro 0813 评测成绩曝光,Agent 能力大幅提升

摘要与判断

DeepSeek V4 Pro 0813 版本的最新评测成绩显示,其在多项 Agent 基准测试中实现大幅提升,全面接近或超越 Fable 5 及 Opus 4.8。具体而言,其 DeepSWE 得分从预览版的 12.8 跃升至 62.7,Terminal Bench 2.1 达到 87.9。这表明此次版本升级重点聚焦于智能体能力的强化,展示了该模型在复杂任务自动化领域的快速迭代与竞争力。

Topics

引用和原文

Trace

Raw Item
raw_070755434a8c40ec
Processed Item
processed_c32f7ffe98294d8f
Source
source_x_maxforai
Cluster
查看所属簇
LLM Logs
llm_4a97b689dbdc4081, llm_156a1ac83ad54db3, llm_183e488d8ac047d8
Coze Loop
2d8437f58a4be39502fadb84363d48c4