Artificial Analysismediumconfig v28
Qwen3.8 Max在GDPval-AA评测中获1599分,追平Claude Sonnet 5
摘要与判断
Artificial Analysis 公布 Qwen3.8 Max 在代理任务评测 GDPval-AA 中获得 1599 Elo,与 Claude Sonnet 5 基本持平,领先 GLM-5.2 但落后于 Kimi K3。该成绩较前代大幅提升 329 分,是其智能指数提升的核心驱动力。这一评测结果直观反映了该模型在真实世界工作任务处理能力上的显著进步,为国产大模型在复杂代理场景下的表现提供了量化参考。
Topics
引用和原文
Trace
- Raw Item
- raw_ac6fd0add4114792
- Processed Item
- processed_13fc46786ac94076
- Source
- source_x_artificialanlys
- Cluster
- 查看所属簇
- LLM Logs
- llm_bdb6837f0d3845f3, llm_63ea971857cd4caf, llm_195be287edc240e0
- Coze Loop
- acfc1a5ffd112ac97fb136f230441e92