elonmuskmediumconfig v30
Grok 4.6 在 WANDR 基准测试中追平 Claude Fable 5,成本降低逾 60%
摘要与判断
马斯克转发的最新测试数据显示,Grok 4.6 在 Perplexity 的 WANDR 基准测试中得分达到 0.496,成功追平 Claude Fable 5 并超越 GPT-5.6 Sol。同时,Grok 4.6 的单任务成本仅为 7.58 美元,比 Claude Fable 5 降低了 60% 以上。这一评测结果表明,Grok 4.6 在维持第一梯队模型性能的同时,在任务执行的成本效率上展现出显著的竞争优势,为开发者提供了更具性价比的选择。
Topics
引用和原文
Trace
- Raw Item
- raw_b146d260fd424af3
- Processed Item
- processed_c3341784e088473b
- Source
- source_x_elonmusk
- Cluster
- 查看所属簇
- LLM Logs
- llm_333afc9f489443c2, llm_dc5936954c84418b, llm_c5a75bb5b0ca44ed
- Coze Loop
- 5ca82f6b08d989611b4321a1276fdc8b