Kimi.aimediumconfig v27
Together AI 评测称 Kimi K3 在软件工程任务中性能比肩 Claude Fable 5 且成本更低
摘要与判断
Kimi.ai 转发 Together AI 的评测数据称,在 DeepSWE 软件工程任务中,Kimi K3 展现出与 Claude Fable 5 相当的性能,且成本仅约为后者的 35%,并在更高的 pass@k 指标上取得领先。这一评测结果凸显了 Kimi K3 在特定编程任务中的高性价比,为开发者提供了更具成本效益的模型选择。
Topics
引用和原文
Trace
- Raw Item
- raw_7bc3a0c4ce1042b8
- Processed Item
- processed_a435ad7987b64d08
- Source
- source_x_kimi_moonshot
- Cluster
- 查看所属簇
- LLM Logs
- llm_a5b337669a754cbc, llm_059b5b0e289a4e13, llm_6c58788f598a4d8e
- Coze Loop
- bb21a8ee42e4350ab4894c8b108fe768