Kimi.aimediumconfig v27

Together AI 评测称 Kimi K3 在软件工程任务中性能比肩 Claude Fable 5 且成本更低

摘要与判断

Kimi.ai 转发 Together AI 的评测数据称,在 DeepSWE 软件工程任务中,Kimi K3 展现出与 Claude Fable 5 相当的性能,且成本仅约为后者的 35%,并在更高的 pass@k 指标上取得领先。这一评测结果凸显了 Kimi K3 在特定编程任务中的高性价比,为开发者提供了更具成本效益的模型选择。

Topics

引用和原文

Trace

Raw Item
raw_7bc3a0c4ce1042b8
Processed Item
processed_a435ad7987b64d08
Source
source_x_kimi_moonshot
Cluster
查看所属簇
LLM Logs
llm_a5b337669a754cbc, llm_059b5b0e289a4e13, llm_6c58788f598a4d8e
Coze Loop
bb21a8ee42e4350ab4894c8b108fe768