togethercomputemediumconfig v28

Kimi K3在Harvey LAB-AA法律任务测试中得分近乎Claude Fable 5两倍

摘要与判断

Kimi K3在Harvey LAB-AA的硬性自主法律任务基准测试中表现突出,其得分接近Claude Fable 5的两倍。这一测试结果凸显了Kimi K3在处理复杂专业法律任务时的显著性能优势,为垂直领域的AI模型能力评估提供了新的参考数据。

Topics

引用和原文

Trace

Raw Item
raw_fb56e64ec1e547a5
Processed Item
processed_4f68091bc7484697
Source
source_x_togethercompute
Cluster
查看所属簇
LLM Logs
llm_c57f86fce0a34043, llm_87fb4af2e1824313, llm_91a955b3324a43fc
Coze Loop
42f5a368ba99d0b4ee9e85a15e51e5b8