togethercomputemediumconfig v28
Kimi K3在Harvey LAB-AA法律任务测试中得分近乎Claude Fable 5两倍
摘要与判断
Kimi K3在Harvey LAB-AA的硬性自主法律任务基准测试中表现突出,其得分接近Claude Fable 5的两倍。这一测试结果凸显了Kimi K3在处理复杂专业法律任务时的显著性能优势,为垂直领域的AI模型能力评估提供了新的参考数据。
Topics
引用和原文
Trace
- Raw Item
- raw_fb56e64ec1e547a5
- Processed Item
- processed_4f68091bc7484697
- Source
- source_x_togethercompute
- Cluster
- 查看所属簇
- LLM Logs
- llm_c57f86fce0a34043, llm_87fb4af2e1824313, llm_91a955b3324a43fc
- Coze Loop
- 42f5a368ba99d0b4ee9e85a15e51e5b8