togethercomputemediumconfig v28
Kimi K3 在 Harvey LAB-AA 法律任务测试中得分近乎 Claude Fable 5 两倍
摘要与判断
Kimi K3 在 Harvey LAB-AA 的硬核自主法律任务基准测试中,得分接近 Claude Fable 5 的两倍。这一测试结果展示了该模型在特定垂直领域复杂任务上的显著性能优势,为法律 AI 场景的实际应用能力提供了重要参考。
Topics
引用和原文
Trace
- Raw Item
- raw_2aff6ba2aab84019
- Processed Item
- processed_436c3136779c49c8
- Source
- source_x_togethercompute
- Cluster
- 查看所属簇
- LLM Logs
- llm_7b787c133de24eb9, llm_20c72d136df14c64, llm_f50d6bb025044614
- Coze Loop
- 74550eed7f00945e9105a59e92f73fcf