togethercomputemediumconfig v28

Kimi K3 在 Harvey LAB-AA 法律任务测试中得分近乎 Claude Fable 5 两倍

摘要与判断

Kimi K3 在 Harvey LAB-AA 的硬核自主法律任务基准测试中,得分接近 Claude Fable 5 的两倍。这一测试结果展示了该模型在特定垂直领域复杂任务上的显著性能优势,为法律 AI 场景的实际应用能力提供了重要参考。

Topics

引用和原文

Trace

Raw Item
raw_2aff6ba2aab84019
Processed Item
processed_436c3136779c49c8
Source
source_x_togethercompute
Cluster
查看所属簇
LLM Logs
llm_7b787c133de24eb9, llm_20c72d136df14c64, llm_f50d6bb025044614
Coze Loop
74550eed7f00945e9105a59e92f73fcf