Ahmadmediumconfig v27
Kimi K3基准测试成绩曝光,部分任务击败GPT 5.6
摘要与判断
Kimi K3模型参数规模达2.8万亿,支持100万上下文长度。最新基准测试显示,其在BrowseComp任务中排名第一,击败了GPT 5.6 Sol Max与Fable 5 Max;在AA-Briefcase和GDPval-AA v2中也分别取得第二和第三的成绩。这一跑分结果展示了该模型逼近头部闭源旗舰的能力,引发了业内关于开源AI未来竞争优势的讨论。
Topics
引用和原文
Trace
- Raw Item
- raw_6d8dcd993dda4955
- Processed Item
- processed_681fb5faeae94061
- Source
- source_x_feishu_candidate_theahmadosman
- Cluster
- 查看所属簇
- LLM Logs
- llm_d27fdbfb67ee46d7, llm_bae53b898cbb4022, llm_c5dc8400333f4cb1
- Coze Loop
- ff4d87b7d7611582e94c42727f2fe735