Onur Solmazmediumconfig v30
Qwen 3.8 27b 在私有基准测试中得分超越 GLM 5.2
摘要与判断
开发者 Onur Solmaz 在其构建的私有基准测试中发现,Qwen 3.8 27b 的得分比 GLM 5.2 高出 4%。作者表示目前尚不确定这一结果是源于基准测试本身的设计问题,还是该版本模型确实具备如此突出的性能。这为关注开源模型能力的开发者提供了一个早期的个人实测参考。
Topics
引用和原文
Trace
- Raw Item
- raw_0683a1c9304b493d
- Processed Item
- processed_4325d83a621549a0
- Source
- source_x_feishu_candidate_onusoz
- Cluster
- 查看所属簇
- LLM Logs
- llm_da4078652d724783, llm_74a30f292c37469c, llm_ecffa8b20221460d
- Coze Loop
- 3611a5e69f604b2797e740c8ba458d01