Onur Solmazmediumconfig v30

Qwen 3.8 27b 在私有基准测试中得分超越 GLM 5.2

摘要与判断

开发者 Onur Solmaz 在其构建的私有基准测试中发现,Qwen 3.8 27b 的得分比 GLM 5.2 高出 4%。作者表示目前尚不确定这一结果是源于基准测试本身的设计问题,还是该版本模型确实具备如此突出的性能。这为关注开源模型能力的开发者提供了一个早期的个人实测参考。

Topics

引用和原文

Trace

Raw Item
raw_0683a1c9304b493d
Processed Item
processed_4325d83a621549a0
Source
source_x_feishu_candidate_onusoz
Cluster
查看所属簇
LLM Logs
llm_da4078652d724783, llm_74a30f292c37469c, llm_ecffa8b20221460d
Coze Loop
3611a5e69f604b2797e740c8ba458d01