alibaba_cloudmediumconfig v30

阿里云发布Qwen3.8-27B模型性能基准报告

摘要与判断

阿里云官方发布了Qwen3.8-27B模型的性能基准报告,数据显示该模型在MMLU测试中得分82.4,在HumanEval代码生成任务中达到67.8分。报告还详细展示了其在中文任务上的优势以及与Llama3.1-70B的对比数据。这一性能披露为开发者评估和选择开源中等规模语言模型提供了具体的参考依据。

Topics

引用和原文

Trace

Raw Item
raw_e351979fa05c49cd
Processed Item
processed_ac83022d83f04be0
Source
source_x_alibaba_cloud
Cluster
查看所属簇
LLM Logs
llm_a2339cba06334c9e, llm_db6cad7288d34a5c, llm_f2f1f611a6734d74
Coze Loop
38f9cc6011c7c02c6967fed5d92fb696