alibaba_cloudmediumconfig v30
阿里云发布Qwen3.8-27B模型性能基准报告
摘要与判断
阿里云官方发布了Qwen3.8-27B模型的性能基准报告,数据显示该模型在MMLU测试中得分82.4,在HumanEval代码生成任务中达到67.8分。报告还详细展示了其在中文任务上的优势以及与Llama3.1-70B的对比数据。这一性能披露为开发者评估和选择开源中等规模语言模型提供了具体的参考依据。
Topics
引用和原文
Trace
- Raw Item
- raw_e351979fa05c49cd
- Processed Item
- processed_ac83022d83f04be0
- Source
- source_x_alibaba_cloud
- Cluster
- 查看所属簇
- LLM Logs
- llm_a2339cba06334c9e, llm_db6cad7288d34a5c, llm_f2f1f611a6734d74
- Coze Loop
- 38f9cc6011c7c02c6967fed5d92fb696