赛博禅心mediumconfig v27

MindLab发布Macaron V1模型,首创MoL架构提升GLM 5.2性能

摘要与判断

MindLab正式发布Macaron V1系列模型,包含基于GLM 5.2的748B旗舰版Venti和基于Qwen 3.6的35B轻量版Tall。该系列首创Mixture-of-LoRA(MoL)架构,通过在冻结基座上挂载多个独立LoRA专家消除能力干扰,并利用LongStraw技术将上下文扩展至2M。这一发布为大模型的高效后训练、长文本处理及多任务能力融合提供了新的架构参考与工具链支持。

Topics

引用和原文

Trace

Raw Item
raw_9c8f23b0da234852
Processed Item
processed_81003c50cc744c0d
Source
manual_wechat_mp
Cluster
查看所属簇
LLM Logs
llm_be49b24b8b53430e, llm_db6a45a3c99d4951
Coze Loop
43beb828d74b2e1f16e84d877fc08995