赛博禅心mediumconfig v27
MindLab发布Macaron V1模型,首创MoL架构提升GLM 5.2性能
摘要与判断
MindLab正式发布Macaron V1系列模型,包含基于GLM 5.2的748B旗舰版Venti和基于Qwen 3.6的35B轻量版Tall。该系列首创Mixture-of-LoRA(MoL)架构,通过在冻结基座上挂载多个独立LoRA专家消除能力干扰,并利用LongStraw技术将上下文扩展至2M。这一发布为大模型的高效后训练、长文本处理及多任务能力融合提供了新的架构参考与工具链支持。
Topics
引用和原文
Trace
- Raw Item
- raw_9c8f23b0da234852
- Processed Item
- processed_81003c50cc744c0d
- Source
- manual_wechat_mp
- Cluster
- 查看所属簇
- LLM Logs
- llm_be49b24b8b53430e, llm_db6a45a3c99d4951
- Coze Loop
- 43beb828d74b2e1f16e84d877fc08995