#1
当前簇头 · 第 1、3 任独立事件二手报道
Meta 新模型 Muse Spark 1.2 在 ErdosBench 测试中优于 GPT-5.5 xhigh
第三方团队在 ErdosBench 基准测试中评估了 Meta 新模型 Muse Spark 1.2,结果显示其在 226 个研究级数学问题中成功解决 40 题。该模型在数学研究能力上表现优于 GPT-5.5 xhigh,仅略逊于 Kimi K3,为评估当前前沿模型在复杂推理任务上的水平提供了新的参考数据。
去重判断LLM 复核 · 独立事件
在 CozeLoop 查看判断 簇级候选:8 个已有簇, 共 9 条代表。
最终结果已修正为“独立事件”,以当前持久化状态为准。