- 开始
- 2026年9月2日可信度 90%来自来源
Muse Spark 1.3 发布
由原文自动翻译
原标题: Muse Spark 1.3 Released
- Meta 于 2026 年 9 月 2 日发布了 Muse Spark 1.3,称其“在智能体和编程任务上带来了性能提升”,并借鉴了“Muse Code 和 Meta Model API 数月广泛应用”所积累的经验[1]
- 这是 Meta 五个月内第四次发布 Muse Spark 模型;目前可用的版本 Muse Spark 1.3(xhigh)在 Artificial Analysis 智能指数上得分 61,高于 8 月发布的 Muse Spark 1.2 的 57 分,与 GPT-5.6 Sol(max)和 Grok 4.6(high)并列[4]
- Muse Spark 1.3(max)得分 62,仅次于 Claude Fable 5.1 和 Claude Opus 5;Meta 的博文称 max 推理版本已在 Muse Code 和 Meta Model API 上线,而 Artificial Analysis 称其目前只是面向 Meta 合作伙伴的限量预览版,VentureBeat 则称其仍处于安全测试阶段[1][3][4]
- Meta 训练该模型在提示含糊时主动提出澄清问题,在遇到困难时向用户求助,并在执行有实际影响的操作前先进行确认;该模型也能更好地了解“自己能做什么、不能做什么”,而不是凭空臆造结果[1]
- 在 Meta 工程师的对比测试中,该模型的工具调用次数比 Muse Spark 1.2 减少约 20%,消耗的 token 减少约 25%[1]
- Meta 的路线图包括“更大规模的模型、Muse Spark 开放权重版本等等”[1][3]
值得关注的功能
- 价格与 Muse Spark 1.2 保持一致:每百万输入 token 1.25 美元,每百万缓存输入 token 0.15 美元,每百万输出 token 4.25 美元;还有一个“贡献者”档位,价格为每百万 token 0.10 美元和 0.20 美元,但相关数据会被用于改进 Meta 的产品[2][4]
- 1M token 的上下文窗口,支持文本、图像和视频输入[2][4]
- Artificial Analysis 的测试成绩:在 Tau3-Bench Banking 上,xhigh 得分 47%、max 得分 52%(所有模型中的最高分),而 Muse Spark 1.2 为 35%;Terminal-Bench 2.1 得分 85%,Muse Spark 1.2 为 80%;GDPval-AA v2 的 Elo 分别为 1,709 和 1,754,Muse Spark 1.2 为 1,615[4]
- 按每个智能指数任务 0.55 美元计算,它是得分 59 分及以上的模型中最便宜的一款;GPT-5.6 Sol(max)每任务 0.95 美元,Grok 4.6(high)为 0.94 美元[4]
- 存在一些小幅退步:AA-LCR 从 83% 降至 79%,AA-Omniscience 的准确率也有所下降,原因是该模型在不确定时更倾向于拒绝回答[4]
- 安全性:对对抗性输入和提示注入的抵御能力增强,对哪些智能体操作具有不可逆性的判断也更加准确[1]
- 该模型已在 Muse Code(Meta 面向 macOS 和 Linux 终端的多智能体编程工具)以及 Meta Model API 中上线[1]
参考资料 4可信度 88%总体可信度: 88%该图钉的来源和参考资料对其日期的支持程度。包括来源在内的 4 份资料对图钉开始和结束时间支持程度的加权平均;资料每比最新的一份旧 180 天,权重减半显示所有可信度不低于 75% 的图钉
第一项始终是图钉的来源。总体可信度是各份资料对上方所用开始和结束时间支持程度的加权平均;资料每比最新的一份旧 180 天,权重减半。
- [1]90%research.meta.ai/blog/introducing-muse-spark-1-3research.meta.ai· 发布于 2026年9月28日· 开始 2026年9月2日 ✓· 占评分 26%
Meta[2] 的博文日期为“2026 年 9 月 2 日”,文中写道:“我们很高兴发布 Muse Spark 1.3”,并称其“今天已在 Muse Code 和 Meta Model API 中上线”;Artificial Analysis[4] 同日发布的文章开篇即写道:“Meta 已发布 Muse Spark 1.3”。
- [2]90%Muse Spark 1.3 | Metadeveloper.meta.com· 添加于 2026年9月28日· 占评分 26%
Meta's[1] developer model page lists the two API models and their prices - muse-spark-1.3 at $1.25 input, $0.15 cached input and $4.25 output per million tokens, and muse-spark-1.3-contributor at $0.10 and $0.20 with data used to improve Meta's products - both with a 1M-token context window.
- [3]80%Meta says Muse Spark 1.3 has frontier performance - but its best results come from a model developers can't broadly use yetventurebeat.com· 发表于 2026年9月3日· 占评分 24%
VentureBeat's report by Carl Franzen says the xhigh version is broadly available through Muse Code and Meta[1][2] Model API while the max configuration is undergoing safety testing and will arrive shortly, and notes the open-weights release now on Meta's roadmap.
- [4]90%Muse Spark 1.3: Meta reaches the frontierartificialanalysis.ai· 发表于 2026年9月2日· 开始 2026年9月2日· 占评分 24%
Artificial Analysis' same-day independent benchmark write-up: Muse Spark 1.3 (xhigh) scores 61 on its Intelligence Index, up from 57 for 1.2 and 53 for 1.1, and the limited-preview max variant 62, behind only Claude Fable 5.1 and Claude Opus 5; it gives the Tau3-Bench Banking, Terminal-Bench 2.1, GDPval-AA v2 and cost-per-task figures.
建议更正
有遗漏或错误吗?用你自己的话说明:能佐证此图钉的链接、不同的开始或结束日期及理由,或缺失、有误的信息。AI 会对照此图钉的来源进行核实,搜索更好的来源,并添加任何支持你说法的页面。图钉自身的来源仍然最重要。AI 也会查看图片:显示的是别的东西或显示效果差的图片会被移到后面或替换。