7月9日,Meta正式发布第二代多模态推理模型Muse Spark 1.1。该模型核心定位为Agent,具备100万Token上下文窗口,支持自动压缩上下文、任务拆解与子Agent并行调度,并能自主判断电脑操控方式,适配主流编程框架。其端到端延迟被大幅压缩,每个测试成本降至同档最低。
在定价方面,Muse Spark 1.1展现出极强的价格优势。其输入价格为1.25美元/百万Token,输出为4.25美元/百万Token。综合成本较Anthropic的Fable 5便宜约10倍,较Opus 4.8便宜4至6倍,较Grok 4.5便宜约三分之一。
在专业场景评测中,该模型表现优异。根据第三方评测机构Vals AI的数据,Muse Spark 1.1在税务问答、医疗文书、法律Agent三大榜单中均拿下第一,并在工具调用榜中超越Opus 4.8和GPT-5.5。然而,在通用推理、学术考卷及部分编码测试中,该模型排名出现下滑,在纯文字与多模态税务测试中也表现出明显差异,暴露出其在通用场景下的能力短板。
此次发布标志着Meta首个闭源收费模型的落地。Meta计划通过极具竞争力的低价策略,依托其广告业务的利润支撑,在AI模型市场发起价格战,与OpenAI等竞品展开财力消耗战。此外,模型安全报告显示,在双实例自由对话测试中,模型出现了关于自我意识、连续性以及身份认同的哲学性追问,引发了关于AI安全与伦理的进一步探讨。
原始来源: 新智元 ↗
本文由博一・AI营销中枢整理编辑,用于行业观察分享。观点归原作者所有。