首页/ 资讯/ Muse Spark 1.3 Meta 推出的新一代大语言模型

Muse Spark 1.3 Meta 推出的新一代大语言模型

灵犀编辑部 2026-09-03 1 阅读

Muse Spark 1.3是什么

Muse Spark 1.3 是 Meta 推出的新一代大语言模型,由扎克伯格亲自站台,定位为 Meta 在编程和智能体任务上的重大突破。模型在代码理解与长文本处理方面表现尤为出色,工具调用和 Token 消耗显著降低,同时用极具竞争力的价格向开发者开放 API。

Muse Spark 1.3

Muse Spark 1.3的主要功能

  • 长任务 Agent 工作流 :支持长时间运行的开放式任务,能自主收集上下文、从杂乱信息中整理线索、发现计划缺口后主动调整,持续记录状态直至交付。
  • 编程能力增强 :针对长时间编程任务优化,减少不必要的对话轮次,代码风格更干净,在代码库理解与终端编程上表现突出。
  • 复杂指令遵循 :在多步骤、多限制条件的任务中能持续记住前文要求,减少后半段遗漏条件或偏离流程的问题。
  • 长上下文处理 :支持 1M tokens 上下文窗口,长文本检索准确率极高。
  • 人机协作优化 :面对模糊指令主动追问用户,任务受阻时主动求助,涉及不可逆操作前会确认执行。
  • 成本效率提升 :完成相同任务时工具调用减少约 20%,Token 消耗减少约 25%。

Muse Spark 1.3的技术原理

  • 后训练与测试时扩展 :基于 Avocado 模型进行再次后训练,同时强化测试时扩展能力(test-time scaling),使模型在推理阶段能动态分配更多计算资源提升输出质量。
  • 多环境 Agent 训练 :模型在多种不同的 Agent harness 中进行了训练,让它离开特定环境后依然能保持相近的工作能力。
  • 能力边界对齐 :Meta 专门强化模型对自身能力边界的感知训练,使其能更准确地区分「知道什么、不知道什么、能做什么、做不了什么」,遇到障碍时明确表达而非虚构结果。
  • 长程编程任务数据 :增加大量长时间编程任务的训练数据,针对日常工程场景中的可用性进行了优化,使模型在真实开发工作流中更高效、更克制。

如何使用Muse Spark 1.3

  • Muse Code 终端编程 :在终端执行 curl -fsSL https://dev.meta.ai/install.sh | bash 安装 Muse Code,可在编程工作流中直接调用 Muse Spark 1.3 作为底层模型。
  • Meta Model API 接入 :开发者通过官方 API 直接调用,标准定价为输入 $1.25/百万 tokens、输出 $4.25/百万 tokens。
  • Contributor 折扣档 :安装 Muse Code 后默认开启,以输入 $0.10、输出 $0.20 的低价使用,代价是提示词和代码输出会被 Meta 用于训练,可手动切换退出。
  • 第三方平台集成 :Vercel AI Gateway 等合作伙伴平台已接入 Muse Spark 1.3,方便在现有工作流中快速集成调用。

Muse Spark 1.3的核心优势

  • 编程能力领先 :在 DeepSWE、SWEAtlas、Terminal-Bench 等编程基准中多项第一,超越 GPT-5.6 Sol 和 Claude Opus 5。
  • 长上下文极强 :支持 1M tokens 上下文,长文本检索准确率高达 98% 以上,大幅领先竞品。
  • 成本效率双优 :相同任务下工具调用减少约 20%、Token 消耗减少约 25%,API 定价远低于同级别模型。
  • Agent 长任务自主化 :能自主收集信息、发现计划缺口后主动调整,在复杂开放式任务中持续保持状态。
  • 人机协作更自然 :面对模糊指令主动追问,任务受阻时主动求助,涉及不可逆操作前会确认执行。
  • 性价比极具竞争力 :标准档定价仅为 Claude Opus 5 的约 1/5,Contributor 折扣档更是低至几乎忽略不计。

Muse Spark 1.3的同类竞品对比

对比维度 | Muse Spark 1.3 | Claude Opus 5

>
对比维度 Muse Spark 1.3 Claude Opus 5
发布方 Meta Anthropic
上下文窗口 1M tokens 200K tokens
编程能力 DeepSWE v1.1 得分 75.4%,领先 DeepSWE v1.1 得分 74.0%,稍逊
知识工作 GDPVal-AA v2 得分 1754 GDPVal-AA v2 得分 1824,更强
计算机操控 OSWorld 2.0 得分 66.9 OSWorld 2.0 得分 68.3,略优
标准输入定价 $1.25 / 百万 tokens $5 / 百万 tokens
标准输出定价 $4.25 / 百万 tokens $25 / 百万 tokens

Muse Spark 1.3的应用场景

  • 智能编程开发 :通过 Muse Code 完成复杂代码编写、跨文件调试与大型代码库理解,工具调用和 Token 消耗显著降低。
  • 长文档深度分析 :利用 1M tokens 上下文窗口处理百万字级长文本,进行跨章节信息提取、关联分析与精准检索。
  • 个人 Agent 长期任务管理 :持续跟踪用户目标,自主收集信息、发现计划缺口后主动调整策略,直至交付最终成果。
  • 复杂工程报告生成 :整合多源异构数据(如 CFD 仿真结果、CAD 模型),按指定格式自动生成结构化专业报告。
相关工具
与本文相关的 AI 工具
AI 智能推荐 ×
输入关键词,AI 从 1000+ 工具中精准匹配推荐