首页/ 资讯/ GPT-6 Luna OpenAI 推出的轻量级 AI 模型

GPT-6 Luna OpenAI 推出的轻量级 AI 模型

拆宝 2026-09-23 24 阅读

GPT-6 Luna是什么

GPT‑6 Luna 是 OpenAI 推出的轻量级模型,与 GPT‑6 Sol 同属 GPT‑6 Astra 的衍生版本,定位高频、规模化任务。模型 API 价格降至输入 0.1 美元、输出 0.5 美元每百万 token,比上一代便宜 50%,已进入 DeepSeek 腹地。性能上,编程测试 DeepSWE 达 66.6%,接近 Claude Opus 5 中等强度水平,成本仅为其约 7%,适合轻量开发、批量处理和多 Agent 并发场景。

GPT-6 Sol

GPT-6 Luna的主要功能

  • 轻量级编程 :DeepSWE v1.1 得分 66.6%,接近 Claude Opus 5 中等强度水平,但任务成本低 93%。

  • 计算机操作 :OSWorld 2.0 测试中超过 GPT-5.6 Sol(medium),成本仅为其十分之一。

  • 专业工作流 :高推理强度下 AutomationBench 得分较 GPT-5.6 Luna 提升 5.4 个百分点,任务成本降低 58%。

  • 事实准确性 :高推理强度下以约百分之一的成本达到 GPT-5.6 Sol 的事实可靠性水平。

  • 协作风格优化 :回答更简洁清晰,少术语、少冗余细节,明确说明检查了哪些内容。

GPT-6 Luna的技术原理

  • Astra 蒸馏下放 :采用与 GPT-6 Astra 相近的训练方法,将旗舰模型在推理、多模态、对齐等方面的能力压缩到更轻量、吞吐量更高的运行版本,实现能力规模化而非单纯追求峰值性能。

  • 推理基础设施优化 :通过改进缓存机制和推理效率降低服务成本,并将节省的成本以降价 50% 的形式直接让给用户,这是低价的根本来源而非单纯压缩模型能力。

  • Prompt Caching 升级 :系统默认缓存命中率更高,缓存输入读取享 90% 折扣;支持对话中动态调整推理强度和工具开关而不破坏缓存复用,并引入显式断点让开发者精确控制缓存前缀边界,对长上下文 Agent 场景尤为关键。

  • 分级推理强度 :提供低/中/高/最高等多档 effort 设置,用户可按任务难度灵活调节算力投入,高推理强度可逼近上一代 Sol 的水平,低强度则进一步压低成本,实现成本与能力的动态权衡。

如何使用GPT-6 Luna

方式一:ChatGPT Work / Codex

  • 确认是 Plus、Pro、Business、Enterprise 或 Edu 用户(Free/Go 用户仅限桌面应用使用 Luna)。

  • 打开 ChatGPT Work 或 Codex,在模型选择器中找到 GPT-6 Luna。

  • 直接输入任务开始使用,Luna 适合高频、轻量化的日常任务。

方式二:API 调用

  • 登录 OpenAI 开发者平台,获取 API Key。

  • 在请求中将模型参数设为 gpt-6-luna ,按每百万 token 输入 0.1 美元、输出 0.5 美元计费。

  • 可通过控制台 Prompt Caching Dashboard 监控缓存命中率,配合显式断点优化长上下文复用以进一步降低成本。

GPT-6 Luna的核心优势

  • 能力越级对标 :DeepSWE 编程测试达 66.6%,接近 Claude Opus 5 中等强度水平,但任务成本低 93%。

  • 闯入 DeepSeek 价格腹地 :普通请求定价已进入 DeepSeek V4.1 Flash 区间且更便宜,没有峰谷定价波动。

  • 事实可靠性提升 :高推理强度下以约百分之一的成本达到 GPT-5.6 Sol 的事实准确性水平。

  • 缓存大幅省钱 :改进的 Prompt Caching 命中率高,缓存输入读取享 90% 折扣,长上下文 Agent 场景成本进一步压缩。

  • 适合规模化并发 :轻量架构吞吐量高,适合批量处理、轻量开发、多 Agent 并发等高频任务。

GPT-6 Luna的项目地址

  • 项目官网 :https://openai.com/index/introducing-gpt-6-sol-and-luna/

GPT-6 Luna的同类竞品对比

对比维度 | GPT-6 Luna | DeepSeek V4.1 Flash

对比维度

GPT-6 Luna

DeepSeek V4.1 Flash

输入价格

$0.10 / 百万 token(约 0.7 元)

闲时 1 元,高峰 2 元

输出价格

$0.50 / 百万 token(约 3.5 元)

闲时 4 元,高峰 8 元

缓存命中输入

缓存读取 90% 折扣

闲时低至 0.02 元 / 百万 token

价格模式

固定价,无峰谷波动

闲时/高峰分时定价

DeepSWE 得分

66.6%(max)

74.2%

上下文窗口

支持长上下文 + 缓存优化

100 万 token 上下文

多模态

继承 Astra 多模态能力

支持图文理解

生态入口

ChatGPT Work、Codex、API 全家桶

API + 开放平台

GPT-6 Luna的应用场景

  • 轻量级编程 :承担代码检查、批量修改和简单功能开发,以 Claude Opus 5 约 7% 的成本提供接近其中级水平的编程能力。

  • 多 Agent 并发任务 :支撑大规模 Agent 并行执行的长流程工作流,低单价让成本优势随并发规模成倍放大。

  • 高频日常办公 :处理邮件起草、文档摘要、数据整理等重复性工作,固定低价且无峰谷波动使预算完全可控。

  • 计算机自动化操作 :执行网页浏览、表单填写等 RPA 类任务,以 GPT-5.6 Sol 十分之一的成本实现更高的操作得分。

  • AI 应用规模化部署 :作为聊天机器人和内容生成产品的后端模型,其极低 API 定价让高频调用的边际成本趋近于零。

相关工具
与本文相关的 AI 工具
AI 智能推荐 ×
输入关键词,AI 从 1000+ 工具中精准匹配推荐