Appearance
GPT-6.1 Sol 发布解读:DevDay 新模型、Codex 与 ChatGPT 工具(2026)
更新日期:2026年09月30日
GPT-6.1 Sol 是 OpenAI 在 DevDay 2026 周期推出的推理模型,定位在复杂编程、电脑操作和专业工作之间,目标是在接近 GPT-6 Astra 能力的同时降低调用成本。本文依据 OpenAI 开发者文档和来源文章整理公开信息,并把官方已确认的规格与第三方报道的活动信息分开说明。
一、GPT-6.1 Sol 是什么?
GPT-6.1 Sol 可以理解为面向 Agent 工作流的高性价比模型。官方文档将它描述为以更低成本提供接近 Astra 的复杂工作表现,适合需要多轮推理、调用工具、检查中间结果并继续执行的任务。
它并不是普通聊天页面的通用入口。能否在 ChatGPT、Codex 或 API 中看到它,取决于产品、账号套餐、工作区策略、组织权限和分批开放进度。站内已有的 GPT-6 Sol 参数与使用核验指南可用于对照前代模型;实际可用状态应以账户界面和官方文档为准。
二、GPT-6.1 Sol 官方规格与 API 价格
截至本文更新日,官方模型页给出的核心参数如下:
| 项目 | GPT-6.1 Sol |
|---|---|
| API 模型名 | gpt-6.1-sol |
| 上下文窗口 | 1,050,000 Token |
| 最大输出 | 128,000 Token |
| 推理力度 | low、medium(默认)、high、xhigh、max |
| 输入与输出 | 文本、图片输入;文本输出 |
| 知识截止时间 | 2026年4月30日(以官方模型页为准) |
| 标准输入 | 每百万 Token 2 美元 |
| 缓存输入 | 每百万 Token 0.10 美元 |
| 缓存写入 | 每百万 Token 2.50 美元 |
| 输出 | 每百万 Token 10 美元 |
缓存输入价格约为未缓存输入价格的 5%。对于长上下文 Agent,重复发送稳定的系统提示、项目说明和工具定义时,缓存命中率会直接影响实际成本。超过 272K 输入 Token 的请求、Fast mode、Batch/Flex 和区域处理还会采用不同计费规则,预算评估不能只看表格中的基础单价。
三、GPT-6.1 Sol 适合哪些开发任务?
GPT-6.1 Sol 支持 Responses API 的工具调用,官方列出的工具包括 Web Search、File Search、Code Interpreter、Hosted Shell、Apply Patch、Computer Use、MCP、Skills 和 Tool Search。它也支持函数调用、结构化输出和流式响应。
这组能力适合以下工作流:
- 在真实代码库中定位跨文件问题,提出修改方案并生成补丁。
- 读取项目文档、测试结果和日志,连续执行排查步骤。
- 让 Agent 操作浏览器或桌面应用,完成明确、可审计的业务流程。
- 处理包含图表、截图或扫描页面的专业资料,再输出结构化结果。
- 用 MCP 连接内部工具,但把权限、审批和数据边界交给接入方控制。
官方模型页同时注明:Chat Completions 支持不带工具调用的使用,工具调用应使用 Responses API。电脑操作、Shell、MCP 等能力也不是模型自动获得的权限,仍需要应用侧显式配置和批准。
四、DevDay 期间公布了哪些 Codex 更新?
来源文章将 GPT-6.1 Sol 与一批 Codex、API 和 ChatGPT 更新放在同一场 DevDay 回顾中。按照该报道,Codex 的变化主要集中在执行位置、团队协作和代码审查:
- 云端 Codex 可以在可重复的开发环境中运行,团队可以共享权限和批准设置。
- Codex CLI 增加语音引导与
/agents视图,用于分配和跟踪多个任务。 - ChatGPT 桌面应用加入代码审查体验,可对云端修改进行首次检查,并把反馈带到 GitHub Pull Request 或 GitLab Merge Request。
- Codex Security 面向符合条件的计划提供云端仓库扫描、发现调查和修复准备能力。
这些功能的套餐和开放范围可能变化。使用企业工作区时,还要额外核对管理员策略、代码仓库授权、网络访问和数据保留设置。不要因为模型支持 Computer Use 或 Hosted Shell,就默认 Codex 已拥有本地电脑或仓库的全部权限。
五、ChatGPT 协作与插件方向
报道还提到 ChatGPT Space、Pages、协作幻灯片、团队任务、Meetings 插件和插件扩展等方向。它们共同指向一个变化:ChatGPT 不再只是单个对话窗口,也可以成为团队、应用和 Agent 共享上下文的工作空间。
对开发者而言,插件扩展可以提供侧边栏主页、交互面板和文件查看器;合作伙伴登录则允许用户在 ChatGPT 内调用外部工具。接入第三方服务前,应分别检查数据会发送到哪里、使用哪一个账号、是否能撤销授权,以及服务商是否会保存输入内容。
六、性能数据应该怎么读?
来源文章转述了 OpenAI 对 DeepSWE、GDP.pdf、AutomationBench、OSWorld 2.0 和 Terminal-Bench Science 等测试的结果,包括与 GPT-6 Sol、GPT-6 Astra 及其他模型的分数和成本比较。这些数字适合用来理解产品定位,但不能直接当作你项目的实测结果。
原因有三点:
- 不同测试使用的推理力度、工具配置、提示词和数据集不同。
- OpenAI 的自有模型可能在内部环境或 API 中评估,竞品数据可能来自公开报告。
- 单任务成本会受输入长度、缓存命中、工具调用次数和重试策略影响。
更可靠的做法是使用自己的代表性任务建立小型评测集,分别记录成功率、人工返工时间、延迟、Token 成本和错误类型,再决定是否从 GPT-6 Sol 迁移。
七、国内用户如何核验可用性?
国内用户看到第三方文章或镜像页面宣称“已开放”时,可以按下面顺序核对:
- 在 OpenAI 官方模型文档确认模型名、规格和价格。
- 登录实际使用的 ChatGPT Work、Codex 或 API 项目,检查模型选择器、项目权限和账单页面。
- 对比请求返回的模型 ID,避免把第三方平台的自定义名称当成官方模型名。
- 不要在未知镜像、插件或网页中粘贴 API Key、源代码、客户资料和内部文档。
OpenAI 服务的可用性还会受到地区、账号、网络、组织政策和服务状态影响。请遵守当地法律法规与 OpenAI 平台条款,不要通过虚假身份、共享密钥或绕过安全控制来使用服务。
常见问题
GPT-6.1 Sol 已经能在普通 ChatGPT 对话中使用吗?
不能仅凭 DevDay 报道判断普通 ChatGPT 已面向所有账号开放。官方开发者文档确认的是 API 模型规格;ChatGPT 和 Codex 的可见范围应以当前账号、工作区和官方公告为准。
GPT-6.1 Sol 与 GPT-6 Astra 怎么选?
需要极限质量、复杂推理或高价值单次任务时,先评估 Astra;需要大量代码迭代、工具调用和长上下文任务时,Sol 的成本结构更值得测试。最终应以自己的评测集和预算决定。
API 应该使用哪个模型 ID?
官方模型页列出的模型 ID 是 gpt-6.1-sol。请在服务端配置密钥,并以 API 返回结果和官方价格页为准。
结语
GPT-6.1 Sol 的核心卖点是“接近高端模型的复杂任务能力,加上更低的 Token 成本和更完整的 Agent 工具链”。DevDay 的 Codex 与 ChatGPT 更新则把重点从单次问答推进到代码审查、团队协作和可复用工作空间。准备采用 GPT-6.1 Sol 时,先核验官方入口和账号权限,再用真实任务测量质量、成本与权限风险。
参考来源:
- OpenAI Developers:GPT-6.1 Sol 模型文档
- OpenAI:DevDay 2026 回顾
- Unite.AI:OpenAI 在 DevDay 发布 GPT-6.1 Sol(第三方报道)