不免费。OpenAI 于 2026 年 9 月 29 日发布它,面向 ChatGPT Work 和 Codex 中的 Plus、Pro、Business、Enterprise 和 Edu 用户。它尚未进入 Chat,Free 和 Go 套餐无法使用,API 模型 gpt-6.1-sol 没有免费额度。Standard API 定价为每百万输入 token $2、每百万缓存输入 token $0.10、每百万输出 token $10。
好消息是便宜的路子更便宜了。GPT-6.1 Sol 保持了 GPT-6 Sol 的 $2/$10 标价,并把缓存输入费率减半。本指南按成本为每条途径排序,说明哪些并不免费,用一个使用真实费率的成本示例演算一遍,并给出同一 GPT-6 家族的免费替代方案。想了解模型本身,请阅读 what GPT-6.1 Sol is;关于上一代模型的同一问题由 is GPT-6 Sol free 回答。在选择途径之前,先在 Apifox 中测量你自己提示词的成本。
通往 GPT-6.1 Sol 的各条途径对比
| 途径 | 成本 | 你能得到什么 | 限制 |
|---|---|---|---|
| 免费替代方案(不是 Sol):ChatGPT 桌面版中的 GPT-6 Luna | Free 套餐下 $0 | 桌面版 Work 和 Codex 中的 Luna,而非 Sol | 是不同的模型;不在 Chat 中;没有 API key |
| 在 Codex 或 ChatGPT Work 中使用 ChatGPT Plus | 一份 Plus 订阅 | 用于编码和工作任务的 6.1 Sol | 受套餐用量限制;不在 Chat 中;没有 API key |
| 通过 Sign in with ChatGPT 使用合作方应用 | 计入你的 Plus 或 Pro 用量 | 在 Devin、Notion、Vercel、T3、OpenClaw 和 Dactyl 等应用内使用你的套餐 | 仅限 Plus 和 Pro;每个应用有每周上限;额度默认关闭 |
| API、Batch 或 Flex | 输入 $1、缓存 $0.05、输出 $5 | Standard 费率的一半 | Batch 是异步的;Flex 更慢且可能返回 429 |
| API、带缓存的 Standard | 输入 $2、缓存 $0.10、输出 $10 | 在你自己的代码中调用该模型 | 每个 token 都计费;缓存命中需要稳定的 prefix |
OpenRouter openai/gpt-6.1-sol |
输入 $2、缓存 $0.10、输出 $10(OpenAI 端点) | 一个密钥跨多个服务商 | 与标价相同;并不免费 |
所有 API 价格均为每百万 token,适用于输入不超过 272K token 的提示词,取自 OpenAI 的定价页和 OpenRouter 的模型页。
ChatGPT Plus:交互式使用的入门套餐
如果你想自己在 Codex 或 ChatGPT Work 中使用 6.1 Sol,Plus 是包含它的最低档套餐。OpenAI 的发布公告称它面向「ChatGPT Work 和 Codex 中的全部 Plus、Pro、Business、Enterprise 和 Edu 用户」开放,并说明它「尚未在 Chat 中提供」。根据 OpenAI 的模型文档,Enterprise 和 Edu 需要管理员启用后才能使用。
在这里你不按 token 付费,但套餐用量限制依然适用;我们的 Codex usage limits 指南解释了它们如何运作。free Codex guide 覆盖了 Codex 的零成本选项,但对 6.1 Sol 而言,OpenAI 的名单从 Plus 起步。
Sign in with ChatGPT:在其它应用中使用你的套餐
DevDay 新增了 Sign in with ChatGPT。身份认证部分(OAuth/OIDC)已在全球可用。在此之上,Plus 和 Pro 用户可以在参与的工具中消耗其套餐用量。OpenAI 发布时带来了 16 家合作方,其DevDay recap点名了 Cognition 的 Devin、Notion、Vercel、T3、OpenClaw 和 Dactyl。
根据 OpenAI 的在其它应用中使用套餐的帮助文档,用量规则如下:
- 符合条件的请求会计入你套餐的 ChatGPT Work 和 Codex 用量。
- 每个应用会有以你每周总用量百分比设定的每周使用上限。它是上限,不是预留额度。
- 达到上限后用额度付费是可选的,默认关闭,且只有在应用的用量达到 100% 后才生效。
- 应用会获得你的姓名、邮箱地址和头像。它不会获得你的对话、记忆或 API key。
在假定某个应用使用的是 6.1 Sol 之前,请先确认它用的是哪个模型。如果你想知道 OpenClaw 本身要多少钱,请阅读 is OpenClaw free。开发者侧的内容,从 client ID 到 OAuth 流程,都在我们的 Sign in with ChatGPT guide 中。
ChatGPT 套餐不是 API key
这是大多数「免费 GPT」搜索中的陷阱。Plus 或 Pro 套餐让你在 ChatGPT Work 和 Codex 中使用 6.1 Sol,而不是给你一个 API key。脚本、CI 任务或 Agent 只要向 https://api.openai.com/v1 发送 Authorization: Bearer $OPENAI_API_KEY,无论你买的是哪个套餐,都按 token 计费。代码想使用套餐的唯一方式是 Sign in with ChatGPT 的 OAuth 流程;OpenAI 的套餐用量文档向开源和本地托管的应用开放了它,但带有预览期限制:仅支持流式、store: false、不支持 temperature,也不支持文件搜索等托管工具。这些请求仍然计入你的 Plus 或 Pro 用量以及该应用的上限。
最省钱的 API 途径:Batch、Flex 与缓存
有三个杠杆可以降低每 token 账单:
- Batch 以 Standard 费率的一半异步运行任务:输入 $1、缓存 $0.05、输出 $5。我们的 Batch API guide 完整演示了一次批量任务。
- Flex 在设置
service_tier: "flex"时,让普通请求按 Batch 费率计费。Flex 处理指南提醒响应会更慢,并可能偶尔返回429 Resource Unavailable错误,这类错误不收费。 - Prompt 缓存默认开启。缓存输入为 $0.10,比标准输入低 95%,也是 GPT-6 Sol 的 $0.20 的一半。OpenAI 的prompt caching 指南规定最小长度为 1,024 token,缓存写入按未缓存输入费率的 1.25 倍计费(此处为 $2.50),并且 prefix 在最后一次写入或复用后 30 分钟内可继续复用。
请把提示词控制在 272K 输入 token 以内。超过之后,模型页说明整个请求按输入与缓存费率的 2 倍、输出费率的 1.5 倍计费。
演算示例:一次 Agent 调用要花多少钱
假设一个 Agent 步骤使用 100,000 token 的 prefix(系统提示词、工具 schema、代码库上下文),它在多次调用间保持不变,另有 8,000 个新增输入 token 和 2,000 个输出 token(含推理)。prefix 已被缓存,且显式缓存模式会在 prefix 处停止缓存写入,因此新增 token 按普通输入计费。
在 Standard 档且命中缓存时:
- 缓存输入:100,000 x $0.10 / 1,000,000 = $0.0100
- 新增输入:8,000 x $2.00 / 1,000,000 = $0.0160
- 输出:2,000 x $10.00 / 1,000,000 = $0.0200
- 合计:每次调用 $0.0460
在 Batch 或 Flex 档,所有费率减半:$0.0050 + $0.0080 + $0.0100 = $0.0230。在 GPT-6 Sol 上,缓存这一项翻倍到 $0.0200,因此单次调用成本为 $0.0560。如果在 6.1 Sol 上没有命中缓存,全部 108,000 个输入 token 都按 $2.00 计费:$0.2160 + $0.0200 = $0.2360。
| 场景 | 每次调用 | 1,000 次调用 |
|---|---|---|
| 6.1 Sol Standard,命中缓存 | $0.046 | $46 |
| 6.1 Sol Batch 或 Flex,命中缓存 | $0.023 | $23 |
| GPT-6 Sol Standard,命中缓存 | $0.056 | $56 |
| 6.1 Sol Standard,未命中缓存 | $0.236 | $236 |
第一次调用会以每百万 $2.50 把 prefix 写入缓存:这部分为 100,000 x $2.50 / 1,000,000 = $0.25。此后,缓存命中率会让账单相差约五倍,Batch 或 Flex 能让它减半,而在这个例子中从 GPT-6 Sol 迁移每次调用只省下一美分,因为只有缓存那一项变了。想了解更多命中缓存的技巧,请阅读 GPT-6 prompt caching。
哪些并不免费
- ChatGPT Free 和 Go:没有 6.1 Sol。
- ChatGPT Chat:任何套餐下 6.1 Sol 都还没进入这里。
- API:没有免费额度。
- 用 Free 账号使用 Sign in with ChatGPT:套餐用量仅限 Plus 和 Pro。
- OpenRouter:价格相同,没有折扣。
- Ultrafast:6.1 Sol 的「即将推出」,而在 GPT-6 Astra 上它要花 Standard 的 6 倍。
免费替代方案:GPT-6 Luna
如果你需要一个完全不花钱的选项,GPT-6 Luna 在 ChatGPT 桌面版的 Work 和 Codex 中面向 Free 套餐提供(付费的 Go 套餐也能用)。它不在 Chat 中。它是一款不同的、更便宜的模型,而且套餐席位并不附带 API key,所以它也无法驱动你写的脚本或 Agent。free GPT-6 Luna guide 覆盖了配置步骤。在 API 上,Luna 标价为输入 $0.10、输出 $0.50,是 6.1 Sol 输入与输出费率的二十分之一,这使它成为高并发分类与抽取场景的经济之选。
在做选择之前,先在 Apifox 中测量真实 token 用量
上面的示例用的是虚构的 token 数。真正决定哪条途径更划算的是你的实际数字,而在 Apifox 中保存一个请求就能拿到它们:
- 创建一个环境,设置
OPENAI_API_KEY,并将MODEL_ID设为gpt-6.1-sol。 - 保存一个指向
https://api.openai.com/v1/responses的 POST,在 Authorization header 中带上Bearer {{OPENAI_API_KEY}},body 中包含"model": "{{MODEL_ID}}"、"reasoning": {"effort": "low"},并把来自你实际负载的真实提示词作为input。 - 发送两次。断言第二次运行时
$.usage.input_tokens_details.cached_tokens大于 0,这样一处破坏缓存的提示词修改就会让测试失败。 - 在
low和medium下对比usage.output_tokens与usage.output_tokens_details.reasoning_tokens。推理指南指出推理 token 按输出计费。 - 添加一个后置脚本,按 Standard 费率计算每次调用的价格:
const u = pm.response.json().usage;
const d = u.input_tokens_details || {};
const cached = d.cached_tokens || 0;
const written = d.cache_write_tokens || 0;
const fresh = u.input_tokens - cached - written;
const usd = (fresh * 2 + cached * 0.1 + written * 2.5 + u.output_tokens * 10) / 1e6;
console.log(`gpt-6.1-sol Standard: $${usd.toFixed(4)} per call`);
乘以你的日均调用量,Batch 或 Flex 则再减半。把该请求保存到测试场景中,Apifox CLI 就能在 CI 中重跑它,于是让缓存命中率下降的提示词改动会在账单到来之前先暴露出来。
FAQ
GPT-6.1 Sol 在 ChatGPT 中免费吗?不免费。它在 ChatGPT Work 和 Codex 中面向 Plus、Pro、Business、Enterprise 和 Edu 提供。它尚未进入 Chat,也不在 Free 或 Go 中。
我能用 ChatGPT Plus 套餐调用 GPT-6.1 Sol API 吗?不能用 API key 调用:套餐并不是 API key,而发送密钥的代码按 token 计费。Sign in with ChatGPT 让实现了其 OAuth 流程的应用(包括开源和本地托管的)可以把符合条件的请求计入 Plus 或 Pro 用量,但有预览期限制。
有免费的 GPT-6.1 Sol API 吗?没有。最便宜的官方费率是 Batch 或 Flex:每百万 token 输入 $1、缓存 $0.05、输出 $5。
GPT-6.1 Sol 在 OpenRouter 上免费吗?不免费。OpenRouter 在其 OpenAI 端点把 openai/gpt-6.1-sol 标为 $2/$10,与 OpenAI 的标价相同。
GPT-6.1 Sol 比 GPT-6 Sol 便宜吗?标价相同,都是 $2/$10。缓存输入减半($0.10 对 $0.20),因此缓存命中率高的负载会更便宜。
下一步
HiFox:将 Agent 变成真正的队友
另外,我们也在思考,AI 如何从个人提效走进团队协作。
HiFox 是一个让人和 AI Agent 在同一个工作现场协作的平台:你可以像给同事分派任务一样指派 Agent,在任务看板中跟踪进度、查看结果,让 Agent 成为团队里的队友。
👉 立即体验 HiFox:https://hifox.com
AI Coding 交流群
如果你也在用 AI 写代码,或者正在研究 Cursor、Claude Code 这些工具,
欢迎加入以下交流群。群里平时会聊一些 AI 编程的实际用法、开发工作流,还有各种新工具和新玩法。