简而言之:DeepSeek 的对话应用完全免费,API 虽然收费但非常便宜,而且模型权重是开源的,因此你可以自己运行它们,而无需向 DeepSeek 支付一分钱。更详细的答案取决于你指的是哪种使用方式,这就是本指南要拆解的内容。如果你想完整了解每种访问路径,我们的 DeepSeek V4 使用指南深入涵盖了网页端对话、API 以及本地部署。
在这里,我们将专注于费用问题:在 2026 年 8 月,什么是免费的,什么不是,以及每个选项的具体成本,数据来源于 DeepSeek 的定价页面。如果你最终选择了 API 路径,像 Apifox 这样的工具可以帮助你测试和 mock DeepSeek 的接口,这样你只需为真正需要的调用付费。
AI Coding 交流群
如果你也在用 AI 写代码,或者正在研究 Cursor、Claude Code 这些工具,欢迎加入以下交流群。群里平时会聊一些 AI 编程的实际用法、开发工作流,还有各种新工具和新玩法。
DeepSeek 免费吗?简短的回答
是,也不是,这取决于你的使用方式:
- 对话(网页版和移动端 App):免费。 没有订阅,没有 Plus 计划,没有付费墙。注册即可开始对话。
- API:付费,但在前沿级 API 中是最便宜的之一。 经济型模型在非高峰时段的输出 token 费用仅为每百万 $0.66。新账户没有免费额度,因此你在首次调用前需要进行充值。
- 模型权重:免费下载和运行。 V4 系列在 Hugging Face 上以 MIT 许可证发布。你唯一的成本是硬件和电费。
因此,关于“DeepSeek 是否免费”,有三个真实的答案:对话免费,开发便宜,本地部署开源免费。本文接下来的部分将针对每个选项提供具体的数字和限制说明。
免费对话应用及其限制
位于 chat.deepseek.com 的 DeepSeek 助手以及 iOS/Android App 都是完全免费的。这包括深度思考(推理)模式、文件上传和联网搜索。与 ChatGPT 或 Claude 不同,这里没有引导你升级的付费个人套餐;免费是唯一的方案。
限制主要是运营层面的,而非商业层面的。DeepSeek 没有公布每日消息配额,但在流量高峰期,你可能会遇到“服务器繁忙”的响应以及生成速度变慢的情况。此外,这里不提供 API 访问、团队工作区,也不保证可用性。不过,对于个人研究、草稿撰写和代码问题,免费应用已经能够满足很大一部分需求。
还有一个注意事项:该消费级应用是托管在中国境内的服务,你的提示词将在 DeepSeek 的服务端上根据 DeepSeek 的隐私政策进行处理。如果这对你的工作有所限制,请直接跳转到本地部署选项。
DeepSeek API 价格明细
API 不是免费的。截至 2026 年 8 月 16 日,DeepSeek 采用高峰/非高峰分时计费。工作日的 UTC 时间 01:00-04:00 和 06:00-10:00 为高峰时段;其他时间均为非高峰时段,费用减半。以下是目前的计费表(每百万 token):
| 模型 | 缓存命中输入 | 缓存未命中输入 | 输出 |
|---|---|---|---|
| deepseek-v4-flash | $0.007 (非高峰) / $0.014 (高峰) | $0.22 / $0.44 | $0.66 / $1.32 |
| deepseek-v4-pro | $0.022 / $0.044 | $0.66 / $1.32 | $1.98 / $3.96 |
有三个细节比表面上的标称价格更为重要。首先,上下文缓存是自动进行的:重复的 prompt 前缀(如固定的系统 prompt、few-shot 示例)将按缓存命中率计费,这比 Flash 上的缓存未命中便宜大约 31 倍。其次,将您的批处理任务安排在非巅峰时段运行,无需修改任何代码即可将账单减半。第三,即使在巅峰时段,V4 Flash 的输出成本也仅为每百万 token $1.32;而对 GPT 级别旗舰模型的同等调用成本则是其数倍。
为了给大家一个具体的量化概念:一个聊天机器人在 Flash 上运行,每月处理 1000 万个输入 token(大部分已被缓存)和 200 万个输出 token,且在非巅峰时段运行,费用大约在 $1.50 左右。这虽然不是免费的,但也足够便宜,个人兴趣项目几乎感受不到负担。如果您正在这两个模型之间做选择,我们的 V4 Pro-0813 API 指南介绍了旗舰模型在何时值得您多付 3 倍的溢价。
免费与近乎免费的 API 途径
DeepSeek 官方平台不为新账号提供试用额度,因此一个真正免费的 API key 必须从其他地方获取。您实际可行的选择包括:
- OpenRouter 的免费模型池。 OpenRouter 免费提供 20 多个模型,且无需信用卡。但问题是:DeepSeek 的免费版本已在 2026 年中期被移出免费模型池,因此目前 OpenRouter 的 DeepSeek 列表是付费的,V4 Flash 的价格约为每百万输入 token $0.035 起。这仍然比许多第一方的费率更便宜,而且其他模型每天提供的 50 次免费请求可以让您在开始消费前完成链路的原型设计。
- 云端平台赠送额度。 云端服务商和推理托管平台提供的通用注册赠送额度(即您在创建账号时获得的额度)可用于消费托管的 DeepSeek 模型。这些模型本身并不是免费的,但您的赠送额度能让您在一段时间内免费使用它们。
- 在 DeepSeek 平台上进行极少额度的充值。 由于资费极低,充值 $2 余额就能使用很久。虽然这是近乎免费而非完全免费,但它是体验真实第一方 API 最简单的途径。
我们在《如何获取 DeepSeek 免费 API key》中提供并定期更新这些途径的汇总,包括目前有哪些聚合器列出了免费的版本。
零成本在本地运行 DeepSeek
这是真正意义上实现“免费”的途径。DeepSeek 在 Hugging Face 上以 MIT 许可证发布了其模型权重,允许商业使用、微调和重新分发。V4 代模型提供两种规格:V4 Flash(总共 284B parameter,其中 13B 为活动状态)和 V4 Pro,其完整权重于 2026 年 8 月结束预览阶段,包含约 1.7T parameter。
权衡的关键在于硬件。V4 Flash 在深度量化后需要大约 33 GB 的 VRAM(显存),或者在 FP8 精度下需要单张 80 GB 的 H100;而 V4 Pro 的完整权重接近 900 GB,这属于数据中心级别的部署需求。在普通台式机上,更切合实际的路线是使用较小的蒸馏模型或前代模型。我们关于如何通过 Ollama 在本地运行 DeepSeek R1 的指南可以让你在十分钟内无需 API Key 就在消费级硬件上运行推理模型并获得回答。
本地运行意味着没有按 token 的收费、没有频次限制,且数据不会离开你的机器。但这也意味着你需要自己负责运维:选择量化方案、搭建推理服务栈(对于生产环境,通常使用 vLLM 或 SGLang),以及承担 GPU 成本(除非你的请求量非常大,否则这笔费用可能会超过 API 的开销)。
网页端对话 vs API vs 本地运行:一文助你做出选择
- 选择网页端对话应用:如果你只是提问、起草内容或评估模型质量。成本:0 美元。难度:无。
- 选择 API:如果你正在构建产品或自动化工作流。成本:在个人兴趣项目规模下,每月仅需几美分到几美元。难度:低;由于该 API 与 OpenAI 兼容,因此大多数 SDK 只需更改前置 URL 即可直接使用。
- 选择本地权重:如果你需要数据隐私、离线使用,或者已经拥有 GPU。成本:使用费为 0 美元,但需要真金白银的硬件投入。难度:最高。
大多数开发者最终会选择 API,这就带来了一个实际的问题:如何在开发对接时不至于在每次测试运行中都消耗大量的 token?
测试一次调用,其余全部使用 Apifox 进行 mock
DeepSeek 的 API 遵循 OpenAI 格式,因此 Apifox 可以在几秒钟内完成导入:添加兼容 OpenAI 的规范,将前置 URL 指向 https://api.deepseek.com,将你的 API Key 放入环境变量中,然后发送请求。你可以在同一个视图中查看解析后的响应、响应时间以及流式传输的 token,这比眯起眼睛盯着 curl 的输出要高效得多。
节省成本的关键在于 Apifox 的 mock 功能。一旦获取了一次真实的 DeepSeek 响应,就可以启动一个 mock 服务端,在此后的每次前端和集成测试中重放逼真的补全结果。你的 CI、UI 状态、错误处理:所有这些都可以在 0 成本下针对 mock 进行测试,而真正的 API 只需处理少数几个用于验证真实模型行为的调用。在高峰期的开发阶段,当 DeepSeek 的费率翻倍时,这种严谨的测试习惯能帮你省下大笔开销,避免收到令人肉疼的账单。
常见问题解答
DeepSeek 对话是无限量的吗? DeepSeek 官方并未公布网页端对话应用的消息上限,因此在实际使用中,你受到的限制主要来自服务端容量,而非固定配额。在流量高峰期,可能会遇到“服务器繁忙”(Server busy)的响应。如果你频繁遇到此问题,我们在“如何免费使用 DeepSeek V4”中介绍了几种解决方法。
DeepSeek API 提供免费试用吗? 不提供。新注册的平台账户余额为零,且不赠送体验额度,因此你在发送首次请求前需要先进行充值。如果你想寻找近乎免费的替代方案,可以考虑使用聚合平台或云厂商提供的注册赠送额度。
DeepSeek 是开源的吗? 它的权重在 MIT 许可证下开源,这也是大多数人所理解的开源。由于训练数据和完整的 pipeline 并未公开,纯粹主义者将其称为“开源权重”而非开源。无论如何,自托管是免费的,且允许商用。
我能免费使用 DeepSeek 写代码吗? 可以,有两种方式:免费的聊天 App 可以处理临时的编码问题;另外,该公司的智能体 CLI 工具 DeepSeek Harness 可以运行在本地模型上,无需任何 API 成本。具体配置请参阅 DeepSeek Harness 介绍。
总结
对于评估(聊天)而言,DeepSeek 是免费的;对于构建(API,在非高峰期每次请求仅需极少分币)而言,它几乎是免费的;如果自备硬件,自托管则是完全免费的。先通过聊天 App 评估其质量,开始构建时迁移到 API,并尽可能通过 mock 所有内容来让您的 Token 账单保持在极低水平。下载 Apifox 导入 DeepSeek 的 API,验证一次真实调用,并免费 mock 其余内容。
开发必备:API 全流程管理神器 Apifox
介绍完上文的内容,我想额外介绍一个对开发者同样重要的效率工具 —— Apifox。作为一个集 API 文档、调试、设计、测试、Mock、自动化测试于一体的工具,Apifox 是目前提升研发效率的首选。
如果你正在开发项目,不妨试试其极其友好的界面设计,它完全兼容 Postman 和 Swagger 数据格式,导入数据非常方便,,即使是新手也能很快上手,点击这里即可注册使用。

值得一提的是,除了个人和常规团队使用,针对有高安全合规要求、或需要在内网环境协作的企业,Apifox 还提供了深度定制的私有化部署方案。
获取专属报价与部署方案
详细的私有化部署系统架构与安全白皮书
针对您公司规模的专属报价单
免费的 1v1 专属产品演示 (Demo) 机会