deepseek ai – Guide
DeepSeek AI 是中国深度求索公司于 2023 年推出的开源大语言模型,主打低成本与强推理能力。其旗舰模型 R1 的 API 输入价格仅约每百万 token 0.14 美元,约为 OpenAI o1 的 1/30;V3 模型参数总量达 6710 亿,采用混合专家(MoE)架构,训练成本约 557 万美元,却能对标顶级闭源模型,2025 年 1 月引爆全球关注。

核心要点
- DeepSeek-R1 输入价约每百万 token 0.14 美元,仅 o1 的三十分之一。
- V3 通用型日常用,R1 推理型攻克数学代码难题。
- V3 采用 671B 参数 MoE 架构,每次只激活部分参数省算力。
- 主力模型训练成本约 557 万美元,冲击 AI 烧钱共识。
- MIT 开源可免费商用,权重可下载本地部署,数据不出内网。
关键速览
- DeepSeek-R1 的 API 输入价格约为每百万 token 0.14 美元,约为 OpenAI o1 的 1/30。
- 公司 2023 年成立,2025 年 1 月因 R1 模型登上全球关注焦点。
- V3 模型参数总量 6710 亿,采用混合专家(MoE)架构,每次推理只激活一小部分参数来降低运行成本。
- R1 在数学、代码推理测试上对标 OpenAI o1 系列表现。
- 模型采用 MIT 许可开源,可免费商用与本地部署。
DeepSeek AI 是什么?一句话看懂它的定位
DeepSeek AI 是成立于 2023 年、总部在浙江杭州、由梁文锋创办的深度求索公司开发的开源大语言模型。它靠约 557 万美元的训练成本,做出了对标顶级闭源模型的效果,在 2025 年初引爆全球关注。想低价用上强 AI,它是首选之一。
V3 和 R1 有什么区别?
V3 是通用型,R1 是推理型,两者分工不同。V3 负责日常对话、写作、翻译这类任务,采用 671B 参数的混合专家(MoE)架构,每次只激活一小部分参数,省算力又快。
R1 于 2025 年 1 月发布,是主打的推理模型。它会先”想一遍”再回答,适合数学题、代码调试、逻辑分析这类需要多步骤的活。选型建议:闲聊翻译用 V3,难题硬骨头交给 R1。
为什么它引起全球轰动?
关键在成本。行业里训练一个顶级模型动辄几千万甚至上亿美元,DeepSeek 却把主力模型的训练成本压到 557 万美元左右。这个数字一出,直接冲击了”AI 必须烧大钱”的共识,连英伟达股价当天都受波及。成本之外,更狠的是它采用 MIT 等开源许可、公开模型权重(open-weight),任何人都能下载、部署、二次开发,不用付授权费。低成本加开源,这两点叠加,让 deepseek ai 成为开发者和中小企业的低成本替代方案。

DeepSeek 怎么用?网页版、App、API、开源模型四条路径怎么选
DeepSeek AI 有四条上手路径:网页版、手机 App、开发者 API 和本地部署。官方产品入口deepseek-app.org 想快速试用选网页版,想搭产品选 API,想数据不出内网就下载开源权重本地跑。
普通用户:网页版和 App 怎么用?
打开 deepseek-app.org 就能对话,注册后可保存历史记录。手机端在 Google Play 搜索官方 DeepSeek 应用(开发者为杭州深度求索),iOS 在 App Store 同名下载。这条路免费、零门槛,适合写作、翻译、问答。
开发者:API 和本地部署怎么选?
要接进自己的软件,去 deepseek-app.org 申请 API Key,按调用量(token)计费,适合做客服机器人或批量处理。对数据合规要求高的团队,可在 HuggingFace 下载 MIT 开源许可的模型权重,671B 参数的 V3 需多张高显存显卡,自建服务器运行,数据完全留在本地。

DeepSeek 免费吗?网页版、App 与付费 API 的成本对比
网页版和手机 App 完全免费。DeepSeek 在 2025 年推出的官方聊天产品,被多家媒体称为免费 AI 聊天机器人。普通用户无需付费即可对话、写代码、做推理。只有调用 API(应用程序接口,让程序自动调用模型的通道)才收费。
免费版和付费 API 差在哪?
免费版够日常聊天;API 适合把 DeepSeek AI 接进你自己的产品。核心差异在两点:免费版靠人手动对话且有限流,API 能让程序自动、批量、高并发地调用。
| 维度 | 网页版 / App(免费) | 付费 API |
|---|---|---|
| 费用 | 0 元 | 按 token 计费 |
| 使用方式 | 手动对话 | 程序自动调用 |
| 调用量 | 有限流限制 | 可批量高并发 |
| 适合人群 | 普通用户 | 开发者、企业 |
API 一个月要花多少钱?
token 是模型处理文字的基本单位,约等于 0.75 个英文词。以每百万 token 输入 0.14 美元、输出 0.28 美元估算:若每月 100 万次调用,每次平均输入 500、输出 500 token,总量各约 5 亿 token,月费约 210 美元。deepseek 的建议是:先用免费版验证需求,确定要自动化再上 API。

DeepSeek 和 ChatGPT、Gemini、Claude 比,哪个更好?
没有绝对赢家,选谁看你要什么。2025 年 1 月发布的 DeepSeek-R1,在数学和代码基准上接近 OpenAI 的 o1,但 API 价格仅约其 1/30。想省钱做推理和写代码,选 DeepSeek;想要更稳的多轮对话和创意写作,ChatGPT、Claude 更强。
💡 反直觉: 顶级大模型不一定要烧上亿美元。DeepSeek V3 训练成本仅约 557 万美元,却对标 OpenAI o1,R1 的 API 输入价约每百万 token 0.14 美元,仅为 o1 的三十分之一,2025 年 1 月一度波及英伟达股价。
| 维度 | DeepSeek R1 | ChatGPT (o1) | Gemini | Claude |
|---|---|---|---|---|
| 中文能力 | 很强 | 强 | 较强 | 较强 |
| 代码生成 | 接近 o1 | 顶级 | 强 | 顶级 |
| 数学推理 | 接近 o1 | 顶级 | 强 | 强 |
| 价格(相对) | 约 o1 的 1/30 | 高 | 中 | 高 |
一句话落地:重逻辑、预算紧,首选 R1;要长文创意和自然多轮聊天,补一个闭源模型。两者不是二选一,常见做法是把便宜的 R1 用在推理和代码上,再拿闭源模型顶创意写作。

DeepSeek 数据安全吗?数据存储与多国禁用情况说明
DeepSeek 官方服务把用户数据存储在中国境内,这是隐私争议的核心。开发商深度求索总部位于浙江杭州,受中国数据法律管辖。2025 年起,意大利数据保护局、台湾及美国多个政府机构陆续禁止公务设备使用其 App。想规避风险,别用官方云端版。
降低风险的实操办法有两条:
- 本地部署开源版:DeepSeek 模型是 open-weight(权重公开可下载),自己在服务器跑,数据不出内网。
- 用第三方托管 API:选海外合规服务商代理调用,数据存在境外机房。
普通用户闲聊无妨;企业处理敏感数据,优先本地开源部署。
新手用 DeepSeek 最常踩的三个坑
新手用 DeepSeek AI 最常犯三个错:把通用模型 V3 当推理模型用、API 不开缓存导致成本翻倍、遇到敏感话题就放弃。这三个坑都能靠调整设置或提示词避开。下面逐个拆解。
为什么不能拿 V3 当推理模型用?
因为 V3 和 R1 分工不同。DeepSeek-V3 是 671B 参数的通用大模型,擅长对话和写作,但复杂数学、逻辑推理该用 2025 年 1 月发布的 R1。反过来,简单问答别用 R1,它会输出大段”思考过程”,拖慢速度还多花钱。分清任务再选模型。
API 成本为什么会翻倍?
没开上下文缓存(context caching,把重复的输入内容存起来复用)。同一段长提示词反复调用时,命中缓存的部分只按更低单价计费,能省下大笔重复输入费用。批量调用前,先确认缓存已开启。
遇到内容限制怎么办?
官方云端版对部分敏感话题有过滤。真正需要无限制推理时,走本地部署开源权重模型这条路,而不是硬碰官方接口。

三类人群分别该走哪条路?
| 人群 | 推荐路径 | 关键理由 |
|---|---|---|
| 尝鲜用户 | 网页版 deepseek-app.org | 零成本、免安装、开箱即用 |
| 开发者 | 官方 API | 推理价约同类 1/30,可编程调用 |
| 注重隐私的企业 | 本地部署 671B open-weight 模型 | 数据不出内网,规避境内存储争议 |
企业别直接用官方云端版。DeepSeek 的 open-weight(权重公开)模型能下载到自建服务器跑,这样用户数据就不经过杭州的服务器,合规部门也好过关。
收尾行动:今天就打开网页版聊十分钟。觉得答案够用,再让工程师接 API 做自动化;涉及敏感数据,才上本地部署。DeepSeek AI 的门槛就是这么低,不用一次押注最重的方案。




