先对齐版本:8 月发生了什么
2026 年 8 月是国产模型密集换代的一个月,任何 7 月之前写的对比都需要重看:
| 厂商 | 8 月现状 | 定位 |
|---|---|---|
| DeepSeek | 8-13 发布 V4-Pro 正式版;V4 Flash 同期静默升级 | 高性价比推理与 API,MIT 开源,1M 上下文 |
| Kimi | 发布 K3(2.8T 参数,宣布月底开源);主力 K2.6 | 中文长文档,K3 多模态理解最强 |
| 豆包 | 旗舰 2.1 Pro,预算档 Seed-2.0 Mini | 大众中文助手,响应最快,内容生态 |
| 智谱 | 8-14 发布 GLM-5.3 | 编码与 Agent 场景 |
| OpenAI | 8-06 免费层默认换 GPT-5.6 Luna,无限文本对话 | 深度推理、多模态、Agent Mode |
国产各家的版本与定位信息来自公开报道与第三方评测(见文末来源),发布节奏很快,具体以各家官网为准。
为什么不该看榜单
8 月这波发布之后,多份编码向评测的结论是「国产模型已能与国际一线正面竞争」, 选型的关键不再是「哪个最强」,而是「你的使用模式匹配哪种定价和哪种长处」。 榜单差几个百分点,对你的日常任务几乎没有可感知差异;真正决定体验的是下面这七个场景。
七个场景逐个说
① 深度分析与复杂推理:ChatGPT
商业分析、竞品研究、多约束权衡这类需要长链推理的任务, 评测者的工作流里仍然把它交给 ChatGPT——Plus / Pro 可用的 Sol 加思考程度滑杆, 是目前对「想得深」控制最直接的入口。 DeepSeek 的推理不弱,但消费级体验(工具、文件、Agent)不如 ChatGPT 完整。
② 中文写作:Kimi、DeepSeek 在前
这是最反直觉的一条。有评测者给出的中文写作排序是 Kimi > DeepSeek > ChatGPT, 并称这个排序在长期使用中「非常稳定」。中文语感、成语用法、口语节奏,国产模型的训练语料优势是实打实的。 公众号长文、小红书文案、口播稿,先试国产。
③ 长中文文档:Kimi
把 PDF、长报告、会议材料、论文交给模型做提纲、问答和改写,Kimi 是国内最顺手的。 第三方测试里 K2.6 在 256K 以内的长文本召回几乎不衰减。 DeepSeek V4 虽有 1M 上下文,但官方提示「重 KV-cache 压缩可能损伤精确检索」,超过 200K 建议分段。
④ 日常问答与生活:豆包
免费、快、口语化、有内容生态——豆包的优势不是某个 benchmark,而是「随手就用」。 测试里它在多数场景响应最快,这是字节基础设施的红利。 不过要注意:ChatGPT 免费层 8 月 6 日之后也开放了无限文本对话, 纯聊天这一项两边差距已经不大,差的是访问门槛。
⑤ 编程:看你的成本结构
编码向评测把 Kimi K3 放在代码生成与终端操作的领先位置,DeepSeek V4-Pro 在业务流自动化上性价比极高, GLM-5.3 紧随其后。国际侧则是 Codex 与 Claude Code 的对决(见Codex vs Claude Code)。 API 价格在 8 月之后已经拉平:GPT-5.6 Luna 官方 $0.20 / $1.20,DeepSeek V4 Flash 第三方整理约 $0.28 输出——选型标准变成了「你的调用模式匹配哪种定价」,而不是谁便宜一个数量级。
⑥ 多模态:ChatGPT 独占生图与语音
图像生成(GPT Image 2)和语音对话是 ChatGPT 相对国产消费级产品最硬的差异之一; 图像理解方面 Kimi K3 被评为三家国产里最强。 生图额度与商用规则见 ChatGPT 图像生成完整指南。
⑦ 合规与数据:国产在境内有结构性优势
国产模型已完成生成式 AI 服务备案,面向境内用户的业务、处理境内数据,优先选它们是合规路径上的默认答案; ChatGPT 未在大陆提供服务,推理在境外处理,企业用于业务数据需评估数据出境义务。 个人短期用途可通过订阅代付解决支付,但它只解决「钱怎么付」,不解决合规—— 边界见 中国团队与 AI 大模型:合规路径盘点。
价格:网页免费、API 拉平
| 网页 / App | API(每百万 token) | |
|---|---|---|
| DeepSeek | 官方声明网页与正版 App 完全免费、无内购 | V4 Flash 输出约 $0.28(第三方整理;有涨价预告) |
| Kimi | 免费 + 付费会员档 | K2.6 约 $0.95 / $4(第三方整理) |
| 豆包 | 免费 + 付费会员档 | 2.1 Pro 输出约 ¥30,国产三家里最贵档(第三方整理) |
| ChatGPT | 免费层 Luna 无限文本;Plus $20;Pro $100 / $200 | Luna $0.20 / $1.20、Terra $2.00 / $12、Sol $5 / $30(官方) |
国产三家 API 价为第三方 2026-08-19 整理值;OpenAI 为 2026-07-30 官方降价后价格。各家调价频繁,以官方定价页为准。
把 ChatGPT 留在工作流里的两个理由
如果国产已经覆盖了你 80% 的场景,剩下 20% 值不值得单独付一份 ChatGPT?两个判断依据:
- 你有没有「错了代价很高」的任务。关键决策、对外交付、复杂推理——这些场景 ChatGPT 的深度分析仍然值回票价。
- 你需不需要它独占的能力。图像生成、语音、Agent Mode 自动执行,国产消费级产品目前给不了同等体验。
两条都不沾,留在国产就够;沾一条,Plus 是起点。 各档差别见 ChatGPT 套餐对比。
一句话总结
技术硬核选 DeepSeek,办公干活选 Kimi,生活娱乐选豆包,深度分析、生图和 Agent 留给 ChatGPT。多数人的终局是组合而不是二选一——DeepSeek 做默认,其他按场景补位。
本文国产模型部分依据公开报道与第三方评测整理(见来源),部分评测为个人博客与社区帖, 版本号与价格建议在使用前对照 DeepSeek、月之暗面、火山引擎官网核实。