LLM对比

简约无双

[toc]

现在大家对LLM的使用越来越频繁,但市面上多如牛毛的LLM又让人眼花缭乱,未经选择就随意使用LLM很容易花很多冤枉钱,最终还事倍功半。这篇文章通过介绍一些主流LLM来帮助大家选择合适的LLM。

模型总览

11 款大模型阵营与定位总览 海外 5 款(ChatGPT、Gemini、Grok、Claude、Perplexity)需特殊网络;国内 6 款(豆包、Kimi、通义千问、文心一言、DeepSeek、智谱GLM)可直连,每款标注核心定位。 海外 5 款 · 需特殊网络 ChatGPT 全能主力 · 编程 · 语音 Gemini 多模态 · 视频 · 超大上下文 Grok X 实时社交数据流 Claude 长文档 · 低幻觉 · 严谨 Perplexity AI 搜索 · 强制引用溯源 国内 6 款 · 直连可用 豆包 中文自然 · 语音 · 日常 Kimi 超长文档 · 批量 PDF 通义千问 开源生态 · 企业部署 文心一言 公文 · 国内实时搜索 DeepSeek 代码 · 数学 · 硬核推理 智谱 GLM Agent · 前端 · 二次开发
  • ChatGPT — 综合全能 + 生态最强的通用主力助手
  • Gemini — 多模态天花板,原生支持图/音/视频
  • Grok — 独家 X 平台实时社交数据流
  • Claude — 长文档王者,幻觉最低,输出严谨
  • Perplexity — AI 原生搜索引擎,强制引用溯源
  • 豆包 — 中文最自然、语音体验国内第一
  • Kimi — 国内超长文档解析王者
  • 通义千问 — 能力均衡 + 开源生态最强,企业友好
  • 文心一言 — 百度搜索联动,公文时政见长
  • DeepSeek — 国产代码 / 数学 / 推理天花板,开源可本地部署
  • 智谱 GLM — Agent 工具调用与前端代码见长,适合二次开发

海外大模型

国内均不能直接访问,需特殊网络。

ChatGPT(OpenAI)

版本:GPT-4o / GPT-5

优势

  1. 综合能力最均衡,编程、逻辑推理、创意写作整体很强;生态最完善,第三方插件、自定义 GPT 最多。
  2. 语音对话体验成熟,图片理解、复杂任务拆解稳定。
  3. 开发者生态繁荣,大量软件、工具都接入 GPT 接口。
  4. 通用任务与第三方工具集成能力最强,语音对话自然。

短板

  • 训练数据有截止时间,联网搜索能力一般;
  • 安全过滤严格,回答偏保守;
  • 长上下文弱于 Gemini;长文档处理成本高。

适合:写代码、方案策划、创意创作、日常主力 AI 助手、通用任务、语音对话、各类第三方工具集成。

Gemini(Google)

优势

  1. 多模态最强:原生支持图片、音频、长视频理解,可以直接解析 YouTube 视频内容。
  2. 超大上下文窗口,可以一次性读几十份 PDF、整本书、大量文档,资料汇总分析能力很强。
  3. 与谷歌全家桶打通:Gmail、Google 文档、Google 搜索,联网搜索质量优秀。
  4. 免费版能力很强,Flash 版本日常使用够用。

短板

  • 复杂底层代码调试略逊 ChatGPT;
  • 部分场景回答偏啰嗦;
  • 复杂推理偶尔不稳定。

适合:读长文档 PDF、视频总结、资料调研、谷歌生态用户、解析视频/图片/图表/YouTube 内容。

Grok(xAI)

阵营:马斯克 xAI,绑定 X(原 Twitter)社交平台

优势

  1. 独家能力:直接读取 X 实时数据流 —— 全网热点、社交舆论、最新事件,这是另外两者没有的能力。
  2. 回答风格更随性幽默,内容过滤更少,说话更大胆;响应速度快。
  3. 订阅便宜:买 X 会员就附带 Grok 权限,也有独立网页 grok.com。

短板

  • 中文能力弱于另外两个大模型;
  • 严谨推理、深度代码、长文档处理不如 GPT / Gemini;
  • 事实幻觉概率相对更高。

适合:看实时热点、社交舆情、时事吃瓜、轻松闲聊。

Claude(Anthropic)

定位:主打低幻觉、长文档

产品三档

  1. Opus — 旗舰,最强推理,复杂任务;
  2. Sonnet — 绝大多数人首选,性能、速度、成本平衡;
  3. Haiku — 极速轻量,适合简单批量任务。

优势

  1. 长文本处理极强、幻觉最低 —— 读几十份 PDF、整本书、合同、代码库,信息丢失少,事实错误更少;法律、论文、文档整理非常稳。
  2. 代码工程能力很强,读完整项目代码、重构、Debug 表现优秀。
  3. 输出严谨克制,格式输出稳定,适合做 Agent 自动化任务。
  4. 中文质量优秀,长段中文材料理解到位。

短板

  1. 多模态最弱:几乎没有视频理解,图片能力够用但不如 Gemini / ChatGPT;没有 AI 画图
  2. 没有原生语音对话。
  3. 联网能力普通,没有独家实时数据源。
  4. 生态插件少于 ChatGPT。

适合:合同审阅、论文文献、批量 PDF 分析、阅读大段代码库、严谨书面写作、对事实准确度要求高的工作。

Perplexity

定位AI 原生搜索引擎,主打实时联网 + 可点击引用来源,不是通用聊天大模型。底层可调用 GPT、Claude、Gemini,核心能力是网页检索、资料汇总、每条答案带溯源链接,专门解决”查最新资料、写综述、事实核查”,减少 AI 幻觉。

核心优势

  1. 强制引用来源 —— 每一条事实后面附带可点击网页链接,可直接点开原文核对,写报告、做调研、查新闻非常实用,这是它最大卖点。
  2. 默认全网实时搜索,不用手动开启联网;Deep Research 深度研究模式,自动做多轮搜索,整理复杂问题、行业综述、调研报告。
  3. 内置多种专项模式:学术模式(优先抓取论文库)、Reddit 模式(看网友观点)、YouTube 模式(总结视频内容)、Wolfram(数学计算)。
  4. Pro 版可手动切换底层模型:GPT-5、Claude、Gemini,用不同模型交叉验证答案,降低出错概率。

短板

  1. 创意写作、复杂代码生成能力偏弱 —— 适合整理资料,不适合从零写大型项目代码、文学创作。
  2. 多轮长对话容易遗忘上下文,不适合长时间持续深度对话。
  3. PDF 解析能力不如 Claude;没有强大的原生语音对话。

适合:写文献综述、市场调研、时事事实核查、查最新行业数据、学生写论文找素材、记者核实信息。

国内大模型

全部国内直连;中文、本土常识、公文、国内网络搜索是国产模型最大优势;硬核前沿推理、英文全球知识库整体弱于海外旗舰。

豆包(字节跳动)

优势

  • 中文口语感、交互、语音体验国内第一,网感好,输出自然,几乎没有翻译腔。
  • 响应速度快,图片理解、AI 绘图、联网搜索全部内置;日常文案、短视频脚本、口语对话、学习答疑体验优秀。
  • 免费额度充足,APP、网页、小程序全覆盖,上手门槛最低

短板

  • 极限硬核数学、超复杂底层代码、超长百万字文档精读不如 Kimi、DeepSeek。
  • 高难度专业科研任务容易出现幻觉,重要资料建议二次核对。

适合:日常问答、写文案、口语练习、图片解读、轻办公、随手提问、普通学生。

Kimi(月之暗面)

优势

  • 长文档国内天花板 —— 一次性读几十万 ~ 200 万字材料,批量 PDF、合同、财报、整本书拆解能力极强。
  • 输出严谨理性,适合学术阅读、文献整理;网页插件可以直接总结网页。

短板

  • 文风偏严肃,写活泼营销文案、短视频脚本效果一般;
  • 普通闲聊体验不如豆包;
  • 复杂数学推理一般。

适合:读大量 PDF、论文、合同审阅、财报、长篇资料整理。

通义千问(阿里云)

优势

  • 综合全能,开源生态最强 —— 写代码、画图、多模态、智能体 Agent 能力全面;支持私有化部署,企业场景很强。
  • 和钉钉、阿里生态打通;免费版能力够用,API 成本很低。

短板

  • 回答语气偏正式,缺少网感;
  • 部分深度问题会泛泛而谈,挖掘不够深入。

适合:办公、代码、企业场景、多任务处理,阿里生态用户,私有化部署。

文心一言(百度)

优势

  • 背靠百度搜索,国内实时中文搜索能力强
  • 公文、时政、国内本土知识理解到位。

短板

  • 创意和灵活度偏弱;
  • 产品迭代节奏偏保守。

适合:公文写作、时事资讯查询、正式书面文稿。

DeepSeek(深度求索)

定位:国内主打数学、代码、逻辑推理的模型,开发者圈热度极高;大量模型开源可本地部署、私有化调用,国内可直连访问。

两大核心版本

  • V4:通用主力,速度快,兼顾日常、代码、分析。
  • R1:深度思考模式,强化多步逻辑、奥数、算法难题,思考时间更长,推理能力国产第一梯队

核心优势

  1. 代码、数学、硬核逻辑推理国产顶尖 —— 底层 C/C++、嵌入式、算法刷题、复杂数学推导表现突出,边界条件考虑周全,很多开发者用来做算法、工程调试。
  2. 大量模型开源,支持本地部署、二次微调,API 调用价格低廉,中小企业、学生做项目成本很低。
  3. R1 深度思考模式会把推导步骤完整输出,解复杂数学、逻辑题思路清晰。
  4. 长上下文能力强,可以读取完整代码仓库,做代码审查、项目解析。

短板

  1. 闲聊、文案、短视频创作网感弱,文风偏理工直男,写感性、活泼的内容不如豆包。
  2. 多模态(图片、画图)能力一般,没有原生语音对话
  3. 中文日常对话的流畅自然度弱于豆包;复杂创意输出容易偏干。
  4. 虽然支持联网,但搜索整合能力不如文心一言、Perplexity。

适合人群:程序员、理工科学生、算法刷题、数学推导、代码审查、科研辅助、需要本地私有化部署的开发者。

智谱清言GLM

背景:智谱清言是智谱 AI(源自清华大学)面向普通用户的产品,底层是 GLM-4 / GLM-5 系列基座,大量权重开源,非常适合做 Agent 智能体、API 二次开发、私有化部署。

核心优势

  1. Agent 工具调用是强项 —— 函数调用、多工具联动表现优秀,很适合搭建自动化智能体、工作流;开发者生态成熟,大量开源项目基于 GLM 做二次开发。
  2. 前端代码表现亮眼 —— 网页、JS、TS、UI 页面生成质量高;开源权重多,普通显卡就可以本地跑模型,企业私有化部署方案完善。
  3. 多语言翻译强,小语种支持不错;内置 AI 绘图、PPT 生成,功能套件齐全。
  4. 长上下文窗口最高 200K,文档处理够用;国内合规备案,网页端免费额度充足。

短板

  1. 硬核数学、底层算法、C/C++ 深度调试弱于 DeepSeek,高难度数理推导容易出错。
  2. 日常闲聊网感一般,写轻松活泼的文案不如豆包。
  3. 超长百万级文档能力不如 Kimi。
  4. 原生视频理解能力普通。

适合:开发者做 Agent、前端开发、多语言翻译、企业私有化部署、搭建自有 AI 应用;学生做二次实验。

横向对比总结

模型 阵营 核心亮点 主要短板 最佳场景
ChatGPT 海外 综合全能,编程强,生态插件多,语音对话优秀,第三方工具集成最强 长文档成本高,回答偏保守,联网搜索一般 通用干活、写代码、创意创作、语音对话、第三方工具集成
Gemini 海外 多模态天花板,原生支持视频/音频解析,超大上下文,谷歌全家桶打通,免费版很强 复杂推理偶尔不稳定,复杂底层代码调试略逊 解析视频/图片/图表、YouTube 内容,大量资料调研,谷歌生态用户
Grok 海外 可直接读取 X 实时社交数据流;风格大胆幽默,响应快 中文弱,幻觉偏高,严谨推理与长文档一般 实时网络热点、社交舆论、时事吃瓜、轻松闲聊
Claude 海外 长文档王者,幻觉最低,文本严谨,工程代码强,输出格式稳定 视频/画图弱,无原生语音,联网能力普通,插件少于 GPT 批量 PDF、合同审阅、论文、完整代码库阅读、严谨书面工作、Agent 自动化
Perplexity 海外 AI 搜索之王,强制引用溯源,深度联网调研,可切换底层模型交叉验证 创意写作与深度代码弱,长对话退化,PDF 解析不如 Claude 查最新资料、文献综述、事实核查、调研报告、找素材
豆包 国内 中文自然流畅,语音体验国内第一,响应快,多模态完整,上手门槛最低 极限推理、硬核算法、超长百万字文档偏弱 日常聊天、文案脚本、口语练习、图片理解、轻办公、学生日常
Kimi 国内 超长文档国内天花板,批量 PDF/财报/论文解析强,输出严谨 闲聊创意弱,推理中等,复杂数学一般,文风偏严肃 大批量长文档、合同审阅、财报、资料汇总
通义千问 国内 能力均衡全面,开源生态强,Agent 全面,钉钉/阿里生态打通,企业友好 文风偏正式,缺少网感,深度问题易泛泛而谈 办公、代码、企业场景、私有化部署
文心一言 国内 百度搜索联动强,国内实时中文搜索,公文时政理解到位 创意灵活度一般,迭代节奏保守 公文写作、国内时事资讯查询
DeepSeek 国内 代码/数学/逻辑推理国产天花板,开源友好,R1 完整输出推导,可私有化部署 闲聊文案差,无原生语音,多模态一般,联网整合弱 算法刷题、底层代码调试、数学推导、科研、本地部署
智谱 GLM 国内 Agent/工具调用强,前端代码优秀,开源丰富,多语言翻译强,适合二次开发 硬核数理推理弱于 DeepSeek,闲聊网感一般,超长文档不如 Kimi,视频理解普通 开发智能体、前端项目、多语言翻译、私有化部署、AI 二次开发

计费规则与价格

由于大模型价格变化很快,故于此单列一章。以下数据整理于2026年8月30日,仅供参考,一切以官方实时价格为准。

海外大模型

ChatGPT(OpenAI)

订阅

档位 价格 说明
Free $0 有限额度,滚动窗口限制
Go $8/月 广告支持版,按地区逐步开放,无高级功能
Plus $20/月 扩展 GPT-5.x 访问、智能体、Deep Research 配额
Pro $100/月(5× Plus)/$200/月(20× Plus) Pro 档于 2026-04-09 拆成两档;含更高 Codex 额度
Business(Team) $20/用户/月(年付)/$25(月付) 2 席起,SSO、不用于训练
Enterprise 面议 合规、数据保留、协商用量
  • 关键提示:用量上限不是月度配额,而是按 3–5 小时滚动窗口重置(不同档位/模型不同),部分功能另有周/月配额,且 OpenAI 声明该数值会随需求与系统状况浮动。

API 单价(每百万 token)

模型 输入 缓存输入 输出 长上下文
gpt-5.6-sol(旗舰) $4.00 $0.40 $20.00 $8.00 / $30.00
gpt-5.6-terra(均衡) $2.00 $0.20 $12.00 $4.00 / $18.00
gpt-5.6-luna(轻量) $0.20 $0.02 $1.20 $0.40 / $1.80
  • 调价历史:7 月 30 日 Luna 降价 80%($1/$6 → $0.20/$1.20)、Terra 降价 20%($2.50/$15 → $2/$12);8 月 21 日 Sol 从 $5/$30 降至 $4/$20,官方标注为促销价,至少持续到 2026-11-21
  • 折扣与加价:Batch API 5 折;缓存命中约为输入价 10%,缓存写入按未缓存输入价 1.25×;Fast(优先)模式 ;长上下文 ;区域数据驻留 1.1×
  • 附加计费:Web search $10/千次调用;file search $2.50/千次 + $0.10/GB-天存储。
  • 企业用户常通过 Azure OpenAI 采购(Provisioned Throughput Units 预留,1 个月至 3 年期),账单走 Azure,价目单不同。

Gemini(Google)

订阅

档位 价格 上下文 说明
免费(AI Studio) $0 随模型 仅 Flash 模型,5–15 RPM,数据用于改进产品
Google AI Plus $7.99/月 1M Flash + 部分 Pro 功能
Google AI Pro $19.99/月 1M 完整 Gemini 3.1 Pro 访问
Google AI Ultra $99.99/月(原 $249.99) 1M+ 5× Pro 额度 + 20TB 存储;另有 $200/月 档(20× Pro 额度)
Workspace 内嵌 约 $7–22/用户/月 另有 Gemini for Workspace 加购约 $20/用户/月

API 单价(每百万 token)

模型 输入 输出 上下文
Gemini 3.1 Pro Preview $2.00 $12.00 2M(>200K 提示词:$4.00 / $18.00)
Gemini 3.5 Flash $1.50 $9.00 1M(2026-05-19 上线,最佳编码/Agent 模型)
Gemini 3 Flash Preview $0.50 $3.00 1M
Gemini 3.1 Flash-Lite $0.25 $1.50 1M
Gemini 2.5 Pro $1.25 $10.00 1M(>200K:$2.50 / $15.00)
Gemini 2.5 Flash-Lite $0.10 $0.40 1M(最便宜)
  • 弃用提醒:Gemini 2.0 Flash 已于 2026-06-01 关停;Gemini 2.5 Flash($0.30/$2.50)计划 2026-10-16 弃用,建议迁移至 3 Flash Preview 或 3.1 Flash-Lite。
  • 思考 token 按输出计费 —— 这是 Gemini 账单最容易失控的地方,深度推理任务的隐藏成本可能远超预期。
  • 免费档(AI Studio)无需信用卡;Batch 约 5 折;付费账户可设月度消费上限($250 / $2,000 / $100,000 三档)。
  • 不同来源价差较大:部分第三方站点仍在引用 2.5 系列旧价(如 2.5 Flash $0.15/$0.60),与 3.x 系列不可混用。

Grok(xAI)

订阅

档位 价格 说明
Free $0 Grok 4 Mini(仅文本),独立 Chat/Voice 额度
X Premium $8/月 X 平台内使用 Grok,额度高于免费档
SuperGrok Lite $10/月 2026-03-25 上线,含 Imagine(480p/6s)与 1 个 AI 智能体
SuperGrok $30/月(年付 $300,约合 $25/月) 完整 Grok,DeepSearch、Voice、Imagine
X Premium+ $40/月 Grok + X 平台权益,适合重度 X 用户
SuperGrok Plus $100/月 新增档位,高峰优先访问
SuperGrok Heavy $300/月 唯一含完整 Grok 4.5 + Grok 4 Heavy 多智能体
Grok Business $30/用户/月 企业
  • 计费机制:自 2026 年 6 月起,所有付费档改为单一共享周额度池,可跨 Chat / Imagine / Voice / Build 使用,取代了此前”每 2 小时 N 次提示”的限额。

API 单价(每百万 token)

模型 输入 缓存输入 输出 上下文
Grok 4.6 $2.00 $0.30 $6.00 500K
Grok 4.5 $2.00 $0.30 $6.00 500K
Grok 4.3 $1.25 $0.20 $2.50 1M
Grok 4.20 $1.25 $0.20 $2.50 2M
grok-build-0.1 $1.00 $0.20 $2.00 256K
Grok 4 Heavy 仅随 SuperGrok Heavy 档位
  • 退役提醒:Grok 4.1 Fast、Grok 4、Grok 3 已于 2026-05-15 退役,旧调用会静默按 Grok 4.3 费率计费 —— 这是最贵的坑之一。
  • Grok 4.5/4.6 超过 200K token 的请求按更高上下文费率计费。
  • Batch API:文本/推理降 20%–50%(随负载浮动,不同于 OpenAI 的固定 5 折)。
  • Grok Imagine:图片 $0.02/张(1K/2K 标准)、高质量 $0.05(1K)/$0.07(2K);视频 $0.05/秒(480p)、$0.07/秒(720p),1.5 preview 为 $0.08/$0.14 每秒。
  • Grok Voice:实时语音 $0.05/分钟;TTS $15/百万字符;STT REST $0.10/小时、Streaming $0.20/小时。
  • 违反使用政策的请求仍然计费 —— Responses API 调用若在开始生成前被拦截,仍收 $0.05/次。

Claude(Anthropic)

订阅

档位 价格 说明
Free $0 Sonnet 5 为默认模型,每日上限
Pro $20/月(年付 $200,约 $16.67/月) 约 5× Free 用量,含 Claude Code、Cowork、Design、Science、无限 Projects、Research、Claude for Microsoft 365
Max 5× $100/月 5× Pro 用量,仅月付
Max 20× $200/月 20× Pro 用量,最高优先级,适合长时间 Claude Code 会话
Team Standard $25/月付 或 $20/用户/月(年付),2 席起 共享工作区、集中计费、管理后台
Team Premium $125/月付 或 $100/用户/月(年付) 含 Claude Code,5× Standard 用量
Enterprise $20/席/月 + 按 API 费率计用量(年付) SSO、SCIM、审计日志、自定义数据保留

API 单价(每百万 token)

模型 基础输入 缓存写 5m 缓存写 1h 缓存命中 输出
Claude Fable 5 $10 $12.50 $20 $1 $50
Claude Mythos 5(限量) $10 $12.50 $20 $1 $50
Claude Opus 5 / 4.8 / 4.7 / 4.6 / 4.5 $5 $6.25 $10 $0.50 $25
Claude Sonnet 5 $2 $2.50 $4 $0.20 $10
Claude Sonnet 4.6 / 4.5 $3 $3.75 $6 $0.30 $15
Claude Haiku 4.5 $1 $1.25 $2 $0.10 $5
Claude Haiku 3.5(已退役) $0.80 $1 $1.60 $0.08 $4
Claude Opus 4.1 / 4(已退役) $15 $18.75 $30 $1.50 $75
  • Sonnet 5 价格已固化:$2/$10 原为 2026-08-31 前的推广价,官方已宣布转为标准价,原定 9 月 1 日涨至 $3/$15 的计划取消。
  • Batch 5 折;缓存命中为输入价的 10%
  • 长上下文不加价:Opus 4.8 / 4.7、Sonnet 4.6 支持 1M 上下文且无附加费;Sonnet 4.5 超过 200K 有附加费。
  • Fast mode(Opus 4.8): 标准价($10/$50),最高 2.5× 速度 —— 相比此前 Opus 4.7 的 $30/$150 已大幅下降。
  • 美国境内推理:1.1×。
  • 附加计费:Web search $10/千次搜索;Code execution 每组织每天 50 小时免费,超出 $0.05/容器小时;Managed Agents $0.08/会话小时(活跃运行时)。
  • 分词器陷阱:Claude 4.7 及之后(含 Mythos Preview)换用新分词器,同一段文本约多产生 30%的 token。单价不变,但从 4.6 迁移过来的实际每请求成本可能上升三成;4.7 → 4.8 无此损耗,属配置级切换。

Perplexity

订阅

档位 价格 核心权益
Free $0 无限基础搜索(带引用),约 3–5 次/天 Pro Search,无 Deep Research / Labs,模型自动分配
Pro $20/月 或 $200/年(≈$16.67/月) 无限 Pro Search、约 20 次/天 Deep Research、50 次/月 Labs、3 个视频/月、模型选择器(GPT-5.x / Claude Opus / Gemini)、含 $5/月 Sonar API 额度、含 Comet Plus
Max $200/月 或 $2,000/年(≈$167/月) 无限 Labs、Perplexity Computer(10,000 credits/月,编排 19 个模型)、Model Council、Sora 2 Pro 视频、前沿模型优先访问
Education Pro $10/月(SheerID 学生认证) Pro 权益 + Study Mode
Enterprise Pro $40/席/月($400/年) 约 500 次/天 Deep Research、SSO、SOC 2 Type II
Enterprise Max $325/席/月($3,250/年) 无限 Deep Research + Labs、SCIM、审计日志
  • Comet 浏览器自 2025 年 10 月起全球免费;Comet Plus(优质出版商内容)$5/月。
  • 选型提示:Pro 与 Max 共用同一答案引擎与同样的前沿模型,$180 的差价买的是自主智能体 Computer 与无限 Labs,不是更好的搜索。

Sonar API(每百万 token)

模型 输入 输出
sonar(基础) $1 $1
sonar-pro $3 $15
sonar-deep-research $2 $8
  • Perplexity 的 API 有五层计费,只看 token 价会严重低估成本:
    1. token 费
    2. 每次请求的搜索上下文费
    3. sonar-deep-research 额外计引用 token + 推理 token + 每次搜索费
    4. 图像/视频生成另计
    5. 超出套餐额度的 Computer credits

国内大模型

豆包(字节跳动)

C 端

档位 价格
免费版 $0,基础功能永久免费
豆包专业版 标准 ¥68/月、加强 ¥200/月、高级 ¥500/月
专业版年费 标准 ¥688 / 加强 ¥2,048 / 高级 ¥5,088
大学生认证 标准套餐连续包月 ¥38(原价 ¥68)
方舟 Coding Plan Lite 首月 ¥8.9、¥40/月(¥120/季);Pro 首月 ¥49.9、¥200/月(¥600/季)

API 单价(元/百万 token)

模型 输入长度 输入 缓存命中 输出
doubao-seed-2.0-pro(旗舰,256K 上下文) ≤32K ¥3.2 ¥0.64 ¥16
doubao-seed-2.0-pro 低延迟(Fast) ≤32K ¥9.6 ¥1.92 ¥48
doubao-seed-2.1-pro ¥6 ¥1.2 ¥30
doubao-seed-2.1-turbo ≤256K ¥6 ¥1.2 ¥30
doubao-seed-2.0-lite ≤32K / 32–128K / 128–256K ¥1.2 / ¥1.8 / ¥3.6 ¥0.24 / ¥0.36 / ¥0.72 ¥7.2 / ¥10.8 / ¥21.6
doubao-seed-2.0-mini ≤32K / 32–128K / 128–256K ¥0.4 / ¥0.8 / ¥1.6 ¥0.08 / ¥0.16 / ¥0.32 ¥4.0 / ¥8.0 / ¥16.0
  • 分段计价:豆包按单次请求输入长度分档,长输入单价显著上升。
  • 批量推理约为在线推理 5 折;音频输入单独计价。
  • 缓存存储另计:约 ¥0.017/百万 token/小时。
  • 免费额度:火山方舟新用户每日可领单模型最高 500 万 tokens 免费额度;2026 Q1 起已取消无限免费调用。Managed Agents 首次开通赠 30 小时 Agent 运行时 + 500 次 web_search。

Kimi(月之暗面)

C 端会员

档位 月付 年付折算 Agent 并行 K3 超长对话
Adagio 免费 免费 1 个任务
Andante ¥49/月 ¥39/月 1 个任务
Moderato ¥99/月 ¥79/月 2 个任务
Allegretto ¥199/月 ¥159/月 2 个任务
Allegro ¥699/月 ¥559/月 4 个任务 ✓(100 万 token)
  • 关键避坑:K3 模型需 Moderato 及以上档位;只有 Allegro 解锁 K3 的百万 token 超长对话容量;Andante 档无法体验百万上下文。
  • 2026-07-19 K3 发布后因算力紧张曾暂停 C 端新用户订阅;会员体系仍在调整(。
  • 订阅用户可通过 API Key 接入 Claude Code / Roo Code 等工具(兼容 Anthropic 协议)。

API 单价(元/百万 token)

模型 输入(缓存命中) 输入(缓存未命中) 输出 上下文
kimi-k3 ¥2 ¥20 ¥100 1,048,576(约 1M)
  • 缓存自动生效,无需手动配置;命中率在编程场景可超 90%,实际输入成本降至 1/10
  • 批量推理约 6 折;文件抽取/存储接口限时免费(仅上传抽取不计费,但抽取内容作为输入时会计费)。
  • 限时充值活动:单笔 ¥99 起,阶梯赠券 10%–30%。
  • K3 涨价明显:相比 K2.6(输入 ¥6.5 / 输出 ¥27),K3 输入涨超 3 倍、输出涨超 3.5 倍,输出单价 ¥100/百万是国产模型中最贵的,约为 DeepSeek V4-Pro 的 7–22 倍。

通义千问(阿里云百炼)

C 端 / 订阅

档位 价格
通义 APP 基础功能免费
百炼 Coding Plan Lite 首月 ¥7.9、¥40/月;Pro 首月 ¥39、¥200/月
百炼个人版 Token Plan Lite ¥39 / Standard ¥139 / Pro ¥499(限时价)
百炼团队版 标准 ¥150 / 高级 ¥550 / 尊享 ¥1,398 元/坐席/月,可聚合 MiniMax、智谱 GLM、Kimi 等多家模型,无 5 小时/7 天窗口限制

API 单价

国际站(美元/百万 token):

模型 输入长度 输入 输出
qwen3.7-plus ≤256K $0.276 $1.101
qwen3.7-plus 256K–1M $0.826 $3.301
qwen3.6-plus ≤256K $0.276 $1.651
qwen3.6-plus 256K–1M $1.101 $6.602

国内站(元/百万 token):

模型 输入 输出
qwen3.8-max / qwen3.7-max(国内) ¥14.4 ¥43.2
qwen3.8-max(国际部署) ¥17.99 ¥53.96
qwen3.7-max(国际部署) ¥22.48 ¥67.45
Qwen3.5-397B-A17B(千帆代售,≤128K) ¥1.2 ¥7.2
  • 夜间优惠是阿里最大特色:22:00–08:00(UTC+8)按计费时间判定,国际站 qwen3.7-plus 限时夜间 6 折、日间 8 折;百炼个人版夜间 5 折;另有”秒悟 Meoo Night Plan”Qwen3.7-Max 最低 2 折、Plus 最低 4 折。
  • 阶梯加价:输入超过 256K 后单价上涨约 3 倍($0.276 → $0.826)。
  • 新用户 100 万免费 token(长期有效)。

文心一言(百度千帆)

C 端:文心一言 APP / ernie.baidu.com 基础功能免费。

API 单价(元/百万 tokens)

模型 输入长度 输入 输出 缓存命中
ERNIE 5.1(当前旗舰,128K) ≤32K ¥4 ¥18
ERNIE 5.1 32K–128K ¥6 ¥22
ERNIE 5.0 ≤32K ¥6 ¥24
ERNIE 5.0 32K–128K ¥10 ¥40
ERNIE 4.5 Turbo(32K/128K) ¥0.8 ¥3.2 ¥0.2
ERNIE 4.5 Turbo(批量推理) ¥0.32 ¥1.28
ERNIE 4.5 Turbo VL(视觉) ¥3 ¥9 ¥0.75
ERNIE X1.1(深度思考) ¥1 ¥4
ERNIE 4.5 开源 0.3B ¥0.1 ¥0.4
ERNIE Speed Pro 128K ¥0.3 ¥0.6
ERNIE Lite Pro 128K ¥0.2 ¥0.4
  • 搜索增强按次计费:触发 ¥0.004/次(批量 ¥0.0016/次),这是文心区别于其他家的计费项。
  • 百度 AI 搜索 API:¥0.036/次调用;智能搜索生成 ¥0.06/次(限时 ¥0.008/次);每日免费额度 100 次,单账号每日上限 100,000 次。
  • 量包预付费:ERNIE-4.5-Turbo 系列共享量包 1 亿 tokens ¥140(9 折 ¥126)、5 亿 ¥700(85 折 ¥595)、10 亿 ¥1,400(8 折 ¥1,120),有效期 6 个月。
  • 按 TPM 预付费:ERNIE-4.5-Turbo 输入 10k TPM ¥346/月(活动价 ¥242)、输出 1k TPM ¥138.2/月(活动价 ¥96.8)。
  • 千帆同时代售第三方模型(DeepSeek、GLM、Kimi、Qwen 等),价格与各自官方略有差异(如千帆 GLM-5.2:输入 ¥8 / 缓存命中 ¥2 / 输出 ¥28)。
  • ЕРNIE 5.1 无视觉能力:千帆 API 明确标注当前 API 不支持视觉输入(C 端 APP 支持)。

DeepSeek(深度求索)

C 端:网页/APP 免费。

API 单价

模型 闲时 高峰
deepseek-v4-flash 输入(缓存命中) $0.007 $0.014
输入(缓存未命中) $0.22 $0.44
输出 $0.66 $1.32
deepseek-v4-pro 输入(缓存命中) $0.022 $0.044
输入(缓存未命中) $0.66 $1.32
输出 $1.98 $3.96
deepseek-v4-flash-vision-exp 同 v4-flash 同左 同左

换算为国内人民币口径(约 ¥1 ≈ $0.14):

模型 时段 缓存命中 缓存未命中 输出
V4-Pro 闲时 ¥0.15 ¥4.5 ¥13.5
V4-Pro 高峰 ¥0.30 ¥9.0 ¥27.0
V4-Flash 闲时 ¥0.05 ¥1.5 ¥4.5
V4-Flash 高峰 ¥0.10 ¥3.0 ¥9.0
  • 峰谷规则:高峰时段为 UTC 01:00–04:00 与 06:00–10:00,周一至周五,其余时间为闲时;闲时价格 = 高峰的一半
    • 换算为北京时间(UTC+8):09:00–12:00 与 14:00–18:00 为高峰(共 7 小时)。
    • 2026-08-23 二次优化:周末全天不再区分峰谷,统一按闲时(低谷)价格计费
  • 上下文 1M,最大输出 384K;并发限制:flash 2500、pro 500。
  • 支持非思考/思考两种模式(默认思考);图片按尺寸折算为 token 计入输入。
  • 注册赠送 500 万免费 token(长期有效);充值余额优先扣赠金。
  • 2026 年 8 月大幅涨价:V4-Pro 高峰输出由 ¥6 涨至 ¥27(涨幅 350%),缓存命中输入由 ¥0.025 升至闲时 ¥0.15(涨幅 500%)、高峰 ¥0.30(涨幅 1100%)。官方归因于”更合理地配置资源、提升服务稳定性”。即便涨价后,V4-Pro 高峰价仍约为 GPT-5.6 Sol 的 22%、智谱 GLM-5.2 的 36%。
  • 缓存命中价约为输入价的 3%(西方厂商普遍为 10%),是全场最激进的缓存折扣。

智谱 GLM(Z.ai / bigmodel.cn)

国际站 API(美元/百万 token)

模型 输入 缓存输入 输出
GLM-5.3-Flash(限时 5 折) $0.15(原 $0.30) $0.075 $0.50(原 $1.00)
GLM-5.3 / GLM-5.2 / GLM-5.1 $1.4 $0.26 $4.4
GLM-5 $1 $0.2 $3.2
GLM-4.7 / 4.6 / 4.5 $0.6 $0.11 $2.2
GLM-4.7-FlashX $0.07 $0.01 $0.4
GLM-4.5-Air $0.2 $0.03 $1.1
GLM-4.7-Flash / GLM-4.5-Flash 免费 免费 免费
  • GLM-5.3-Flash 的 5 折促销截止 2026-09-09 24:00(UTC+8);缓存存储限时免费。
  • 附加计费:Web Search $0.01/次;GLM-Image $0.015/张、CogView-4 $0.01/张;CogVideoX-3 $0.2/个视频;GLM-ASR-2512 $0.03/百万 token(≈$0.0024/分钟);GLM Slide/Poster Agent $0.7/百万 token;通用翻译 $3/百万 token。
  • 视觉模型:GLM-4.6V $0.3/$0.9、GLM-OCR $0.03、GLM-4.5V $0.6/$1.8、GLM-4.6V-Flash 免费。

国内站(bigmodel.cn + 千帆代售)

GLM Coding Plan(2026-07-30 起改为积分制):

档位 月付 连续包季(9 折) 连续包年(7 折) 5 小时额度 周额度
Lite ¥49/月 ¥44.1/月 ¥34.3/月 ~80 次请求 ~400 次
Pro(热门) ¥149/月 ¥134.1/月 ¥104.3/月 ~400 次请求 ~2,000 次
Max ¥469/月 ¥422.1/月 ¥328.3/月 ~1,600 次请求 ~8,000 次
  • 积分公式:消耗积分 =(输入 Token × 输入系数 + 缓存命中 Token × 缓存输入系数 + 输出 Token × 输出系数)÷ 10000
  • 时段规则:工作日 14:00–18:00 全额消耗积分;其余时段及周末全天按基础 50% 抵扣(半价调用)。
  • 千帆代售 GLM-5.2:输入 ¥8 / 缓存命中 ¥2 / 输出 ¥28(元/百万 token)。
  • 另有 Z.ai 的 GLM Coding Plan 国际版约 $18/月起,按每 5 小时窗口的提示数计量。

横向对比:主力档 API 单价总表

统一按每百万 token 计,人民币按 1 USD ≈ 7.1 CNY 换算,取各家主力/旗舰档

模型 主力档 输入 输出 输入(¥) 输出(¥) 上下文
DeepSeek V4-Pro(闲时) $0.66 $1.98 ≈¥4.7 ≈¥14.1 1M
豆包 Seed-2.0-pro(≤32K) ¥3.2 ¥16 ¥3.2 ¥16 256K
文心 ERNIE 5.1(≤32K) ¥4 ¥18 ¥4 ¥18 128K
智谱 GLM GLM-5.2 $1.4 $4.4 ≈¥9.9 ≈¥31.2 1M
通义千问 qwen3.8-max ¥14.4 ¥43.2 ¥14.4 ¥43.2 1M
Kimi K3(缓存未命中) ¥20 ¥100 ¥20 ¥100 1M
Gemini 3.1 Pro $2 $12 ≈¥14.2 ≈¥85.2 2M
ChatGPT gpt-5.6-terra $2 $12 ≈¥14.2 ≈¥85.2
Grok 4.6 $2 $6 ≈¥14.2 ≈¥42.6 500K
Claude Sonnet 5 $2 $10 ≈¥14.2 ≈¥71 1M
ChatGPT gpt-5.6-sol $4 $20 ≈¥28.4 ≈¥142 1.1M
Claude Opus 4.8 $5 $25 ≈¥35.5 ≈¥177.5 1M
Perplexity sonar-pro $3 $15 ≈¥21.3 ≈¥106.5

本文借助AI整理而成。

  • 标题: LLM对比
  • 作者: 简约无双
  • 创建于 : 2026-08-30 00:00:00
  • 更新于 : 2026-09-12 23:34:42
  • 链接: https://blog.jianyuewushuang.top/2026/08/30/LLM对比/
  • 版权声明: 本文章采用 CC BY-NC-SA 4.0 进行许可。
评论