这份报告不是"参数罗列",而是一本 WorkBuddy 自定义模型的选型操作手册。它回答三个问题:
本报告沿用"5 分钟找到内容 → 场景导航 → 目录速查 → 分篇详述 → 选型决策表"的结构,方便你从痛点出发直接跳读。本报告也适合上传给 WorkBuddy,让它直接学习后帮你选型。
选择适合你的版本,两种格式内容完全一致,仅排版不同。
交互式网页格式,适合在电脑、手机、平板上阅读。
💡 提示:如果你主要用 WorkBuddy 辅助决策,推荐下载 HTML 版本——AI 工具对 HTML 的解析更准确,能更好地提取表格数据和结构化信息。
| 你想做什么 | 去哪里找 |
|---|---|
| 搞懂各家计费单位为什么不一样、Credits 怎么折算 | 第一篇 / 1.3 术语与计量速查 |
| 看全部厂商、谁能被 WorkBuddy 自定义模型调用 | 第二篇 / 2.1 厂商总览 |
| 比个人版 / Token Plan / 按量价格 | 第二篇 / 2.2 个人版对比 |
| 比企业版 / 团队版、要多人座席与预算管控 | 第二篇 / 2.3 企业版对比 |
| 搞懂 Credits / 积分 ↔ Token 的明确换算 | 第二篇 / 2.4 计量归一化 |
| 用最日常的任务直观看各家差距 | 第二篇 / 2.5 场景化对比 |
| 看各模型能力矩阵(上下文 / 模态 / 开源 / Agent) | 第三篇 / 3.1 模型特性矩阵 |
| 按我的需求直接拍板选型 | 第三篇 / 3.2 选型建议 |
| 把模型接到 WorkBuddy | 第三篇 / 3.3 接入配置速查 |
| 同一家厂商有旗舰 / 标准 / 轻量好几个版本,怎么选 | 第二篇 / 2.6 模型版本梯队对比 |
场景 1:我是老板 / 管理者,要给团队选模型、控预算
1. 第二篇 / 2.3 企业版对比 — 座席、预算锁定、企业安全 2. 第三篇 / 3.2 选型建议 — 按团队诉求拍板
场景 2:我想看清账单、搞懂“为什么各家算出来的钱不一样”
1. 第一篇 / 1.3 术语与计量 — 统一语言 2. 第二篇 / 2.4 计量归一化 — 折算到同一把尺子 3. 第二篇 / 2.5 场景化对比 — 直观看差距
场景 3:我想接一个更强的模型到 WorkBuddy
1. 第二篇 / 2.1 厂商总览 — 谁能被调用 2. 第三篇 / 3.3 接入配置速查 — Base URL 与路径
场景 4:我被“积分 / Credits / 算力点”绕晕了
1. 第一篇 / 1.3 术语与计量 2. 第二篇 / 2.4 计量归一化(含各家明确换算标准总表)
场景 5:我要看模型本身的能力差异
1. 第三篇 / 3.1 模型特性矩阵 — 上下文 / 模态 / 开源 / 推理 / Agent
场景 6:同一家厂商有旗舰 / 标准 / 轻量好几个版本,我该选哪一档
1. 第二篇 / 2.6 模型版本梯队对比 — 能力差在哪、价格差几倍、按任务选档
| 一级(篇) | 二级(章) | 一句话说明 |
|---|---|---|
| 第一篇 基础认知与计量 | 1.1 背景与目的 | 为什么需要这份报告、它解决什么 |
| 第一篇 基础认知与计量 | 1.2 方法论与可信度 | 核心约束、置信度图例、数据窗口 |
| 第一篇 基础认知与计量 | 1.3 术语与计量速查 | Token Plan / Coding Plan / 积分 等统一语言 |
| 第二篇 套餐全景对比 | 2.1 厂商总览 | 16 家厂商、API 兼容、能否接 WorkBuddy |
| 第二篇 套餐全景对比 | 2.2 个人版对比 | 元 / 百万 tokens 价格与额度 |
| 第二篇 套餐全景对比 | 2.3 企业版对比 | 团队 / 企业档位、座席与安全 |
| 第二篇 套餐全景对比 | 2.4 计量归一化 | Credits↔Token 明确换算、同请求对照 |
| 第二篇 套餐全景对比 | 2.5 场景化对比 | 同一套任务、按规模放大看差距 |
| 第三篇 特性、选型与接入 | 3.1 模型特性矩阵 | 上下文 / 模态 / 开源 / 推理 / Agent |
| 第三篇 特性、选型与接入 | 3.2 选型建议 | 按需求快速选型决策表 + 避坑 |
| 第三篇 特性、选型与接入 | 3.3 接入配置速查 | WorkBuddy 添加模型路径与 Base URL |
| 第二篇 套餐全景对比 | 2.6 模型版本梯队对比 | 同一厂商旗舰/标准/轻量:能力差、价格倍率、按任务选档 |
理解 WorkBuddy 自定义模型的运行本质、计费差异与计量口径,是选型的第一步。本篇不堆原理,只讲决策必须知道的“边界”与“统一语言”。
越来越多团队和个人开始用 WorkBuddy 及同类智能体平台 处理写方案、做 PPT、整理纪要、搭智能体等日常工作。这类平台本身不绑定某一家大模型,而是支持把任意兼容的模型“接进来”当底座——这就是 自定义模型 需求爆发的根源:模型要你自己选、自己付钱。
但现实是:国内主流大模型已有 16 家(统计口径见 2.1 厂商总览),每家套餐命名不同(Token Plan / Coding Plan / 按量 / 包月),计费单位也不统一(直 token 池、Credits、积分、算力点),同一件事在不同平台算出来的“多少钱”完全不可直接相加。结果就是——绝大多数人面对一长串模型名字和价目表,根本不知道怎么选。
本报告的目的很明确:
本报告围绕一个核心约束展开:WorkBuddy 自定义模型 = 兼容 OpenAI(或 Anthropic)协议的 API 转接层,API Key 仅本地保存、费用与 WorkBuddy 积分独立。因此可被 WorkBuddy 调用的前提 = 该套餐支持 API 且协议兼容。凡“仅限自家编程工具内、明确禁 API 直连”的 Coding Plan 均单列标注,不作为推荐底座。
置信度图例:✅ 已核验 官方定价页 / 文档直接取得 | ⚠️ 估算/快照 第三方横评或早期快照,下单前请复核实时页 | 📞 询价 企业定制报价,无公开档位。
| 术语 | 含义 | 对选型的影响 |
|---|---|---|
| Token Plan | 预购额度包,按 token 抵扣,多数支持 API 直连;例:阿里百炼、腾讯云 TokenHub、火山方舟、小米 MiMo | 用量稳定时单 token 成本最低,适合长期接入 |
| Coding Plan | 面向编程 / 智能体场景的订阅,含统一积分点数;例:智谱 GLM Coding Plan | 须确认是否开放 API——智谱开放、火山 / 阿里部分 Coding 档明确禁 API 脚本 |
| 按量(Pay-as-you-go) | 实时按 token 计费,无订阅;例:DeepSeek、Kimi、百度千帆、阶跃、零一 | 试错零门槛,波动大用量时账单不可控 |
| 直 token 池 | 1 token = 1 扣减单位,无积分层;例:腾讯云轻享、百度千帆 Token Plan | 比价最直接,可跨模型横向比 |
| Credits / 积分 | 厂商统一点数,按模型分层、缓存、峰谷折算成 token;例:阿里百炼、智谱、小米、火山方舟 | 单位不相同,必须归一到“元”才能跨厂商比 |
| 缓存命中(Cache Hit) | 重复出现的输入(如长文档)按 1/4~1/10 计费 | 长文反复追问时成本差距巨大,是横向区分套餐优劣的关键维度 |
| 上下文窗口 | 单次可处理 token 上限(如 128K / 256K / 1M) | 长文档、长对话、Agent 多步任务的关键指标 |
| 开源 / 闭源 | 权重是否公开可自托管 | 政企“数据不出域”场景必看,私有化部署的前提 |
本报告统一把一切归一到两把尺子:① 元 / 百万 tokens(按量口径) 用于精确比价;② 规模化月账单(个人 / 10 人 / 50 人) 用于建立体感。Credits / 积分类一律先折算再比。
本篇把 16 家厂商的套餐放到同一张台面上:先看“谁能接”,再比“个人价 / 企业价”,最后用归一化口径和场景化对比消除单位差异,让差距一目了然。
| 厂商 | 主力模型(2026) | API 协议兼容 | 个人/按量 | 企业/团队版 | WorkBuddy 接入 |
|---|---|---|---|---|---|
| 腾讯(混元 / TokenHub) | Hy3(通用)、Hy4 preview(新·开源) | OpenAI 兼容 | ✅ 按量+Token Plan | ✅ 企业版轻享/专业 | 官方预设 |
| 阿里(百炼 / 通义) | Qwen3.8-Max、Qwen3.7 系、Qwen 开源系 | OpenAI 兼容 | ✅ Token Plan | ✅ 团队版/企业版 | Custom |
| 字节(火山方舟 / 豆包) | Seed-2.1-Pro、Doubao-2.1 / Seed-2.0 系 | OpenAI 兼容 | ✅ 按量+Token Plan | ✅ 团队版/企业版 | Custom |
| 智谱(BigModel) | GLM-5.3 / 5.1 / 5.3-Flash | OpenAI 兼容 | ✅ 按量+Coding Plan | ✅ 企业折扣+私有化 | 官方预设(Coding) |
| DeepSeek | V4-Pro / V4-Flash | OpenAI 兼容 | ✅ 纯按量 | 📞 私有化/定制 | Custom |
| 月之暗面(Kimi) | K2.6 / K3 | OpenAI 兼容 | ✅ 按量+Coding Plan | 📞 企业API询价 | 官方预设(Coding) |
| MiniMax | M3 / M2.7 | OpenAI 兼容 | ✅ Token Plan | 📞 企业 volume discount | Custom |
| 阶跃星辰(Step) | Step-3.7-Flash | OpenAI + Anthropic | ✅ 按量 | 📞 询价 | Custom |
| 零一万物(Yi) | Yi-Lightning | OpenAI 兼容 | ✅ 按量 | 📞 企业私有化 | Custom |
| 百度(千帆 / ERNIE) | ERNIE 5.1 | OpenAI 兼容 | ✅ 按量 | ✅ 企业认证折扣 | Custom |
| 硅基流动(聚合) | 托管 200+ 开源模型 | OpenAI 兼容 | ✅ 按量+免费模型 | 📞 预留实例 | Custom |
| 天工(Skywork) | SkyClaw-v1.0 / Lite | OpenAI 兼容 | ✅ 按量 | ✅ 团队/企业版 | Custom |
| 小米(MiMo) | MiMo V2.5 | OpenAI + Claude | ✅ Token Plan | 📞 询价 | Custom |
| 百川 / 讯飞 / 商汤 | M3-Plus / Spark 4.0 / SenseNova 6.5 | OpenAI 兼容 | ✅ 按量 | 📞 企业定制 | Custom |
下列为各厂商当前主力套餐或按量单价;标 ⚠️ 者为第三方快照或含峰谷 / 档位,非实时精确值。
| 厂商 / 套餐 | 价格 | 月额度 | 覆盖模型 | 口径说明 | 置信 |
|---|---|---|---|---|---|
| 腾讯云 TokenHub 通用(个人) | Lite¥39 / Std¥99 / Pro¥299 / Max¥599 | 3500万 / 1亿 / 3.2亿 / 6.5亿 | DeepSeek-V4、Kimi-K2.5、GLM-5.1/5、MiniMax-M2.7/2.5、Hy3 | 直 token 池,可 API | ✅ |
| 腾讯云 Hy Token Plan(个人) | Lite¥28 / Max¥468(含 Std/Pro 档) | 官方未单列额度;限定 Hy3 单模型,同档价位 token 额度优于通用包 | 仅混元 Hy3 | 单模型,可 API | ✅ |
| MiniMax Token Plan | Plus¥49 / Max¥119 / Ultra¥469 | 6亿 / 18亿 / 71亿 | M3 / M2.7(全模态共享) | 1M 上下文,不限购 | ✅ |
| 阿里百炼 Token Plan(个人) | Lite¥39 / Std¥139 / Pro¥499 | 2500 / 1万 / 4万 Credits(7天) | Qwen 全系 + DeepSeek/GLM/Kimi/MiniMax | Credits 计量(见 2.4) | ✅ |
| 火山方舟 Token Plan(预购包) | Small¥40 / Medium¥200 / Large¥500 / Max¥1000 | 22M / 111M / 278M / 556M tok | 模型池最全:Kimi-K3、DeepSeek-V4、GLM-5.3、MiniMax-M3 | 预购 token 包,可 API;与「方舟模型 API 按量(积分制)」是两条产品线,后者见 2.4.1 | ✅ |
| 小米 MiMo Token Plan | Lite¥39 / Std¥99 / Pro¥329 / Max¥659 | 41亿 / 110亿 / 380亿 / 820亿 Credits | MiMo V2.5 | 兼容 Claude/OAI | ✅ |
| DeepSeek 纯按量 | 官方单价本次未核验全;第三方网关参考价 V4-Pro ¥12/24、V4-Flash ¥1/2(见 2.6.1 与硅基流动行) | — | V4-Pro(1.6T / 49B 激活)、V4-Flash(284B / 13B 激活) | 1M 上下文,Thinking / Non-Thinking 双模;开源;以下单前官方 pricing 页为准 | ⚠️ 单价需复核实时页 |
| 百度千帆 按量 | ERNIE 5.1 输入4/输出18;ERNIE 4.5-Turbo 输入0.8/输出3.2 | — | ERNIE 5.x、DeepSeek、GLM、Kimi | 32k 内档,长上下文略高 | ✅ |
| 硅基流动(聚合) | DeepSeek-V4-Flash ¥1/¥2;V4-Pro ¥12/¥24;Qwen3-8B 免费 | 新户送 14 元 / 2000万 tok | 200+ 开源模型统一网关 | 完全 OpenAI 兼容;第三方网关价,与模型厂商官方定价可能不同 | ✅ |
| 智谱 BigModel 按量 | GLM-5.3 / 5.2 输入8/输出28/缓存2;GLM-5.1 输入6/输出24 | — | GLM-5.x、4.x、视觉、Embedding | 1M 上下文(5.3 为 1.31M) | ⚠️ 按量单价需复核实时页 |
| Kimi / Moonshot 按量 | K2.6 输入6.5/输出27/缓存1.3;K2.5 输入4/输出21/缓存0.7 | — | K2.6 / K2.5 / K3(新旗舰·2.8T·1M·多模态) | K3 输入20/输出100(国际 $3/$15) | ⚠️ 按量单价需复核实时页 |
| 阶跃星辰 按量 | Step-3.7-Flash 输入1.35/输出8.1/缓存0.27;3.5-Flash 输入0.7/输出2.1/缓存0.14 | — | Step 全系(开源) | OpenAI+Anthropic 兼容 | ✅ |
| 零一万物 按量 | Yi-Lightning ¥0.99(输入+输出合并);Yi-Vision-v2 ¥6 | — | Yi-Lightning(路由) | 16K,输入输出同价 | ✅ |
| 天工 Skywork 按量 | SkyClaw-v1.0 输入0.5/输出4;Lite 输入0.3/输出2 | — | SkyClaw 系列 | 1M 上下文,Agent 优先 | ✅ |
| 字节豆包/火山 按量 | Doubao-Seed-2.1-Pro 输入6/输出30/命中1.2;Seed-2.1-turbo 3/15;Seed-2.1-lite 1.2/7.2 | — | 豆包 / Seed 全系(本行为 2.1 系) | OpenAI 兼容;官方价(2026-08,标准推理档);2.0 系见 2.6.1;低延迟(Fast)通道单价约 2 倍,见 2.6.1 口径提醒② | ✅ |
| 百川 按量 ⚠️ | M3-Plus 5/9;Baichuan-4 3/12;3-Turbo 2/8;2-Turbo 0.8/2 | — | Baichuan 全系 | 2026-07 快照 | ⚠️ |
| 讯飞星火 按量 ⚠️ | Spark 4.0 Ultra ~5/~10; Lite 免费 | — | Spark 全系 | 2026-07 快照,语音强 | ⚠️ |
| 商汤 日日新 按量 ⚠️ | SenseNova 6.5 ~4.5/~9;公测期部分免费 | — | SenseNova 全系 | 2026-07 快照 | ⚠️ |
| 厂商 | 团队/企业档位 | 月价 | 额度 | 核心权益 | 置信 |
|---|---|---|---|---|---|
| 腾讯云 TokenHub 企业版 | 轻享套餐 / 专业套餐 | ¥100 / ¥1000 | 5000万 tok(Auto 路由1模型)/ 10万积分(13模型自由选) | 多 API Key 分发、用量精细管控、预算锁定;较按量省 50–80% | ✅ |
| 阿里百炼 团队版 | 标准 / 高级 / 尊享(按座席) | ¥150 / ¥550 / ¥1398 起 | 2.5万 / 10万 / 25万 Credits 每座席 | 多坐席 RAM 子账号、共享用量包(¥5000/62.5万)、无 5h 滚动窗口;企业版定制 | ✅ |
| 火山方舟(扣子/方舟) | 团队高阶/旗舰/尊享;企业标准/旗舰 | ¥198起 / ¥398起 / ¥1998起 / ¥980起 / ¥8980起 | 19.8万 / 39.8万 / 199.8万 / 34.5万 / 207万 积分 | 自定义模型接入、成员管理、SSO/VPC 企业安全;方舟模型 API 另走企业定制 | ✅ |
| 智谱 企业版 | 用量阶梯 V0→V3(9/8/7/6 折)+ 私有化年套餐 | 按量折扣 / GLM-5 系列私有化年包 ¥110万·年起、Air ¥50万·年起(以官方报价为准) | 随用量 | 模型计费福利、并发保障、专属顾问、私有化部署 | ✅ |
| MiniMax 企业版 | Volume Discount(10–30%)+ 私有化 | 📞 询价 | 自定义 | 本地 M3 权重自托管、专属技术支持 | 📞 |
| DeepSeek 企业版 | 按量 + 私有化/一体机 | 📞 询价 | — | 无公开订阅档;企业走销售,重视缓存降本 | 📞 |
| Kimi 企业版 | 会员 Allegro ¥699/月(100万 ctx,4 并行)+ 企业 API | ¥699 / 📞 | 随档 | 超长对话、Agent 并行;大客户联系销售 | 📞 |
| 天工 Skywork 企业版 | 专业¥99(个人) / 团队¥599 / 企业定制 | ¥99 / ¥599 / 📞 | 随档 / 定制 | 智能体 VIP、优先算力、私有化起 ¥38万/年 | ✅ |
| 字节豆包 企业 | 豆包专业版 ¥68/¥200/¥500(个人)+ 火山方舟企业定制 | ¥68起 / 方舟月保底¥10万起 | 随档 | OpenAI 兼容 API、行业垂类模型、VPC 隔离 | ✅ |
各平台计费单位并不统一,只有“元/百万 tokens 按量”和“直 token 池”可直接横向比价;Credits / 积分类需按厂商公布的明确换算系数折算,并非“1 积分 = 固定 token 数”。下表汇总各家已公开的 Credits/积分 ↔ Token 换算标准(均为官方文档口径,2026-08 核验)。
| 厂商 / 套餐 | 计量类型 | 明确换算标准(官方口径) | 1 积分/Credit ≈ 多少 token(示例) | 可直接比价 | 置信 |
|---|---|---|---|---|---|
| 阿里百炼 Token Plan / 团队版 | Credits(分层系数) | 按模型分层,每千 tokens 消耗:基础模型 输入0.1/输出0.2;主流模型 输入0.2/输出0.4;旗舰模型 输入0.5/输出1.0 Credits;缓存 ×0.5 系数。接入 Base URL dashscope.aliyuncs.com/compatible-mode/v1(Token Plan / 团队版通用)。注:Coding Plan 另有独立域名与 sk-sp- 前缀 Key,但明确禁 API 脚本,不用于 WorkBuddy 接入(见 3.2.1)。核验:qwen3.6-plus 输入8349 tok=8.349千×0.2=1.67 Credits,与官方示例一致 | 旗舰输出 1000 tok/积分;主流输出 2500 tok/积分;基础输出 5000 tok/积分(按输出侧单列) | ⚠️ 按模型/分层 | ✅ |
| 火山方舟 模型 API(按量) 区别于 2.2 的 Token Plan 预购包 | 积分 / 千 tokens | 抵扣系数(积分/千tokens):Doubao-pro-32k 输入0.8/输出2;Doubao-lite-32k 0.3/0.6;Doubao-1.5-pro-256k 输入5/输出9;视觉 pro 输入3/输出9 | Doubao-pro 输出 500 tok/积分、输入1250 tok/积分(按千tokens计) | ⚠️ 按模型 | ✅ |
| 智谱 GLM Coding Plan | 积分(公式) | 积分 = (输入×In + 缓存×Cache + 输出×Out) / 10000;系数/万tok:GLM-5.2 6.9/1.7/24;GLM-5-Turbo 5.7/1.5/21;GLM-4.7 4.6/1.2/16;非高峰(周一~五14-18外+周末) ×0.5,高峰(周一~五14:00-18:00) ×1。订阅档位:Lite ¥94.4 / Pro ¥430.4 / Max ¥862.4 每月(连续包月价,由 GLM-5.3 驱动;Pro≈6 倍、Max≈14 倍 Lite 周积分) | GLM-5.2 输出 416.7 tok/积分、输入 1449 tok/积分 | ⚠️ 按模型/峰谷 | ✅ |
| 小米 MiMo Token Plan | Credits(倍率) | 统一 Credit 点数:MiMo-V2.5 1 Token = 1 Credit (1x);MiMo-V2.5-Pro 1 Token = 2 Credits (2x);夜间 00:00–08:00 ×0.8 | V2.5 1 tok/积分;V2.5-Pro 0.5 tok/积分 | ⚠️ 按模型倍率 | ✅ |
| 腾讯云 TokenHub 企业专业版 | 积分池(≈元) | 100 积分 = 1 元;各模型按自身元/百万tok单价从积分池实时扣减(积分本质=元等价池)。1000元/月起=10万积分 | 1 积分=0.01元 ≡ DeepSeek-V4-Flash 14286 tok / Auto 5263 tok(按模型单价) | ⚠️ 按模型单价 | ✅ |
| 百度千帆 Token Plan(个人) | 直 token 池(无积分层) | 1 token = 1 扣减单位,不区分模型/输入输出/缓存,统一从月度额度扣。Mini ¥9.9/1000万、Lite ¥40/4200万、Pro ¥200/2.3亿、Max ¥600/7亿 | 直接 token 数;1元≈101万 tok(Mini)/ 105万(Lite) | ✅ 直接可比 | ✅ |
| 腾讯云 个人版 / 企业轻享 | 直 token 池 | 1 token = 1 扣减;元/百万tok已给定(通用 Std ¥99/1亿;轻享 2元/百万) | 直接 token 数 | ✅ 直接可比 | ✅ |
| 硅基流动 SiliconFlow | 元余额(无积分) | 无积分体系,直接元/百万tok扣减,新户送14元≈2000万tok | 1元≈按模型(DS-V4-Flash 100万tok / Qwen3-8B 免费) | ✅ 直接可比 | ✅ |
| DeepSeek / Kimi API / 阶跃 / 零一 / 天工 / 百度 按量 | 元/百万tok | 直接按量,无积分层 | 直接可比 | ✅ 直接可比 | ✅ |
| 火山扣子平台(任务积分) | 任务积分(非token) | 按轮次/产物计费;企业版余额不足按 1000积分:1元现金 自动扣 | ❌ 不可换算(任务制) | ❌ | ✅ |
| Kimi 会员积分(Kimi Code) | 算力点(请求/功能制) | 官方未公布固定 token/积分换算,消耗随任务复杂度浮动;按周刷新+5h限流 | ❌ 不可换算 | ❌ | ✅ |
| 天工 Skywork 积分 | 产物/功能积分 | 按 DeepResearch / 幻灯片 / 文档产物计量,无公开 token 换算;Free 500/日·首月,Pro ~7000/月 | ❌ 不可换算 | ❌ | ⚠️ |
⚠️ 读表关键:能“直接比价”的只有直 token 池 / 元余额 / 元按量三类;Credits/积分类的“1 积分 = X token”高度依赖所选模型、是否缓存、峰谷时段——上面“示例”仅以输出侧单模型单列,真实混合负载下 1 积分能买的 token 会更高(缓存命中大幅拉低单位成本)。阿里百炼官方另给出实测参考:qwen3.6-plus 单次 ~5万 token 混合请求约耗 3–4 Credits(即 1 Credit ≈ 1.2–1.7万混合 token),与分层系数需以实时账单核对。做预算请以控制台账单实测为准。
| 平台(含模型) | 计算口径 | 消耗 |
|---|---|---|
| 智谱 GLM-5.2(非高峰 ×0.5) | (80000×6.9 + 400000×1.7 + 5000×24)/10000 ×0.5 = 135.2 ×0.5 | ≈ 67.6 积分 |
| 小米 MiMo V2.5(1 Token = 1 Credit) | (80000 + 400000 + 5000) ×1 Credit | ≈ 485,000 Credits |
| 阿里百炼(主流分层,每千tokens) | 输入0.2 / 输出0.4 Credits 每千tokens,缓存×0.5;结合官方实测 1 Credit≈1.2万混合tok | ≈ 58 Credits |
| 腾讯云 企业专业(100积分=1元) | 按所选模型元/百万tok单价从积分池扣减 | ≈ 数百积分(依模型单价) |
此例用于说明“系数口径差异极大”:同一次请求,智谱以几十积分、阿里以几十 Credits、小米以数十万 Credits 计——单位不同不可直接相加,必须先归一到“元”或“token”再比。这也是为什么跨厂商比价必须统一到“元/百万 tokens 按量”口径(见 2.4.3)。
| 模型(按综合单价升序) | 综合单价(元/百万tok) | ¥1000 约可买 |
|---|---|---|
| DeepSeek-V4-Flash | ¥0.70 | 1429M |
| MiniMax-M2.7 | ¥1.00 | 1000M |
| MiniMax-M2.5 | ¥1.10 | 909M |
| Auto 智能路由 | ¥1.90 | 526M |
| Kimi-K2.5 | ¥2.30 | 435M |
| Kimi-K2.6 | ¥2.80 | 357M |
| GLM-5.1 | ¥3.80 | 263M |
| GLM-5 | ¥4.40 | 227M |
| MiniMax-M3 | ¥5.00 | 200M |
| DeepSeek-V4-Pro | ¥9.30 | 108M |
| 模型(按成本升序) | 典型混合负载成本(元) |
|---|---|
| 天工 SkyClaw-Lite(0.3/2) | ¥1.30 |
| 零一 Yi-Lightning(合并¥0.99) | ¥1.49 |
| 阶跃 Step-3.5-Flash(0.7/2.1) | ¥1.75 |
| 阿里 Qwen-Plus(0.8/2.0) | ¥1.80 |
| 腾讯混元 Hy3(1/4) 即 2.6.1 标准档 | ¥3.00 |
| DeepSeek V4-Flash 高峰(3/9) | ¥7.50(空闲减半¥3.75) |
| 百度 ERNIE 5.1(4/18) | ¥13.0 |
| Kimi K2.6(6.5/27) | ¥20.0 |
| 智谱 GLM-5.2 | ¥22.0 |
| DeepSeek V4-Pro 高峰(9/27) | ¥22.5 |
试算仅用于感知相对量级,实际成本受缓存命中率、上下文长度档、思考/工具调用影响极大。缓存命中可将输入成本压到 1/4–1/10。表中混元 Hy3、部分旗舰单价为历史快照价,下单前请以各厂商实时 pricing 页为准。
这一节不谈省钱,只谈“对比”——上面那些“元/百万 tokens”“Credits 系数”太抽象,下面用职场每天都在做的 4 个真实任务(2000 字改 15 页 PPT / 题目写 5000 字方案 / 1 小时录音整理纪要 / 读 3 万字报告连问 5 题),把各家模型套餐放在同一套任务上跑,换算成人民币,让你直观看到差距。测算法:中文约 1 token ≈ 1.5 字;每家取当前最常用 / 最推荐的模型与套餐档。
同一套任务按使用规模放大(个人重度 = 每月 22 个工作日,每天 1 次 S1 + 1 次 S2 + 1 次 S3 + 2 次 S4;团队 = 同等强度 × 人数;小米按包月 ¥39/人 计):
| 使用规模 | 腾讯云 / 百度 / 零一 | 阿里 / DeepSeek / 智谱 | Kimi | 小米 MiMo |
|---|---|---|---|---|
| 单次(参考) | 普遍 < 1 角,单独看无对比意义 | |||
| 个人 · 重度月用 | 约 ¥5 | 约 ¥11 | 约 ¥18 | 包月 ¥39 |
| 10 人团队 · 月用 | 约 ¥48 | 约 ¥109 | 约 ¥183 | ¥390 |
| 50 人部门 · 月用 | 约 ¥240 | 约 ¥546 | 约 ¥914 | ¥1950 |
测算假设:中文按 1.5 字/token;阿里百炼取主流模型分层系数(每千tokens 输入0.2/输出0.4,缓存×0.5)并按 Lite ¥39/2500 Credits 折算;智谱取 GLM-5.2 非高峰 ×0.5;缓存仅"读长文追问"场景计入;小米按 Token Plan Lite ¥39/月(含 41 亿 Credits)包月计。真实成本受上下文长度档、思考/工具调用、峰谷时段影响,Agent 多步任务会放大消耗,请以控制台账单为准。本表用于建立体感,非精确报价。
前面几节比的是“跨厂商谁更便宜”。但真正常让人纠结的是另一件事:同一家厂商自己就分好几个版本——旗舰、标准、轻量,名字还各不相同(Max / Pro / Plus / Flash / Lite / Mini / Turbo)。本节把 8 家主流厂商的版本梯队拉平,告诉你能力差在哪、价格差几倍、什么任务该用哪一档,免得你要么全用最贵的旗舰烧钱,要么全用最便宜的轻量掉质量。
价格统一为 元 / 百万 tokens(输入 / 输出),取各厂商 2026-08 最新官方口径;调价频繁,下单前请以实时页复核。
| 厂商 | 旗舰(质量优先) | 标准(均衡) | 轻量(高频 / 便宜) |
|---|---|---|---|
| 腾讯 混元 | Hy4 preview(新·开源 Apache 2.0) 1M ctx|¥6 / 18(缓存 0.3) | Hy3(通用主力) 256K|¥1 / 4 | —(Hy3 已是最低成本通用档) |
| 阿里 通义 | Qwen3.8-Max 2.4T · 1M ctx|¥12 / 36 | Qwen3.5-Plus ¥0.8 / 4.8 | Qwen3.5-Flash ¥0.2 / 2(最快最便宜) + qwen-long 10M 超长上下文 |
| 智谱 GLM | GLM-5.3(2026-08-19) 1.31M ctx|¥8 / 28 | GLM-5.2 / 5.1 1M ctx|¥8 / 28 | ¥6 / 24 | GLM-4.7-Flash 轻量多模态 |
| DeepSeek | V4-Pro(1.6T / 49B 激活) 1M · 双模|¥12 / 24 | V4-Flash(284B / 13B 激活) 1M|¥1 / 2 | V4-Flash-Vision-Exp 多模态 · 2026-08-31 开源 |
| Kimi | K3(2.8T · 1M · 多模态) ¥20 / 100(国际 $3 / $15) | K2.6 ¥6.5 / 27(缓存 1.3) | K2.5 ¥4 / 21(缓存 0.7) |
| MiniMax | M3(1M · 原生多模态) ¥4.2 / 16.8(<512k) ¥8.4 / 33.6(>512k) | — | M2.7 更便宜的轻量档 |
| 字节 豆包 / Seed | Seed-2.0-Pro / Code 256K|¥3.2 / 16 | — 2.0 系未设标准档; 2.1 系 Seed-2.1-turbo ¥3 / 15 见 2.2 表 | Seed-2.0-Lite ¥0.6 / 3.6 Seed-2.0-Mini ¥0.2 / 2 |
| 百度 文心 | ERNIE 5.0(2.4T) 128K|千帆 ¥6 / 24 | ERNIE 5.1(~800B) 128K|千帆 ¥4 / 18 | ERNIE 4.5-Turbo ¥0.8 / 3.2 |
| 版本档 | 适合的任务 | 代表模型 | 什么时候该升级 / 降级 |
|---|---|---|---|
| 旗舰 (质量优先) | 复杂推理、关键交付物(对外方案 / 合同 / 研报)、长思考、强多模态 | 阿里 Qwen3.8-Max、智谱 GLM-5.3、腾讯 Hy4 preview、DeepSeek V4-Pro、Kimi K3 | 当轻量 / 标准版产出“不对、不稳、掉链子”时升级;只在关键任务用,避免日常烧钱 |
| 标准 (均衡) | 日常主力对话、中等复杂度写作、常规编程、Agent 多步任务 | 阿里 Qwen3.5-Plus、智谱 GLM-5.1、DeepSeek V4-Flash、豆包 Seed-2.1-turbo、百度 ERNIE 5.1 | 多数团队的“默认档”;质量够用、价格适中,先跑通再按需升旗舰 |
| 轻量 (高频 / 便宜) | 批量处理、简单改写、实时分类 / 抽取、高频小任务、内部草稿 | 阿里 Qwen3.5-Flash、豆包 Seed-2.0-Mini、GLM-4.7-Flash、MiniMax M2.7 | 量大、对质量要求不高时首选;成本可压到旗舰的 1/5 到 1/18(各厂商倍率不同,见 2.6.1) |
一句话总结:日常用标准档打底、轻量档跑量、只在关键任务上旗舰档;选版本时先看“同价最新代”,再看“任务复杂度”,别被名字里的 Max / Pro / Flash 绕晕。完整的各家价格倍率与接入路径,可回到 2.2 / 2.4 / 3.3 交叉核对。
本篇把“比完价格”推进到“怎么选、怎么接”:先看模型能力矩阵,再用一张决策表按你的诉求直接拍板,最后给到 WorkBuddy 接入的配置速查。
本节每家厂商只列一个“当前主力模型”作能力快照。但请注意:每家厂商内部都有旗舰 / 标准 / 轻量多个版本(如 Qwen3.8-Max / Plus / Flash、GLM-5.3 / 5.2 / 5.1、DeepSeek V4-Pro / Flash),能力差与价格差可达数倍到十几倍。完整的版本梯队对比与“按任务选档”指引见第二篇 2.6 节。
| 模型 | 上下文 | 模态 | 开源 | 推理/代码 | Agent/工具 | 定位 |
|---|---|---|---|---|---|---|
| 腾讯 Hy3 / Hy4 preview | 256K / 1M | 文本(+图) | Hy4 Apache2.0 | 强推理、代码 | Agent 体系化 | 自研旗舰,生态协同 |
| 阿里 Qwen3.8-Max(旗舰)/ Qwen3.7 系 | 长上下文 | 文本/多模态 | Qwen 开源系广泛 | 均衡 | 工具/多 Agent | 阿里生态、全模态 |
| 字节 Seed-2.0-Pro / Doubao-2.1 | 长上下文 | 文本/图/视频 | 闭源 | 代码/推理 | 工具/多 Agent | 多模态、视频 Seedance |
| 智谱 GLM-5.2 / 5.3 | 1M | 文本(+5.3Flash多模态) | 闭源(企业) | 强推理、长任务 | AllTools/强 Agent | 长程工程、中文强 |
| DeepSeek V4-Pro / Flash | 1M | 文本 | 开源标杆 | 强推理/代码 | 工具 | 性价比推理 |
| Kimi K2.6 / K3 | 262K / 1M | 文本(+视觉 K2.5) | K3 modified-MIT | 代码专长 | 强 Agent(300步) | 长程编程、研究 |
| MiniMax M3 / M2.7 | 1M(部分196K) | 全模态 | M3 开源权重 | 代码/Agent | 工具 | 超长上下文、多模态 |
| 阶跃 Step-3.7-Flash | 256K | 原生多模态 | Apache2.0 | 快、低成本 | 强 Agent、兼容框架 | 生产级 Agent |
| 零一 Yi-Lightning | 16K | 文本(路由) | 底座Yi开源 | 均衡 | 工具 | 极低单价、中英双语 |
| 百度 ERNIE 5.1 | 128K | 文本/图 | 闭源 | 推理 | 搜索增强/工具 | 中文、知识问答 |
| 天工 SkyClaw-v1.0 | 1M | 文本/多模态 | 闭源(企业) | RL Agent | 多步工具、规划/执行分离 | Agent 优先 |
| 百川 M3-Plus | 长上下文 | 多模态 | 闭源(企业) | 均衡 | 工具 | 企业多模态 |
| 讯飞 Spark 4.0 Ultra | 长上下文 | 文本/语音 | 闭源 | 推理 | 语音交互 | 语音场景强 |
| 商汤 SenseNova 6.5 | 长上下文 | 多模态 | 闭源 | 均衡 | 工具 | 行业多模态 |
| 你的主要诉求 | 首选 | 备选 | 关键理由 |
|---|---|---|---|
| 开箱即用、不想配置 | 腾讯云 TokenHub(官方预设) | 阿里百炼 Token Plan | 预设自动填 Key,新人友好 |
| 个人预算最低 | 零一 Yi-Lightning / 天工 SkyClaw-Lite | MiniMax Token Plan | 单价极低(合并/分侧均 <¥3/百万) |
| 中文写作 / 长文质量 | 智谱 GLM-5.3 按量 / 阿里 Qwen3.8-Max | Kimi K3 | 中文强、1M 上下文 |
| 读长文档 / 超长上下文 | Kimi K3 / MiniMax M3(1M) | DeepSeek V4(1M) | 原生超长上下文,RAG 友好 |
| 编程 / Agent 重度 | 智谱 GLM Coding Plan | DeepSeek V4 / Kimi K3 | Coding 订阅积分友好、Agent 强 |
| 多模态(图 / 视频) | 字节 Seed-2.1 / 阿里 Qwen | MiniMax M3 | 多模态覆盖全 |
| 企业多座席 / 预算管控 | 腾讯云 TokenHub 企业版 / 阿里百炼团队版 | 火山方舟企业版 | 座席 / Key 管理、预算锁定最清晰 |
| 数据不出域 / 私有化 | 智谱私有化年包 / DeepSeek·MiniMax 私有化 | — | 合规、权重自托管 |
| 接 WorkBuddy 最稳 | 官方预设(腾讯云 TokenHub / 智谱 Coding / Kimi Coding) | 自定义 API(各家) | 协议兼容、开箱接入 |
路径:头像 → 设置 → 模型 → 添加模型 → 选「提供商接入」(腾讯云 Token Plan / 智谱 Coding Plan / Kimi Coding Plan,自动填充 URL 与模型名)或「自定义 API / Custom」(DeepSeek、MiniMax、阿里百炼、火山方舟、百度千帆、硅基流动等,需自填 Base URL)→ 填 API Key 保存。API Key 仅存本地 ~/.workbuddy/models.json。
| 厂商 | Base URL(OpenAI 兼容) |
|---|---|
| DeepSeek | https://api.deepseek.com/v1 |
| 智谱 BigModel | https://open.bigmodel.cn/api/paas/v4(官方预设可自动填充) |
| Kimi / Moonshot | https://api.moonshot.cn/v1(官方预设可自动填充) |
| MiniMax | https://api.minimax.chat/v1 |
| 阿里百炼 / 通义 | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| 火山方舟 | https://ark.cn-beijing.volces.com/api/v3 |
| 百度千帆 | https://qianfan.baidubce.com/v2 |
| 硅基流动 | https://api.siliconflow.cn/v1 |
| 阶跃星辰 | https://api.stepfun.com/v1 |
| 零一万物 | https://api.lingyiwanwu.com/v1 |
| 天工 Skywork | https://api.apifree.ai/v1 |
| 腾讯云 TokenHub / Hy | 预设自动填充 |
| 本地 Ollama | http://localhost:11434/v1 |
非标准路径可在「高级配置」开启自定义协议开关跳过路径校验。API Key 仅存本地,停用后请在 models.json 中清理。