首页/AI API 价格计算器

AI API · COST CALCULATOR

AI API 价格计算器

输入预计的输入、输出和缓存用量,按实时展示价估算月成本,并比较 Kin 当前在售的代表性模型。
直接回答

输入预计的每月输入、输出 Tokens 和缓存命中率,计算器会按 Kin 当前实时模型价格估算并由低到高排列;价格高低不等同于模型能力排名。

估算你的每月成本

月度成本估算

输入预计用量,按 Kin 当前在售模型的实时展示价自动估算。

实时价格
%
仅作用于输入 Tokens
模型预计月成本
deepseek v4 flash 0731当前估算最低
¥1.85/ 月
¥6.66/ 月
¥38.84/ 月
¥180.41/ 月

实时价格对比

模型上下文输入 / 百万 Tokens输出 / 百万 Tokens缓存 / 百万 Tokens
glm 5.2智谱 AI1M¥3.97¥12.47¥0.743
deepseek v4 flash 0731深度求索(DeepSeek)1.3M¥0.248¥0.578¥0.025
kimi k3月之暗面1M¥14.09¥70.47¥1.41
qwen3.8 27b阿里巴巴1M¥0.352¥2.51¥0.117
MiniMax: MiniMax M3MiniMax1M¥1.90¥7.93¥0.413
StepFun: Step 3.7 Flash阶跃星辰262K¥1.32¥7.60¥0.264

这是 Kin 当前在售模型的同口径样本,不代表能力排名;价格与可用状态会随目录同步更新。

怎样公平比较 AI API 价格

统一计价单位

全部换算成每百万 Tokens 的价格。

按输入输出占比加权

编程和智能体任务的输出占比通常高于分类任务。

纳入缓存与上下文

长提示词与重复上下文会显著改变实际成本。

按任务类型选择

编程智能体优先考虑工具调用稳定性、上下文和输出成本。
长文档分析重点比较上下文容量、输入单价和缓存复用。
高并发分类重点关注低输入成本、延迟与输出可控性。
通用对话综合平衡质量、延迟与平均对话长度。

用真实流量做小规模测试

先选 2–3 个候选模型,用不含敏感数据的代表性请求小规模测试,同时记录回答质量、延迟、Token 用量和最终结算费用。

FAQ

常见问题

AI API 月成本是怎么估算的?

计算器把输入分为未缓存和缓存命中两部分,分别乘以对应单价,再加上输出 Tokens 费用。结果使用 Kin 当前实时展示价,仅供预算参考。

比较 AI API 价格时只看输入单价够吗?

不够。应同时比较输出、缓存、上下文长度和你的输入输出比例;长输出任务通常更受输出单价影响。

表格中的价格会变化吗?

会。表格从 Kin 最近一次同步的在售目录读取,模型价格和可用状态可能随目录刷新更新。

最便宜的模型一定最适合吗?

不一定。还要结合任务质量、上下文、工具调用、延迟和稳定性。建议用真实任务做小规模测试。