输入预计的每月输入、输出 Tokens 和缓存命中率,计算器会按 Kin 当前实时模型价格估算并由低到高排列;价格高低不等同于模型能力排名。
01
估算你的每月成本
月度成本估算
实时价格输入预计用量,按 Kin 当前在售模型的实时展示价自动估算。
%
02
实时价格对比
| 模型 | 上下文 | 输入 / 百万 Tokens | 输出 / 百万 Tokens | 缓存 / 百万 Tokens |
|---|---|---|---|---|
| glm 5.2智谱 AI | 1M | ¥3.97 | ¥12.47 | ¥0.743 |
| deepseek v4 flash 0731深度求索(DeepSeek) | 1.3M | ¥0.248 | ¥0.578 | ¥0.025 |
| kimi k3月之暗面 | 1M | ¥14.09 | ¥70.47 | ¥1.41 |
| qwen3.8 27b阿里巴巴 | 1M | ¥0.352 | ¥2.51 | ¥0.117 |
| MiniMax: MiniMax M3MiniMax | 1M | ¥1.90 | ¥7.93 | ¥0.413 |
| StepFun: Step 3.7 Flash阶跃星辰 | 262K | ¥1.32 | ¥7.60 | ¥0.264 |
这是 Kin 当前在售模型的同口径样本,不代表能力排名;价格与可用状态会随目录同步更新。
03
怎样公平比较 AI API 价格
统一计价单位
全部换算成每百万 Tokens 的价格。
按输入输出占比加权
编程和智能体任务的输出占比通常高于分类任务。
纳入缓存与上下文
长提示词与重复上下文会显著改变实际成本。
04
按任务类型选择
编程智能体优先考虑工具调用稳定性、上下文和输出成本。
长文档分析重点比较上下文容量、输入单价和缓存复用。
高并发分类重点关注低输入成本、延迟与输出可控性。
通用对话综合平衡质量、延迟与平均对话长度。
05
用真实流量做小规模测试
先选 2–3 个候选模型,用不含敏感数据的代表性请求小规模测试,同时记录回答质量、延迟、Token 用量和最终结算费用。