入门教程

AI API 怎么计费?输入、输出与上下文成本入门

看懂按 Token 计费、输入输出单价、上下文长度和倍率,学会在充值前估算一项任务的大致成本。

发布:2026年8月14日
更新:2026/8/14

API 通常不是按聊天次数收费

多数文本模型按实际处理的 Token 数计费。一次很短的问答可能非常便宜,一次携带整份报告并要求长篇输出的请求则可能贵很多。因此“我一天问十次要多少钱”没有固定答案,关键在每次输入和输出的长度。

输入和输出要分开看

输入包括你的问题、系统提示词、附件转换出的文字以及为保持对话而重复发送的历史消息。输出是模型生成的内容。两者通常单价不同,输出价格经常高于输入价格。

如果价格表写着“每百万 Token”,实际费用可以用下面的思路估算:输入量乘输入单价,加上输出量乘输出单价。中转站还可能设置线路倍率、充值汇率或服务费,最终应以账单为准。

为什么对话越聊越贵

客户端为了让模型记住前文,常会把历史对话随新问题一起发送。第一轮只有一个问题,十轮以后输入中可能包含前面所有内容。新手看到的只是新发的一句话,服务端处理的却是整段上下文。

完成一个主题后新建对话、删除无关历史、先压缩长文档再提问,都能减少无效输入。

缓存和其他收费项

部分模型对重复输入提供缓存价格,也可能对图片、音频、联网搜索或工具调用单独收费。不要把文本 Token 单价直接套到所有功能上。若价格表没有说明某项功能,先做小额测试并查看账单明细。

新手预算方法

先选择最常用的三类任务,各完成五次真实测试,记录总费用。用测试期的平均消耗估算一周,再乘四得到月度参考值。预留少量波动即可,不需要一次充值半年。

单价低不代表总价低。响应冗长、反复失败和重复发送大上下文,都会让便宜模型产生更高的实际成本。

标签:API计费Token价格成本