给一份说明书做问答,上传成功之后很容易顺手问十几个问题。Kimi API 值得先看清的地方是:上传、提取文本、把文本送进模型,这几步费用不是同一回事。我会先整理最需要回答的几个问题,再决定每次究竟要带多少资料。
文件处理与模型阅读,分开记
当前官方说明文件提取与存储 API 暂时免费;提取后的内容如果作为模型输入,仍按用量计费。“暂时”也不能写成永久承诺。文件体积、页数和实际输入 tokens 并不能直接互换。[1]
| 这一步在做什么 | 当前计费方向 | 应保留的记录 |
|---|---|---|
| 上传并提取内容 | 文件 API 暂时免费 | 提取是否完整可读 |
| 将正文送给模型 | 输入用量 | 实际发送的文本与 tokens |
| 生成回答 | 输出用量 | 是否忠于原文与所需长度 |
| 复用 K3 请求前缀 | 写入与缓存读取 | TTL 与实际命中 |
我建议先检查提取结果,再问需要的位置。扫描件、表格或排版复杂的内容,不能只因为上传成功就默认文字和字段都完整。这是验收建议,本文没有上传文件或测试提取准确性。
K3 缓存有期限,不是上传后永远省输入
K3 的重复请求前缀支持5分钟、1小时 TTL,未指定时默认5分钟。命中期限内的缓存按缓存输入价,命中会刷新期限,不再收一遍缓存写入费;首次写入则按对应 TTL 的规则单列。[1]
如果连续围绕同一份资料追问,可以观察是否有稳定前缀与实际命中。隔天再回来,或每次把文档前面的内容改得很多,就不能默认还按同样缓存价算。我会把问题、新内容与稳定资料分清,给预算留下可解释的用量,而不只看页面里“读取便宜”。
先给文档问答一个小验收范围
挑几项原文能明确回答的问题,再加一个原文没写的问题,检查模型能否承认缺少依据。答案长短、资料带入量和命中记录一起看,才能判断扩大使用是否划算。当前引用页没有提供足以核清全部现行模型价表的数值,本文不编具体人民币或美元套餐价;购买时对应自己的账户、模型与税费核对。
资料核对与适用范围
2026-10-06直接重读所列官方公开资料;OpenAI使用OpenAI Docs官方检索及正文读取,其余官方网页直接核对。按具体任务分析选型、计费与边界,示例算术不代表账户账单或性能测试。
没有商家登录、付费调用、上传、缓存实验、资源部署或请求测试;未测时延、成功率、输出质量、真实扣费。地区、版本、额度、工具、认证方式与账户资格须对应核对。