算清费用,测对速度
把调用量、输入规模与失败重试算进去,别只看模型的宣传数字。
当前价格只是可变快照
2026 年 9 月 19 日核对的 TypeSafe 模型页列出输入价格为每百万 token 0.042 美元,输出免费。下面计算器以此作为可修改的初始值;服务商价格、账户条件和费率可能变化,以实际控制台为准。
公式比一个总价更重要
费用估算 = 调用次数 × 每次计费输入 token ÷ 1,000,000 × 输入单价。
例如每次 2,500 token、调用 10,000 次,共 2,500 万输入 token;按示例单价约为 1.05 美元。这是自定输入规模下的算术,不是实际账单。
计费输入要按服务商口径计算,不能只数客户那一句话:State、问题、候选描述、重试和重复请求都可能影响总用量。不要把多个问题简单乘成多个完整请求,也不要默认共享状态完全不计费。
这份估算没有包括什么
OCR、转写、生成模型、搜索服务、数据库、服务器、网络传输、税费及人工复核都不在模型输入价格内。不同服务商的最终计费条件需分别核对。
延迟分层测量
记录应用发出请求至获得响应的耗时,以及用户输入至最终可用结果的端到端耗时。检索、网络、排队、预处理、重试和执行动作都会影响体验。
先测串行,再测与你实际业务一致的并发和批量。报告样本数、地区、提供商、模型版本及 p50 / p95;不要把单次最快结果写成“所有任务都能达到”。
本页来源与验证边界
核对日期:2026-09-19。文档整理,不代表本站完成了真实 API 或业务效果测试。
TypeSafe · Models, pricing and limits →TypeSafe · HTTP API →OpenRouter · Jev 1.13 →Cloudflare · Jev integration →Vercel · Jev evaluation integration →阅读进度只保存在当前浏览器

