在线计算器

把「多少钱」算清楚再动手

十七个纯前端小工具,数据不出浏览器,全部不内置厂商价格常量——数字由你从官方页面填入,工具只做算术。

比价

大模型 API 价格对比表

23 个模型、9 家厂商(海外 4 + 国内 5)的输入输出单价横向对比,每行按官方原文币种标注,都带官方定价页链接与核对日期。

排预算

API 月成本估算器

填月输入 / 输出 token 用量,按各模型单价算出月成本并自动排序,先判断量级再选型。

估用量

token 计算器

粘贴真实 prompt,估算 token 数与调用成本,顺带看清中英文 token 密度差异。

控长度

上下文长度计算器

token 数换算成中文字符 / 英文单词量,并算单次调用成本,判断该不该塞长上下文。

选型

模型横向对比

勾选最多 4 个模型并排看单价、上下文、多模态与计费备注,按场景做选型判断。

控容量

并发与限流计算器

由 RPM / TPM 额度、单请求大小与耗时,倒推真正的瓶颈、建议并发数与峰值缺口。

省钱

提示缓存节省计算器

按固定前缀长度与命中率,算出缓存的月度节省额、实际输入均价与理论收益上限。

控历史

多轮会话成本模拟器

对比全量 / 滑窗 / 摘要三种记忆策略下的每轮 token 增长曲线与整场会话成本。

估额度

编程 Agent 额度估算器

按每天任务数、每任务步数与每步消耗,估算月额度与真实月成本,并给出该升档还是补超额的分界线。

选套餐

套餐性价比对比器

把超额算进去再比各档总成本并排序,同时判断这家有没有批量折扣——月费最低的档不一定最省。

团队采购

团队席位成本测算器

按用量把团队分组配档,对照全员统一档能省多少,并校验是否超出席位上限。

防限流

双上限限流模拟器

按任务节奏与并发数,预测你会先撞每分钟频率还是每日总量,并算出升级时两条线各涨多少。

选付法

自带密钥成本对比器

把自带密钥省下的加成和你花在管密钥上的时间折到同一个尺度,给出盈亏平衡的管理小时数。

排报错

报错分诊器

贴进报错原文,判断属于认证、限流、过载、超时、流中断还是解析崩溃等类型,给出排查方向与该避开的弯路。

估用量

积分预算估算器

按任务类型拆开月度消耗,算出缺口、大概几号见底、哪类任务最吃积分,以及换轻模型能省多少。

挑档位

套餐单位成本计算器

把各档折成每积分单价横向比,识别「大档并不便宜」的情况,并算清年付相对月付的实际折扣。

写指令

任务指令生成器

按目标、输入、输出格式、约束四个结构位,配合常用约束模板,拼出一段可直接复制的任务描述。

语音代理

语音对话延迟预算计算器

把「用户说完到听到回复」拆成配置类等待与算力类耗时两块分别加总,定位真正的大头在哪一段。配置类默认值取自开源流水线的参数默认值,算力类必须你自己实测填入。

语音代理

本地语音模型体量估算器

按参数量乘每参数字节数,估算 STT、TTS、LLM 三段模型的权重体积下限。只做这一步算术——实际显存占用必然更高,本站不做「你的卡够不够」的判定。

视频

视频导出体积与码率换算器

码率、时长、文件体积三者互算,带 MiB 与 MB 两套单位切换——这正是「算出来和实际对不上」的常见原因。不内置任何平台的上传规格。

模型微调

LlamaFactory 显存档位对照

把官方硬件表的具名列原值与通用列公式值并排算出来。README 自己标了 * estimated,而两套口径 24 个格子逐格对不上——工具把差值摆出来,不替官方判断哪个算数,也不做「你的卡够不够」。

模型微调

dataset_info.json 校验器

按官方字段规格逐条查数据集描述:四个来源字段的覆盖链、formatting 与列的搭配、ranking 与偏好列、tags 只用于 sharegpt。纯前端不上传,只校验字段组合,不碰你的数据文件。

AI 视频

OpenMontage 双闸自检

幻灯片风险六维评分(0-5 分、四档判定)、八种交付承诺的动效比例比对、预算三键测算。阈值与规则表照抄源码,但打分由你自己给——上游那六个私有打分函数我们没读过,不复刻。

这几个工具是按什么顺序用的

前五个是同一条决策链上的五步,后三个是遇到具体问题时的专项工具。 先用 token 计算器把你真实的 prompt 粘进去,知道单次请求有多大; 再用 月成本估算器乘上日调用量,得到一个能拿去排预算的月成本; 如果数字不能接受,去 上下文长度计算器看看是不是上下文塞太多; 确定要换模型时,用 价格对比表看单价、用 横向对比把候选并排放一起看。

后三个按症状选:账单没问题但老被限流,用并发与限流计算器 看瓶颈是 RPM 还是 TPM;请求前缀很长且高频调用,用提示缓存节省计算器 算这项优化值不值得做;做的是多轮对话产品,用多轮会话成本模拟器 看历史策略怎么把平方级的成本曲线压成线性。

另外三个是针对具体成本结构的:请求前缀重复度高,用 提示缓存节省计算器算开缓存能省多少; 做多轮对话产品,用多轮会话成本模拟器看历史策略怎么把平方级增长压成线性; 担心限流或要排容量,用并发与限流计算器从 RPM/TPM 倒推该开多少并发。

后三个是专项工具,遇到对应问题时再用:撞限流、并发不知道开多大,用 并发与限流计算器从额度倒推容量; 想知道开提示缓存到底能省多少、值不值得改造,用 提示缓存节省计算器; 做多轮对话产品、发现聊得越久越贵,用 多轮会话成本模拟器对比三种历史策略的成本曲线。

价格数据的收录纪律

这几个工具共用一份价格数据,收录规矩只有一条:只写能在厂商官方定价页上逐字查到的数字, 每一行必须带官方链接和核对日期,核不到出处的宁可空着。 所以表里不会出现核不到出处的厂商,但每个数字你都能自己点开验。 价格按各厂商官方定价页的原文币种记录(海外美元、国内人民币),不做折算后再存; 需要跨币种比较时由工具按明示汇率折算,且只影响排序与估算,不改写官方原价。 最近一次逐条核对是 2026-08-09。

另外,全部计算都在你自己的浏览器里跑,粘进去的文本不会上传到任何服务器。 需要精确到账单级的数字时,请以 API 响应里的 usage 字段和厂商官方定价为准, 这里给的是量级判断。

算完账,接着学怎么接

各家 API 的密钥申请、SDK 调用、计费口径与报错排查,奇连 AI 按厂商逐篇写好了。

去学习中心