把「多少钱」算清楚再动手
十七个纯前端小工具,数据不出浏览器,全部不内置厂商价格常量——数字由你从官方页面填入,工具只做算术。
大模型 API 价格对比表
23 个模型、9 家厂商(海外 4 + 国内 5)的输入输出单价横向对比,每行按官方原文币种标注,都带官方定价页链接与核对日期。
API 月成本估算器
填月输入 / 输出 token 用量,按各模型单价算出月成本并自动排序,先判断量级再选型。
token 计算器
粘贴真实 prompt,估算 token 数与调用成本,顺带看清中英文 token 密度差异。
上下文长度计算器
token 数换算成中文字符 / 英文单词量,并算单次调用成本,判断该不该塞长上下文。
模型横向对比
勾选最多 4 个模型并排看单价、上下文、多模态与计费备注,按场景做选型判断。
并发与限流计算器
由 RPM / TPM 额度、单请求大小与耗时,倒推真正的瓶颈、建议并发数与峰值缺口。
提示缓存节省计算器
按固定前缀长度与命中率,算出缓存的月度节省额、实际输入均价与理论收益上限。
多轮会话成本模拟器
对比全量 / 滑窗 / 摘要三种记忆策略下的每轮 token 增长曲线与整场会话成本。
编程 Agent 额度估算器
按每天任务数、每任务步数与每步消耗,估算月额度与真实月成本,并给出该升档还是补超额的分界线。
套餐性价比对比器
把超额算进去再比各档总成本并排序,同时判断这家有没有批量折扣——月费最低的档不一定最省。
团队席位成本测算器
按用量把团队分组配档,对照全员统一档能省多少,并校验是否超出席位上限。
双上限限流模拟器
按任务节奏与并发数,预测你会先撞每分钟频率还是每日总量,并算出升级时两条线各涨多少。
自带密钥成本对比器
把自带密钥省下的加成和你花在管密钥上的时间折到同一个尺度,给出盈亏平衡的管理小时数。
报错分诊器
贴进报错原文,判断属于认证、限流、过载、超时、流中断还是解析崩溃等类型,给出排查方向与该避开的弯路。
积分预算估算器
按任务类型拆开月度消耗,算出缺口、大概几号见底、哪类任务最吃积分,以及换轻模型能省多少。
套餐单位成本计算器
把各档折成每积分单价横向比,识别「大档并不便宜」的情况,并算清年付相对月付的实际折扣。
任务指令生成器
按目标、输入、输出格式、约束四个结构位,配合常用约束模板,拼出一段可直接复制的任务描述。
语音对话延迟预算计算器
把「用户说完到听到回复」拆成配置类等待与算力类耗时两块分别加总,定位真正的大头在哪一段。配置类默认值取自开源流水线的参数默认值,算力类必须你自己实测填入。
本地语音模型体量估算器
按参数量乘每参数字节数,估算 STT、TTS、LLM 三段模型的权重体积下限。只做这一步算术——实际显存占用必然更高,本站不做「你的卡够不够」的判定。
视频导出体积与码率换算器
码率、时长、文件体积三者互算,带 MiB 与 MB 两套单位切换——这正是「算出来和实际对不上」的常见原因。不内置任何平台的上传规格。
LlamaFactory 显存档位对照
把官方硬件表的具名列原值与通用列公式值并排算出来。README 自己标了 * estimated,而两套口径 24 个格子逐格对不上——工具把差值摆出来,不替官方判断哪个算数,也不做「你的卡够不够」。
dataset_info.json 校验器
按官方字段规格逐条查数据集描述:四个来源字段的覆盖链、formatting 与列的搭配、ranking 与偏好列、tags 只用于 sharegpt。纯前端不上传,只校验字段组合,不碰你的数据文件。
OpenMontage 双闸自检
幻灯片风险六维评分(0-5 分、四档判定)、八种交付承诺的动效比例比对、预算三键测算。阈值与规则表照抄源码,但打分由你自己给——上游那六个私有打分函数我们没读过,不复刻。
这几个工具是按什么顺序用的
前五个是同一条决策链上的五步,后三个是遇到具体问题时的专项工具。 先用 token 计算器把你真实的 prompt 粘进去,知道单次请求有多大; 再用 月成本估算器乘上日调用量,得到一个能拿去排预算的月成本; 如果数字不能接受,去 上下文长度计算器看看是不是上下文塞太多; 确定要换模型时,用 价格对比表看单价、用 横向对比把候选并排放一起看。
后三个按症状选:账单没问题但老被限流,用并发与限流计算器 看瓶颈是 RPM 还是 TPM;请求前缀很长且高频调用,用提示缓存节省计算器 算这项优化值不值得做;做的是多轮对话产品,用多轮会话成本模拟器 看历史策略怎么把平方级的成本曲线压成线性。
另外三个是针对具体成本结构的:请求前缀重复度高,用 提示缓存节省计算器算开缓存能省多少; 做多轮对话产品,用多轮会话成本模拟器看历史策略怎么把平方级增长压成线性; 担心限流或要排容量,用并发与限流计算器从 RPM/TPM 倒推该开多少并发。
后三个是专项工具,遇到对应问题时再用:撞限流、并发不知道开多大,用 并发与限流计算器从额度倒推容量; 想知道开提示缓存到底能省多少、值不值得改造,用 提示缓存节省计算器; 做多轮对话产品、发现聊得越久越贵,用 多轮会话成本模拟器对比三种历史策略的成本曲线。
价格数据的收录纪律
这几个工具共用一份价格数据,收录规矩只有一条:只写能在厂商官方定价页上逐字查到的数字, 每一行必须带官方链接和核对日期,核不到出处的宁可空着。 所以表里不会出现核不到出处的厂商,但每个数字你都能自己点开验。 价格按各厂商官方定价页的原文币种记录(海外美元、国内人民币),不做折算后再存; 需要跨币种比较时由工具按明示汇率折算,且只影响排序与估算,不改写官方原价。 最近一次逐条核对是 2026-08-09。
另外,全部计算都在你自己的浏览器里跑,粘进去的文本不会上传到任何服务器。 需要精确到账单级的数字时,请以 API 响应里的 usage 字段和厂商官方定价为准, 这里给的是量级判断。
算完账,接着学怎么接
各家 API 的密钥申请、SDK 调用、计费口径与报错排查,奇连 AI 按厂商逐篇写好了。