按目标厂商的计量规则做工程级压缩,压缩前后 token 对比清晰可见
四层管线:格式规范化、词汇去冗余、近重复消除、TextRank 关键句抽取,默认深度压缩可省 50%+。
按厂商切片规则重采样到语义可分辨的最小分辨率,GPT-4o / Claude / Gemini / Qwen-VL / 豆包全覆盖。
16kHz 单声道重采样 + 静音段裁剪,时长缩短比例即 token 节省比例。
帧率降采样 + 分辨率重采样 + 音轨精简,支持 2GB 大文件分片上传与异步任务。
PDF / DOCX / TXT / Markdown / HTML,DOCX 内嵌图片自动提取压缩,产物打包 zip。
/v1/chat/completions 直接接入,可上架 new-api 类中转平台,按节约 token 计量计费。
只为真正省下的 token 付费
压缩完成后,系统按本次节约的 token 数结算:例如本次节约 50 万 token,费用 = 50万 ÷ 100万 × ¥2 = ¥1。余额不足时返回 402 与充值入口。
new-api 上架建议:网关上报 usage.prompt_tokens = 节约 token 数,模型倍率设为 0.14(倍率 1 ≈ $2/1M)即等价 ¥2/百万节约 token。
登录 TOKEN GO 账户后即可测试,压缩前后 token 实时对比
余额、用量、消费记录实时可查
| 时间 | 模态 | 模型 | 原始 token | 压缩后 | 节约 | 金额(¥) |
|---|
平台用户、数据与经营报表