多模态 Token 压缩引擎
让每一次大模型调用更省

文本 · 图像 · 音频 · 视频 · 文档,五种模态统一压缩。在模型理解效果不变的前提下减少 token 消耗,按节约量计费,无节省不收费。

5模态全覆盖
¥2每百万节约 token
20万每月免费节省额度
OpenAI接口兼容

五种模态,一套接口

按目标厂商的计量规则做工程级压缩,压缩前后 token 对比清晰可见

📝

文本压缩

四层管线:格式规范化、词汇去冗余、近重复消除、TextRank 关键句抽取,默认深度压缩可省 50%+。

🖼️

图像压缩

按厂商切片规则重采样到语义可分辨的最小分辨率,GPT-4o / Claude / Gemini / Qwen-VL / 豆包全覆盖。

🎵

音频压缩

16kHz 单声道重采样 + 静音段裁剪,时长缩短比例即 token 节省比例。

🎬

视频压缩

帧率降采样 + 分辨率重采样 + 音轨精简,支持 2GB 大文件分片上传与异步任务。

📄

文档压缩

PDF / DOCX / TXT / Markdown / HTML,DOCX 内嵌图片自动提取压缩,产物打包 zip。

🔌

OpenAI 兼容网关

/v1/chat/completions 直接接入,可上架 new-api 类中转平台,按节约 token 计量计费。

简单透明的计费

只为真正省下的 token 付费

固定价格
¥2 / 每百万节约 token
  • 计费口径:压缩前 token − 压缩后 token
  • 无节省不收费
  • 每月 20 万节约 token 免费额度,次月自动重置
  • 先扣免费额度,再扣预存余额
  • 母平台 TOKEN GO 账户余额互通,一处充值两处可用

费用流转

压缩完成后,系统按本次节约的 token 数结算:例如本次节约 50 万 token,费用 = 50万 ÷ 100万 × ¥2 = ¥1。余额不足时返回 402 与充值入口。

new-api 上架建议:网关上报 usage.prompt_tokens = 节约 token 数,模型倍率设为 0.14(倍率 1 ≈ $2/1M)即等价 ¥2/百万节约 token。

完整使用指南

从注册到 API 对接,五分钟跑通全流程

在线测试台

登录 TOKEN GO 账户后即可测试,压缩前后 token 实时对比

账户与消费明细

余额、用量、消费记录实时可查

消费记录

时间模态模型 原始 token压缩后 节约金额(¥)

管理后台

平台用户、数据与经营报表

管理员登录

前往母平台注册

TokenPress 与母平台 TOKEN GO 账户互通。确认后将打开母平台注册页(www.ciyuanjice.com),注册完成后回到本站登录即可,余额自动同步。

登录 TOKEN GO 账户

还没有账号? 前往母平台注册