TokenPress多模态 Token 压缩引擎

面向 GPT / Claude / Gemini / Kimi / DeepSeek / 通义千问等主流大模型 —— 文本 · 图像 · 音频 · 视频一键压缩,输入输出效果不变,Token 更省

文本压缩
文档压缩
图像压缩
音频压缩
视频压缩
API 一键接入

输入文本

压缩结果

压缩结果将显示在这里…

四层压缩管线:L1 格式规范化 → L2 词汇去冗余 → L4 近重复消除 → L3 关键句抽取(TextRank + 指令感知锚定),关键信息不足时自动回退保全文。

上传图像(视觉模型按分辨率/切片计 image tokens,重采样到语义所需最小分辨率即可省 token)

点击选择或拖拽图像到这里

上传音频(语音模型按时长计 tokens:16kHz 单声道重采样 + 静音裁剪,可懂内容不变)

点击选择或拖拽音频到这里

上传视频(视频理解按“抽帧数 × 单帧 tokens”计费:降帧采样 + 分辨率重采样 + 音轨精简;支持大文件,最高 2GB)

点击选择或拖拽视频到这里(MP4 / MOV / MKV / AVI / WebM / MXF 等大格式均可)

大文件(>24MB)自动切换分片上传(8MB/片 · 并发3 · 失败自动重试),可过任意网关,服务端最高支持 2GB;视频压缩走异步任务,按钮实时显示耗时,长视频不受网关超时影响。

提示:Seedance 系列(豆包视频生成)按输出视频 token 计费(宽×高×帧率×时长/1024),输入视频只占“时长”一项,画面压缩无计费收益;压缩适用于上方各类视觉理解模型(含豆包 Seed-Vision)。

上传文档(PDF / DOCX / TXT / Markdown / HTML → 提取文本层 → 四层语义压缩,产物为可直接投喂大模型的纯文本)

点击选择或拖拽文档到这里(PDF / DOCX / TXT / MD / HTML)

多模态输入中的文档建议先压缩再投喂:提取正文 → 断行修复 → TextRank 关键句抽取,token 通常可省 35%~55%。扫描件 PDF 无文本层,需先 OCR。超长文档自动按段落分块压缩。

① 申请 API Key(免费)

② 接口一览

POST/v1/compress/text文本 token 压缩
POST/v1/compress/document文档压缩(PDF / DOCX / TXT / MD / HTML → 纯文本)
POST/v1/compress/image图像压缩(multipart,返回文件 + X-Tp-* 统计头)
POST/v1/compress/audio音频压缩(16k 单声道 + 去静音)
POST/v1/compress/video视频压缩(降帧 + 重采样)
POST/v1/chat/completionsOpenAI 兼容压缩转发网关
GET/v1/models计量系数表与计费规则
GET/v1/usage用量与额度查询(X-API-Key)
POST/v1/admin/recharge充值 token 包(运营端,X-Admin-Token)

③ 调用示例

文本压缩(curl)复制


      

图像压缩(curl)复制


      

Python SDK 零改动接入网关复制