Show HN:Turo – 面向 CLI AI 代理的激进令牌节省代理
Turo 是一款激进的令牌节省代理,通过删除填充词、替换同义词并精简为内容词来缩减 CLI AI 代理的提示大小,提供多种压缩级别,包括文言模式(wenyan)。它可以作为代理集成或直接与支持的代理运行,最多可减少 70% 的令牌成本。
Turo 是一个专为 CLI AI 代理设计的激进令牌节省代理。它通过删除填充词、替换同义词以及将文本缩减为仅保留内容词的方式,大幅减少发送给 AI 模型的令牌数量。支持多种压缩级别:lite(保留形容词、名词、动词及部分副词/介词,减少约65%)、full(保留形容词、名词、动词,减少约70%)、ultra(默认,仅保留名词和动词,并按词元去重,减少70%以上)以及 wenyan(文言模式,在 ultra 基础上将每个英文内容词替换为一个文言汉字,仅适用于 CJK 分词器模型)。安装方式包括 Homebrew、Go 或一键脚本。使用 turo run 可启动支持的代理并自动配置代理。此外,Turo 还可作为独立代理运行,监听本地端口并压缩所有通过它的请求。其压缩流程分为四个阶段:删除填充词、替换便宜的同义词、替换定义词、缩减为内容词,并可重复直至收敛。同步替换(默认开启)使用从 WordNet 构建的词汇表,将单词替换为更少令牌的同义词。箭头替换(可选)将多词因果连接词替换为 ->。wenyan 模式在 Qwen、DeepSeek 等模型上可将 766 字符的段落压缩至 69 字符(约42令牌),而在 OpenAI 模型上效果较差。集成方面,npx turo 可自动检测并注册到多种编码代理。Turo 不会修改代码块、URL、文件路径等关键信息。Turo 的代理模式允许用户通过设置环境变量将任何 CLI 代理的请求路由到 Turo。例如,使用 turo -proxy -upstream https://api.openai.com 启动代理,然后设置 OPENAI_BASE_URL 指向本地代理。仅用户和工具内容会被压缩,系统和助手历史保持不变。此外,Turo 还提供 turo run 命令,一键启动并配置 Claude Code、Codex 等代理。通过 npx turo 可以安装二进制文件并自动注册到检测到的代理。对于已经安装在 PATH 中的 Turo,任何代理都可以通过管道将上下文传递给它。默认压缩级别为 ultra,可通过 TURO_LEVEL 环境变量调整。wenyan 模式使用约380个手工挑选的文言汉字映射,仅适用于 Qwen、DeepSeek、GLM 等 CJK 分词器模型。在 ultra 级别下,单词的屈折形式会被还原为词元,但仅限于真实词典中的单词。Turo 是开源项目,托管在 GitHub 上,社区可以扩展其词汇表。总之,Turo 为频繁使用 AI 的开发者提供了一种灵活且高效的令牌节省方案。