Show HN:MCP-compress-router —— MCP 压缩路由器
当连接多个 MCP 服务器时,每次向 LLM 发起请求都会包含所有工具及其描述,这会迅速消耗 token 限额并增加成本。mcp-compress-router 通过代理所有 MCP 服务器,仅暴露两个工具(get_tool_schema 和 invoke_tool)来解决这一问题。在"最大"压缩级别下,三个 MCP 服务器的开销可从约 26K tokens 压缩至 900 tokens,节省超过 90% 的 token 消耗。
背景速读
MCP(Model Context Protocol)是 AI 模型与外部工具通信的开放协议,由 Anthropic 于 2024 年底推出。LLM 每次对话要将所有可用工具的完整描述(名称、参数、说明)一起发送,工具数量越多,token 消耗越大,成本也越高。
这个项目是一个"路由压缩器"——它在 LLM 与多个 MCP 服务器之间加了一层代理,把原本全量发送的工具清单精简为两层调用:先问"有什么工具"(只返回名称和参数列表),等 LLM 真正确定要用哪个工具时,再去拿该工具的完整描述。这样避免了每轮对话都传输数百乃至上千行的工具 JSON Schema。
以三个常见 MCP 服务器(Notion、GitHub、Python 语言服务器)为例,原始开销约 26K tokens/轮,用默认压缩后可降至约 2K tokens,节省超过 90%。对于高频调用场景(如编码助手),token 成本可以大幅降低。