Python
如何在不损失质量的前提下降低 LLM Agent 成本
Headroom 是一个开源的本地上下文压缩层,它在信息发送到 LLM 之前拦截信息流,可在不损失准确性的前提下将 token 成本降低 60-95%。
语言
首页语言
板块
Headroom 是一个开源的本地上下文压缩层,它在信息发送到 LLM 之前拦截信息流,可在不损失准确性的前提下将 token 成本降低 60-95%。
jCodeMunch MCP 使用 tree-sitter 为代码库建立索引,只向 AI 编程助手提供相关的代码片段,可将 Token 成本降低 95–99%。