tokenranger - 使用 TokenRanger 压缩 LLM 上下文性能优化云端大模型上下文压缩令牌优化★ 816 · 更新于 2026-03-20通过本地 Ollama 小型语言模型压缩会话上下文,再发送到云端大模型⚙ 安装插件⚙ 设置侧车⚙ 配置参数
context-optimization - 通过压缩、掩码和缓存优化AI代理上下文上下文管理令牌优化性能内存效率★ 211 · 更新于 2026-02-23通过压缩、掩码、缓存和分区技术扩展有效上下文容量⚙ 压缩消息历史⚙ 掩码工具观察⚙ 优化KV缓存