tokenranger - 使用 TokenRanger 压缩 LLM 上下文
通过本地 Ollama 小型语言模型压缩会话上下文,再发送到云端大模型
标签
更新于: 2026-03-20该技能可以做什么
- 安装插件
- 设置侧车
- 配置参数
- 压缩上下文
- 显示状态
- 切换 GPU 模式
- 切换 CPU 模式
- 禁用压缩
- 列出模型
- 切换插件
- 升级插件
- 卸载插件
- 查看日志
输入
- Ollama 服务地址
- TokenRanger 侧车地址
- 超时时间
- 压缩策略
- 推理模式
- 首选模型
- 最小提示长度
输出
- 压缩上下文
- 状态报告
- 配置详情
- 诊断日志
- 模型列表
要求
- OpenClaw 网关
- Ollama 服务
- GPU 或 CPU
- FastAPI
- LangChain
