thinkdial-reasoning-effort-control - ThinkDial:控制大语言模型推理力度推理预算令牌压缩可控推理预算感知训练★ 6 · 更新于 2026-10-01通过预算感知微调和自适应奖励塑形,使用高、中、低模式控制大语言模型的推理力度。⚙ 定义离散推理模式⚙ 设置令牌预算⚙ 执行预算感知监督微调
tokenranger - 使用 TokenRanger 压缩 LLM 上下文性能优化云端大模型上下文压缩令牌优化★ 816 · 更新于 2026-03-20通过本地 Ollama 小型语言模型压缩会话上下文,再发送到云端大模型⚙ 安装插件⚙ 设置侧车⚙ 配置参数