thinkdial-reasoning-effort-control - ThinkDial:控制大语言模型推理力度推理预算令牌压缩可控推理预算感知训练★ 6 · 更新于 2026-10-01通过预算感知微调和自适应奖励塑形,使用高、中、低模式控制大语言模型的推理力度。⚙ 定义离散推理模式⚙ 设置令牌预算⚙ 执行预算感知监督微调
logit-lens - 解码中间层预测模型解释层分析预测可视化transformer 分析★ 650 · 更新于 2026-03-10将中间层激活解码为词汇预测⚙ 解码中间层预测⚙ 应用层归一化⚙ 应用 unembedding head
unsloth-inference - 部署微调模型用于生产推理推理模型部署优化服务★ 22 · 更新于 2026-02-15使用优化内核、vLLM或SGLang部署微调模型进行生产推理⚙ 加载微调模型⚙ 启用优化内核⚙ 合并LoRA权重