★ 6 · Updated 2026-09-21
Generate multiple tokens simultaneously by having late transformer layers directly predict multiple outputs after early layer processing.
Browse skills that use this input.
★ 6 · Updated 2026-09-21
Generate multiple tokens simultaneously by having late transformer layers directly predict multiple outputs after early layer processing.
★ 650 · Updated 2026-02-14
Deploy fine-tuned models for production inference with optimized kernels and serving engines.