Lossless inference speedup benchmarking suite for local LLMs using DeepSeek DSpark speculative draft heads.
pytorch streamlit inference-acceleration ollama speculative-decoding deepseek qwen3 dspark deepspec llm-speedup
-
Updated
Jun 29, 2026 - Python