view article Article The Transformers modeling backend serves DeepSeek-R1 at native speed hmellor • Aug 4 • 2
view article Article The Transformers modeling backend is now as fast as native vLLM hmellor • Jul 17 • 1