Tagged "kernel-optimization"
- llama.cpp Build 10605: Mamba2 GEMM Optimization Improves State-Space Model Performance
- vLLM v0.27.0 Released with Major Kernel Improvements and New Model Support
- vLLM v0.27.0 Brings Major Performance Improvements and New Model Support
- How To Build Your Own LLM Runtime From Scratch
- Is Anyone Working on an AI Operating System?
- Qwen3.5-397B Achieves 282 tok/s on 4x RTX PRO 6000 Blackwell Through Custom CUTLASS Kernel