2026
KernelBand: Steering LLM-based Kernel Optimization via Hardware-Aware Multi-Armed Bandits
ICML 2026poster
High-performance GPU kernels are critical for efficient LLM serving, yet their optimization remains a bottleneck requiring deep system expertise. While code LLMs show promise in generating functionally correct code, kernel optimization is intrinsically a search problem over a vast optimization space…