01:13
2026-10-02
github.com
large-language-models
KernelBench: Can LLMs Write GPU Kernels? – Benchmark and Toolkit, Torch –> CUDA
Stanford's Scaling Intelligence lab released KernelBench, a benchmark and toolkit for evaluating whether large language models can generate correct and efficient CUDA kernels from PyTorch programs, wi…