AI/ML

Triton (GPU Programming)

Definition

Triton ist eine von OpenAI entwickelte Programmiersprache fuer GPU-Kernel. Sie ermoeglicht Entwicklern, hochperformante GPU-Kernel in Python-Syntax zu schreiben, ohne CUDA-Experten zu sein. Triton wird in PyTorch 2.0 und Flash Attention verwendet.

Beispiel

Flash Attention 3 nutzt Triton, um Attention 2x schneller als die CUDA-Implementierung zu machen.