AI/ML

FP16 (Half Precision)

Definition

FP16 (16-bit Floating Point) ist das Standardformat fuer KI-Training und Inferenz. Es bietet ausreichend Praezision fuer die meisten Modelle bei halbem Speicherbedarf gegenueber FP32. Tensor Cores sind fuer FP16 optimiert.

Beispiel

FP16-Training ist 2-3x schneller als FP32 auf Tensor-Core-GPUs.