FP16 (Half Precision)
Definition
FP16 (16-bit Floating Point) ist das Standardformat fuer KI-Training und Inferenz. Es bietet ausreichend Praezision fuer die meisten Modelle bei halbem Speicherbedarf gegenueber FP32. Tensor Cores sind fuer FP16 optimiert.
Beispiel
FP16-Training ist 2-3x schneller als FP32 auf Tensor-Core-GPUs.
Verwandte Begriffe
Mehr aus “AI/ML”
GAN (Generative Adversarial Network)
GANs bestehen aus zwei Neural Networks, die gegeneinander antreten. Ein Generator erzeugt gefaelschte Daten, ein Diskriminator versucht, diese von echten zu unterscheiden. Durch diesen Wettbewerb werden beide besser. GANs werden fuer Deepfakes und Bildgenerierung verwendet.
FP4 (4-bit Floating Point)
FP4 ist ein 4-bit-Gleitkommaformat, das von NVIDIA mit der RTX-50-Serie eingefuehrt wurde. Es halbiert den Speicherbedarf gegenueber INT8 und ermoeglicht extrem schnelle AI-Inferenz. Die 5. Generation der Tensor Cores unterstuetzt FP4 nativ.
Triton (GPU Programming)
Triton ist eine von OpenAI entwickelte Programmiersprache fuer GPU-Kernel. Sie ermoeglicht Entwicklern, hochperformante GPU-Kernel in Python-Syntax zu schreiben, ohne CUDA-Experten zu sein. Triton wird in PyTorch 2.0 und Flash Attention verwendet.
AGI (Artificial General Intelligence)
AGI bezeichnet eine KI, die kognitive Faehigkeiten auf menschlichem Niveau in allen Bereichen erreicht. Anders als schmale KI (Narrow AI) kann AGI jede intellektuelle Aufgabe erlernen, die ein Mensch erlernen kann. Ob AGI erreicht wurde, ist unter Experten umstritten.