AI/ML

Inference (Inferenz)

Definition

Inference ist die Anwendung eines trainierten KI-Modells auf neue Daten, um Vorhersagen zu generieren. Sie ist weniger rechenintensiv als das Training, erfordert aber dennoch NPUs oder GPUs für Echtzeit-Anwendungen. Edge-Inference findet direkt auf dem Gerät statt.

Beispiel

ChatGPT führt bei jeder Benutzereingabe eine Inference auf NVIDIA H100-GPUs durch.