DistilBERT
Definition
DistilBERT ist eine komprimierte Version von BERT, die durch Knowledge Distillation erstellt wurde. Sie hat 40% weniger Parameter und ist 60% schneller, behaelt aber 97% der Sprachverstaendnis-Leistung. DistilBERT ist ein Paradebeispiel fuer effizientes Model Compression.
Beispiel
DistilBERT kann auf einem Raspberry Pi 4 mit akzeptabler Geschwindigkeit ausgefuehrt werden.
Mehr aus “AI/ML”
TOPS (Tera Operations Per Second)
TOPS ist die Messeinheit fuer die KI-Rechenleistung eines Prozessors. Ein TOPS entspricht einer Billion Operationen pro Sekunde. Microsofts Copilot+ Standard erfordert mindestens 40 TOPS. Haeufigere TOPS bedeuten jedoch nicht automatisch bessere AI-Performance.
Federated Learning
Federated Learning trainiert KI-Modelle dezentral auf mehreren Geraeten, ohne Daten zu teilen. Jedes Geraet trainiert lokal und sendet nur Modell-Updates an einen zentralen Server. Dies schuetzt die Privatsphaere und wird von Google und Apple eingesetzt.
Neural Network (Neuronales Netz)
Ein Neural Network ist ein vom menschlichen Gehirn inspiriertes KI-Modell aus verbundenen Knoten (Neuronen) in Schichten. Es lernt aus Daten, indem es Gewichte anpasst. Tiefe Netzwerke (Deep Learning) mit vielen Schichten koennen extrem komplexe Muster erkennen.
INT8 (8-bit Integer)
INT8 ist das am haeufigsten verwendete Quantisierungsformat fuer KI-Inferenz. Es bietet eine gute Balance zwischen Praezision und Effizienz. Die meisten NPUs sind auf INT8 optimiert, und TOPS-Werte werden typischerweise fuer INT8 angegeben.