RAG Pipeline
Definition
Eine RAG Pipeline ist die Verkettung von Komponenten fuer Retrieval-Augmented Generation: Dokumenten-Ingestion, Chunking, Embedding, Vector-DB-Speicherung, Retrieval und LLM-Generierung. Jeder Schritt kann optimiert werden. Moderne RAG-Pipelines nutzen Re-Ranking und Hybrid Search.
Beispiel
Eine typische RAG-Pipeline mit LangChain umfasst PDF-Parser, OpenAI-Embeddings, Pinecone und GPT-5.
Verwandte Begriffe
Mehr aus “AI/ML”
Neural Network (Neuronales Netz)
Ein Neural Network ist ein vom menschlichen Gehirn inspiriertes KI-Modell aus verbundenen Knoten (Neuronen) in Schichten. Es lernt aus Daten, indem es Gewichte anpasst. Tiefe Netzwerke (Deep Learning) mit vielen Schichten koennen extrem komplexe Muster erkennen.
MLX (Apple ML Framework)
MLX ist Apples Open-Source-Machine-Learning-Framework, speziell fuer Apple Silicon optimiert. Es nutzt Unified Memory und die Neural Engine effizient. MLX ermoeglicht das Training und die Inferenz von LLMs auf Macs mit bisher unerreichter Effizienz.
Embedding (Vektor-Repraesentation)
Ein Embedding ist die Darstellung von Daten als Vektor aus Zahlen, wobei aehnliche Inhalte nahe beieinander liegen. Embeddings sind die Grundlage fuer semantische Suche, Empfehlungssysteme und RAG. Sie werden von speziellen Modellen wie text-embedding-3 erzeugt.
TOPS (Tera Operations Per Second)
TOPS ist die Messeinheit fuer die KI-Rechenleistung eines Prozessors. Ein TOPS entspricht einer Billion Operationen pro Sekunde. Microsofts Copilot+ Standard erfordert mindestens 40 TOPS. Haeufigere TOPS bedeuten jedoch nicht automatisch bessere AI-Performance.