Constitutional AI
Definition
Constitutional AI ist eine von Anthropic entwickelte Trainingsmethode, bei der ein LLM anhand einer 'Verfassung' von Prinzipien sich selbst korrigiert. Das Modell bewertet seine eigenen Antworten und ueberarbeitet sie. Claude wurde mit dieser Methode trainiert.
Beispiel
Claude lehnt Anfragen ab, die gegen seine Verfassung verstossen, wie z.B. Anleitungen zur Herstellung von Waffen.
Verwandte Begriffe
Mehr aus “AI/ML”
AI Agent
Ein AI Agent ist ein KI-System, das eigenstaendig Aufgaben plant und ausfuehrt, indem es Tools, APIs und Datenquellen nutzt. Es bricht komplexe Anfragen in Teilschritte herunter und kann Code schreiben, Web-Recherche betreiben und Entscheidungen treffen.
Transformer (Architektur)
Die Transformer-Architektur wurde 2017 von Google eingefuehrt und ist die Grundlage aller modernen LLMs. Sie nutzt Self-Attention-Mechanismen, um Beziehungen zwischen allen Tokens gleichzeitig zu erfassen. Dadurch sind Transformer stark parallelisierbar und skalierbar.
Alignment (KI-Ausrichtung)
Alignment beschreibt die Ausrichtung von KI-Systemen auf menschliche Werte und Ziele. Ein gut ausgerichtetes KI-System tut, was Menschen wollen, ohne schaedliche Nebenwirkungen. RLHF und Constitutional AI sind wichtige Alignment-Techniken.
Hallucination (KI)
Hallucination beschreibt das Phaenomen, dass ein LLM selbstbewusst falsche oder erfundene Informationen ausgibt. Es entsteht durch statistische Muster im Training, die nicht mit Fakten uebereinstimmen. RAG und bessere Fine-Tuning-Methoden reduzieren Halluzinationen.