Transformer Modell

Was ist ein Transformer Modell? Ein Transformer Modell ist eine KI-Architektur zur Verarbeitung natürlicher Sprache. Es bildet die technische Grundlage moderner Large Language Models wie GPT, Llama oder Gemini. Warum ist das Transformer Modell so wichtig? Vor der Einführung von Transformern wurden Sprachmodelle meist mit rekurrenten neuronalen Netzen (RNNs) trainiert. Transformer-Modelle ermöglichten erstmals: parallele […]
Chain of Thought (in KI)

Was ist Chain of Thought (in Künstliche Intelligenz)? Chain of Thought (CoT) bezeichnet eine Prompting-Technik, bei der ein KI-Modell aufgefordert wird, seine gedanklichen Zwischenschritte strukturiert darzustellen. Wie funktioniert Chain of Thought mit Artificial Intelligence? Statt nur eine direkte Antwort zu generieren, wird das Modell angewiesen: „Denke Schritt für Schritt.“ Das Modell zerlegt die Aufgabe in […]
Zero-Shot Learning

Was ist Zero-Shot Learning? Zero-Shot Learning bezeichnet eine Methode, bei der ein KI-Modell eine Aufgabe ausführt, ohne zuvor konkrete Beispiele im Prompt erhalten zu haben. Wie funktioniert Zero-Shot Learning? Das Modell nutzt sein vortrainiertes Wissen aus großen Datensätzen. Es erhält lediglich eine Anweisung, zum Beispiel: „Fasse folgenden Text zusammen.“ Das Modell greift auf seine […]