// Wissen
Modelle
KI-Modelle wie GPT-4, Claude, Gemini.
Diese Kategorie beleuchtet aktuelle KI-Modelle, darunter führende Large Language Models wie GPT-5, Google Gemini und Claude Opus. Sie umfasst eine Bandbreite von multimodalen Systemen wie Sora und DALL-E bis zu effizienten On-Device-Modellen wie Phi-3-mini und Gemini Nano. Der Schwerpunkt liegt auf fortgeschrittenem Reasoning, Coding und der Verarbeitung verschiedener Datenformate, ergänzt durch Open-Weights-Alternativen wie Llama 4.
// 35 Modelle · Seite 1/2
// Aktualisiert:
- ↗
Google Gemini
Modelle · 18 Erwähnungen
Google Gemini ist eine Familie multimodaler KI-Modelle von Google für Text, Code, Bild und Audio. Du nutzt sie über die API oder Vertex AI, um große Datensätze zu analysieren oder automatisierte Workflows zu bauen. Ein starker Vorteil ist das Kontextfenster von bis zu zwei Millionen Token.
- ↗
GPT-5
Modelle · 16 Erwähnungen
GPT-5 ist das aktuelle Flaggschiff-Sprachmodell von OpenAI. Es deckt Reasoning, multimodale Eingabe und Tool-Use ab und laeuft als Backend hinter ChatGPT-Pro-Features.
- ↗
Gemini 2.5
Modelle · 5 Erwähnungen
Gemini 2.5 ist eine Familie multimodaler KI-Modelle von Google DeepMind, die 2025 eingeführt wurde. Du nutzt Varianten wie Pro oder Flash für komplexe Programmieraufgaben, Datenanalysen oder Echtzeit-Audio-Interaktionen. Die Modelle bieten ein langes Kontextfenster und steuerbare Denkprozesse (Thinking Budgets).
- ↗
Nano Banana
Modelle · 4 Erwähnungen
Nano Banana ist eine Familie von KI-Bildmodellen von Google DeepMind, die nativ in Gemini integriert sind. Du nutzt sie, um per Texteingabe konsistente Marketing-Assets, Mockups oder Infografiken zu erstellen. Trotz starker Textdarstellung stoßen die Modelle in Standard-Chat-Interfaces oft auf Auflösungs-Limits.
- ↗
Transformer-Modell
Modelle · 4 Erwähnungen
Das Transformer-Modell ist eine 2017 von Google vorgestellte neuronale Netzwerkarchitektur. Du nutzt sie als technisches Fundament für moderne Sprachmodelle wie GPT-4 oder Gemini. Durch den Self-Attention-Mechanismus verarbeitet sie Daten parallel, was das skalierbare Training heutiger KI-Systeme ermöglicht.
- ↗
Haiku
Modelle · 4 Erwähnungen
Haiku ist ein KI-Modell von Anthropic. Im Podcast wird es als schnelles Modell beschrieben, das sich gut für einfachere Aufgaben wie das Verbessern von E-Mails eignet.
- ↗
GPT-4.5
Modelle · 3 Erwähnungen
GPT-4.5 ist ein im Februar 2025 veröffentlichtes Large Language Model von OpenAI, das auf skaliertes unüberwachtes Lernen setzt. Du nutzt es für kreative Textarbeit, Programmierung und Aufgaben mit hohem EQ-Bedarf. Wegen hoher Rechenintensität liegen die API-Preise bei stolzen 75 US-Dollar pro Million Input-Token.
- ↗
Gemini 2.5 Flash
Modelle · 3 Erwähnungen
Gemini 2.5 Flash ist ein multimodales KI-Modell von Google, das auf Geschwindigkeit und Kosteneffizienz optimiert ist. Du nutzt es für Aufgaben mit hohem Durchsatz, wie die Analyse großer Textmengen oder die Datenextraktion aus Transkripten. Es verarbeitet bis zu einer Million Token gleichzeitig.
- ↗
Claude Fable 5
Modelle · 3 Erwähnungen
Claude Fable 5 ist ein im Juni 2026 veröffentlichtes KI-Modell der Mythos-Klasse von Anthropic. Wissensarbeiter nutzen es für komplexe, mehrtägige Programmierprojekte und autonome Agenten-Workflows. Bei potenziell riskanten Anfragen greifen jedoch strenge Sicherheitsfilter, die die Aufgabe automatisch an das Modell Opus 4.8 übergeben.
- ↗
Sora
Modelle · 3 Erwähnungen
Sora ist ein Text-zu-Video-Modell von OpenAI, das aus Text-Prompts realistische Videoszenen generiert. Du nutzt es, um schnell visuelle Prototypen oder Marketing-Clips zu erstellen. Beachte jedoch, dass OpenAI die eigenständige App im April 2026 eingestellt hat und die API im September 2026 abschaltet.
- ↗
Claude Sonnet
Modelle · 2 Erwähnungen
Claude Sonnet ist das Workhorse-Modell von Anthropic — schneller und guenstiger als Opus, staerker als Haiku. Deckt den Grossteil produktiver Anwendungsfaelle ab, von Content bis Code.
- ↗
Claude Opus
Modelle · 2 Erwähnungen
Claude Opus ist eine Familie von High-End-Sprachmodellen des US-Herstellers Anthropic. Du nutzt sie für anspruchsvolles Software-Engineering, komplexe Datenanalysen und mehrstufige KI-Agenten. Sie bieten ein großes Kontextfenster von bis zu einer Million Token, sind jedoch langsamer und teurer.
- ↗
Veo
Modelle · 2 Erwähnungen
Veo ist ein KI-Videogenerierungsmodell von Google DeepMind, das Videos aus Text- und Bild-Prompts erstellt. Du nutzt es in der Content-Erstellung, um filmische Clips mit nativ synchronisiertem Audio zu generieren. Die Version 3.1 bietet erweiterte Kontrollen wie das Kombinieren mehrerer Referenzbilder.
- ↗
Claude Mythos
Modelle · 1 Erwähnung
Claude Mythos ist eine KI-Modellreihe von Anthropic für Cybersicherheit und Softwareentwicklung. Du nutzt sie im Rahmen von Project Glasswing, um kritische Sicherheitslücken in Codebasen automatisiert aufzuspüren. Wegen des Missbrauchspotenzials ist der Zugriff streng limitiert und unterliegt US-Exportkontrollen.
-
GPT-5.6
Modelle
GPT-5.6 ist ein generatives KI-Sprachmodell von OpenAI. Du nutzt es fuer komplexe agentische Coding-Aufgaben und zur Automatisierung von Workflows in Tools wie Microsoft 365 Copilot. Es zeichnet sich durch eine hohe Token-Effizienz aus und kann in der Ultra-Stufe mehrere Agenten parallel koordinieren.
- ↗
Gemini 3.1
Modelle · 1 Erwähnung
Gemini 3.1 ist ein multimodales KI-Modell von Google DeepMind für komplexe Reasoning-Aufgaben. Du nutzt es für anspruchsvolle Softwareentwicklung, Datenanalyse und die Verarbeitung großer Datensätze wie Video oder Audio. Es zeichnet sich durch ein dreistufiges Thinking-System aus.
- ↗
Gemini Nano
Modelle · 1 Erwähnung
Gemini Nano ist ein lokales KI-Modell von Google für mobile Endgeräte und Browser. Du nutzt es, um datenschutzfreundliche Textzusammenfassungen oder Bildbeschreibungen direkt auf Android-Geräten oder in Chrome auszuführen. Die Offline-Verarbeitung spart Cloud-Kosten, erfordert jedoch kompatible Hardware.
- ↗
Phi-3-mini
Modelle · 1 Erwähnung
Phi-3-mini ist ein von Microsoft entwickeltes Small Language Model (SLM) mit 3,8 Milliarden Parametern. Du nutzt das Modell, um KI-Anwendungen wie Chatbots direkt lokal auf Smartphones oder Edge-Geräten auszuführen. Dank optimierter Trainingsdaten bietet es starke Leistung bei logischen Aufgaben ohne Cloud-Zwang.
- ↗
GPT-1
Modelle · 1 Erwähnung
GPT-1 ist das erste Generative Pre-trained Transformer (GPT) Sprachmodell von OpenAI. Es wurde 2018 veröffentlicht und nutzte einen Transformer-Decoder, um durch unüberwachtes Vortraining und anschließendes Fine-Tuning verschiedene NLP-Aufgaben zu lösen. Es legte den Grundstein für die Entwicklung nachfolgender, größerer GPT-Modelle und zeigte das Potenzial von Transfer Learning in der NLP auf.
- ↗
GPT-4.1
Modelle · 1 Erwähnung
GPT-4.1 ist ein großes Sprachmodell von OpenAI, das speziell für Entwickler und anspruchsvolle Programmieraufgaben entwickelt wurde. Du nutzt es über die API, um komplexe Code-Reviews durchzuführen oder lange Dokumente dank des 1-Million-Token-Kontextfensters präzise zu analysieren.
- ↗
Mistral Medium 3.5
Modelle · 1 Erwähnung
Mistral Medium 3.5 ist ein multimodales 128B-Sprachmodell von Mistral AI. Du nutzt es für komplexe agentische Workflows und Programmieraufgaben, wobei du den Reasoning-Aufwand pro Anfrage flexibel steuern kannst. Als Open-Weights-Modell ersetzt es spezialisierte Vorgänger und lässt sich lokal betreiben.
- ↗
DALL-E
Modelle · 1 Erwähnung
DALL-E ist eine Familie von Text-zu-Bild-Modellen von OpenAI, die aus Textbeschreibungen digitale Bilder generieren. Du nutzt es, um visuelle Konzepte, Mockups oder Marketing-Grafiken direkt über ChatGPT oder die API zu erstellen. DALL-E 3 besticht durch hohe Texttreue, stößt bei komplexen Szenen aber an Grenzen.
- ↗
Veo 3
Modelle · 1 Erwähnung
Veo 3 ist ein KI-Videogenerationsmodell von Google DeepMind, das hochauflösende Clips mit nativ erzeugtem Audio erstellt. Du nutzt es, um aus Text- oder Bild-Prompts filmische Szenen inklusive passender Soundeffekte und Dialoge zu generieren. Die maximale Videolänge ist dabei auf acht Sekunden begrenzt.
- ↗
GPT-4
Modelle · 1 Erwähnung
GPT-4 ist ein multimodales Großsprachmodell (LLM) von OpenAI, das im März 2023 veröffentlicht wurde. Du nutzt es für anspruchsvolle Aufgaben wie komplexe Datenanalysen, Code-Generierung oder strategische Textarbeit. Obwohl neuere Modelle wie GPT-4o schneller sind, bleibt es ein robuster Standard für präzise Logik.
- ↗
OpenAI o3
Modelle · 1 Erwähnung
OpenAI o3 ist ein KI-Modell von OpenAI, das für komplexe, mehrstufige Denkprozesse entwickelt wurde. Du nutzt es im Arbeitsalltag, um anspruchsvolle Datenanalysen durchzuführen oder Code-Strukturen automatisiert zu prüfen. Es kann eigenständig Web-Suchen und Code-Ausführungen in seinen Denkprozess integrieren.
- ↗
Gemini 1.0
Modelle · 1 Erwähnung
Gemini 1.0 ist die erste Generation der multimodalen Large Language Models von Google DeepMind. Du nutzt die Modelle via API, um Text, Code, Audio, Bilder und Video in deinen KI-Anwendungen zu verarbeiten. Es wurde von Grund auf nativ multimodal trainiert, anstatt separate Modelle zusammenzufügen.
- ↗
o1
Modelle
o1 ist die Reasoning-Modellfamilie von OpenAI, optimiert fuer mehrstufiges Denken in Mathe, Wissenschaft und Coding. Denkt laenger bevor es antwortet — andere Latenz-Charakteristik als GPT-4-Familie.
- ↗
Gemini 2.5 Pro
Modelle
Gemini 2.5 Pro ist das Flaggschiff-Modell von Google fuer komplexe Tasks — Reasoning, Multi-Step-Planung, Coding. Bietet eines der groessten Context-Windows am Markt.
- ↗
Grok 4
Modelle
Grok 4 ist das aktuelle Modell von xAI (Elon Musks KI-Firma), integriert in X/Twitter. Fokus auf Echtzeit-Web-Zugriff und direkter Persoenlichkeit.
- ↗
Gemini Flash
Modelle
Gemini Flash ist Googles latenz-optimiertes Modell fuer High-Volume-Anwendungen. Eingesetzt wenn Kosten und Response-Time wichtiger sind als maximale Tiefe.