Welches Modell sollst du nehmen?
Jedes KI-Tool drückt dir heute ein Modell-Menü in die Hand. Die Namen sind Rauschen. Diese Seite sortiert die Modelle, die ich wirklich nutze, nach der Aufgabe, die du erledigen willst, und sagt dir, wo du jedes findest.
Dirigieren
Die Architekten-Stufe: die Arbeit planen, den Ansatz entwerfen und dann günstigere Modelle ausführen lassen, für jedes Teilstück das passende. Im Moment übernimmt Claude Opus diesen Job für fast alles; Fable bringt nur bei sehr grossen, lang laufenden Aufgaben etwas Vorsprung. Ich erwarte, dass sich das mit dem nächsten Fable-Release wieder dreht.
3 Modelle
Claude Opus
Fast alles: Planung, tiefes Reasoning, Schreiben, Recherche und komplexes agentisches Coding. Fable bringt nur bei sehr grossen, lang laufenden Aufgaben einen Vorsprung.
- Kontext
- 1M tokens
- Preis
- $4 / $20
- Tempo
- Moderat
Claude Fable
Sehr grosse, lang laufende agentische Aufgaben, bei denen ein kleiner Vorsprung gegenüber Opus 5.5 den zweieinhalbfachen Preis wert ist.
- Kontext
- 1M tokens
- Preis
- $10 / $50
- Tempo
- Langsam
GPT-6 Astra
Arbeit, bei der die Antwort beim ersten Mal stimmen muss und die Token-Rechnung nicht die Einschränkung ist.
- Kontext
- 1.05M tokens
- Preis
- $10 / $50
- Tempo
- Moderat
| Modell | Am besten für | Kontext | PreisEingabe / Ausgabe pro Mio. Tokens | Tempo | Wo | Bewertung |
|---|---|---|---|---|---|---|
| Claude Opus Fabians Wahl Anthropic | Fast alles: Planung, tiefes Reasoning, Schreiben, Recherche und komplexes agentisches Coding. Fable bringt nur bei sehr grossen, lang laufenden Aufgaben einen Vorsprung. | 1M tokens | $4 / $20 | Moderat | Claude, Claude Code, Claude Cowork, Perplexity Computer, Poe | |
| Claude Fable Anthropic | Sehr grosse, lang laufende agentische Aufgaben, bei denen ein kleiner Vorsprung gegenüber Opus 5.5 den zweieinhalbfachen Preis wert ist. | 1M tokens | $10 / $50 | Langsam | Claude, Poe, Claude Code | |
| GPT-6 Astra OpenAI | Arbeit, bei der die Antwort beim ersten Mal stimmen muss und die Token-Rechnung nicht die Einschränkung ist. | 1.05M tokens | $10 / $50 | Moderat | ChatGPT, OpenAI Codex, Poe, OpenRouter |
Denken
Starkes Reasoning für harte Probleme: Strategie, Analyse, die Entscheidungen, bei denen die Qualität des Denkens alles Weitere bestimmt. Claude Opus ist hier mein Standard und für fast alles andere auch. GPT-6 gehört mit seiner Sol-Stufe hierher.
3 Modelle · Warum «teuer denken, günstig ausführen» →
Claude Opus
Fast alles: Planung, tiefes Reasoning, Schreiben, Recherche und komplexes agentisches Coding. Fable bringt nur bei sehr grossen, lang laufenden Aufgaben einen Vorsprung.
- Kontext
- 1M tokens
- Preis
- $4 / $20
- Tempo
- Moderat
Gemini Pro
Die Analyse riesiger Datensätze, ganzer Codebases oder stundenlanger Videodateien.
- Kontext
- 2M tokens
- Preis
- $1.25 / $10
- Tempo
- Moderat
GPT-6
Stufen: Sol · Luna
Ausführung im grossen Stil: Sol, wenn die Aufgabe schwierig ist oder Fehler teuer sind, Luna für Volumenarbeit, bei der Tempo und Preis am meisten zählen.
- Kontext
- 1.05M tokens
- Preis
- Sol $2 / $10 · Luna $0.10 / $0.50
- Tempo
- Schnell
| Modell | Am besten für | Kontext | PreisEingabe / Ausgabe pro Mio. Tokens | Tempo | Wo | Bewertung |
|---|---|---|---|---|---|---|
| Claude Opus Fabians Wahl Anthropic | Fast alles: Planung, tiefes Reasoning, Schreiben, Recherche und komplexes agentisches Coding. Fable bringt nur bei sehr grossen, lang laufenden Aufgaben einen Vorsprung. | 1M tokens | $4 / $20 | Moderat | Claude, Claude Code, Claude Cowork, Perplexity Computer, Poe | |
| Gemini Pro Google | Die Analyse riesiger Datensätze, ganzer Codebases oder stundenlanger Videodateien. | 2M tokens | $1.25 / $10 | Moderat | Gemini, Poe, Google AI Studio | |
| GPT-6 OpenAI · Sol · Luna | Ausführung im grossen Stil: Sol, wenn die Aufgabe schwierig ist oder Fehler teuer sind, Luna für Volumenarbeit, bei der Tempo und Preis am meisten zählen. | 1.05M tokens | Sol $2 / $10 · Luna $0.10 / $0.50 | Schnell | ChatGPT, OpenAI Codex, Poe, OpenRouter |
Ausführen
Die Arbeitspferde. Entwürfe, Code, Formatierung, Zusammenfassungen, Agenten, die den ganzen Tag laufen. Von Hand wähle ich diese Modelle kaum noch: Am besten arbeiten sie als Subagenten, wenn ihnen ein stärkeres Modell einen klar umrissenen Job übergibt. GPT-6 kommt hier in zwei Stufen, Sol für die anspruchsvollere Arbeit und Luna für Volumen.
8 Modelle
Claude Sonnet
Klar umrissene Coding-, Schreib- und Recherche-Jobs, die ihm Opus oder Fable als Subagent übergeben, und API-Arbeit mit hohem Volumen.
- Kontext
- 1M tokens
- Preis
- $2 / $10
- Tempo
- Schnell
GPT-6
Stufen: Sol · Luna
Ausführung im grossen Stil: Sol, wenn die Aufgabe schwierig ist oder Fehler teuer sind, Luna für Volumenarbeit, bei der Tempo und Preis am meisten zählen.
- Kontext
- 1.05M tokens
- Preis
- Sol $2 / $10 · Luna $0.10 / $0.50
- Tempo
- Schnell
GLM-5.3-Flash
Für einen Assistenten oder Agenten, der den ganzen Tag über Tool-Aufrufe arbeitet, wo die Kosten pro Aufgabe wichtiger sind als Persönlichkeit.
- Kontext
- 1M tokens
- Preis
- $0.15 / $0.50
- Tempo
- Schnell
Qwen3.7-Max
Komplexe, mehrstufige agentische Programmieraufgaben.
- Kontext
- 1M tokens
- Preis
- ~$0.65 / $3.25
- Tempo
- Moderat
DeepSeek V4 Flash
Reasoning-Aufgaben mit hohem Volumen, bei denen Kosteneffizienz entscheidend ist.
- Kontext
- 1M tokens
- Preis
- $0.14 / $0.28
- Tempo
- Schnell
Gemini Flash
Ausführungsarbeit mit hohem Volumen: Coding, Agenten, Texte und alles, wo Geschwindigkeit und Preis wichtiger sind als maximale Intelligenz.
- Kontext
- 1M tokens
- Preis
- $0.75 / $3.75
- Tempo
- Sofort
Grok 4.7
Der Einsatz in Grok Bot und ein Blick darauf, was die Leute auf X gerade über ein Thema sagen.
- Kontext
- 500K tokens
- Preis
- $2 / $6
- Tempo
- Moderat
Claude Haiku
Ein Subagent, der für ein stärkeres Modell grosse Dokumentsammlungen durchsucht.
- Kontext
- 200K tokens
- Preis
- $1 / $5
- Tempo
- Sofort
| Modell | Am besten für | Kontext | PreisEingabe / Ausgabe pro Mio. Tokens | Tempo | Wo | Bewertung |
|---|---|---|---|---|---|---|
| Claude Sonnet Fabians Wahl Anthropic | Klar umrissene Coding-, Schreib- und Recherche-Jobs, die ihm Opus oder Fable als Subagent übergeben, und API-Arbeit mit hohem Volumen. | 1M tokens | $2 / $10 | Schnell | Claude, Poe, Perplexity, Claude Code | |
| GPT-6 OpenAI · Sol · Luna | Ausführung im grossen Stil: Sol, wenn die Aufgabe schwierig ist oder Fehler teuer sind, Luna für Volumenarbeit, bei der Tempo und Preis am meisten zählen. | 1.05M tokens | Sol $2 / $10 · Luna $0.10 / $0.50 | Schnell | ChatGPT, OpenAI Codex, Poe, OpenRouter | |
| GLM-5.3-Flash Zhipu AI (Z.ai) | Für einen Assistenten oder Agenten, der den ganzen Tag über Tool-Aufrufe arbeitet, wo die Kosten pro Aufgabe wichtiger sind als Persönlichkeit. | 1M tokens | $0.15 / $0.50 | Schnell | OpenClaw, OpenRouter | |
| Qwen3.7-Max Alibaba Cloud | Komplexe, mehrstufige agentische Programmieraufgaben. | 1M tokens | ~$0.65 / $3.25 | Moderat | Poe, OpenRouter | |
| DeepSeek V4 Flash DeepSeek | Reasoning-Aufgaben mit hohem Volumen, bei denen Kosteneffizienz entscheidend ist. | 1M tokens | $0.14 / $0.28 | Schnell | OpenRouter | |
| Gemini Flash Google | Ausführungsarbeit mit hohem Volumen: Coding, Agenten, Texte und alles, wo Geschwindigkeit und Preis wichtiger sind als maximale Intelligenz. | 1M tokens | $0.75 / $3.75 | Sofort | Gemini, Poe, Google AI Studio, Antigravity | |
| Grok 4.7 xAI | Der Einsatz in Grok Bot und ein Blick darauf, was die Leute auf X gerade über ein Thema sagen. | 500K tokens | $2 / $6 | Moderat | Grok Bot, Poe, OpenRouter | |
| Claude Haiku Anthropic | Ein Subagent, der für ein stärkeres Modell grosse Dokumentsammlungen durchsucht. | 200K tokens | $1 / $5 | Sofort | Claude, Poe |
Live im Web suchen
Modelle mit angeschlossenem Suchindex. Für alles, wo «Stand heute» zählt und du die Quellen willst, nicht eine selbstsichere Vermutung.
2 Modelle
Sonar Pro
Recherche in Echtzeit, Faktenprüfung und das Zusammenführen mehrerer Online-Quellen mit eingebetteten Zitaten.
- Kontext
- 127K tokens
- Preis
- $1 pauschal + Suchgebühren
- Tempo
- Schnell
Grok 4.7
Der Einsatz in Grok Bot und ein Blick darauf, was die Leute auf X gerade über ein Thema sagen.
- Kontext
- 500K tokens
- Preis
- $2 / $6
- Tempo
- Moderat
| Modell | Am besten für | Kontext | PreisEingabe / Ausgabe pro Mio. Tokens | Tempo | Wo | Bewertung |
|---|---|---|---|---|---|---|
| Sonar Pro Fabians Wahl Perplexity | Recherche in Echtzeit, Faktenprüfung und das Zusammenführen mehrerer Online-Quellen mit eingebetteten Zitaten. | 127K tokens | $1 pauschal + Suchgebühren | Schnell | Perplexity | |
| Grok 4.7 xAI | Der Einsatz in Grok Bot und ein Blick darauf, was die Leute auf X gerade über ein Thema sagen. | 500K tokens | $2 / $6 | Moderat | Grok Bot, Poe, OpenRouter |
Lokal auf deinem eigenen Rechner
Open-Weights-Modelle, klein genug für einen Laptop oder eine Workstation. Nichts verlässt das Haus. Schwächer als die Cloud-Stufe, und genau das ist der Deal.
4 Modelle
Gemma 4 27B
Lokales Coding und komplexere Automatisierungsaufgaben auf Workstations.
- Läuft auf
- Einer Workstation
- Preis
- Kostenlos, lokal
- Tempo
- Moderat
Gemma 4 12B
Lokale Automatisierung, Admin-Aufgaben und datenschutzfreundliche Workflows auf einem Laptop.
- Läuft auf
- Einem Laptop
- Preis
- Kostenlos, lokal
- Tempo
- Schnell
GLM-5.3-Flash
Für einen Assistenten oder Agenten, der den ganzen Tag über Tool-Aufrufe arbeitet, wo die Kosten pro Aufgabe wichtiger sind als Persönlichkeit.
- Läuft auf
- 1M tokens
- Preis
- $0.15 / $0.50
- Tempo
- Schnell
DeepSeek V4 Flash
Reasoning-Aufgaben mit hohem Volumen, bei denen Kosteneffizienz entscheidend ist.
- Läuft auf
- 1M tokens
- Preis
- $0.14 / $0.28
- Tempo
- Schnell
| Modell | Am besten für | Läuft auf | Preis | Tempo | Wo | Bewertung |
|---|---|---|---|---|---|---|
| Gemma 4 27B Fabians Wahl Google | Lokales Coding und komplexere Automatisierungsaufgaben auf Workstations. | Einer Workstation | Kostenlos, lokal | Moderat | Hugging Face | |
| Gemma 4 12B Google | Lokale Automatisierung, Admin-Aufgaben und datenschutzfreundliche Workflows auf einem Laptop. | Einem Laptop | Kostenlos, lokal | Schnell | Hugging Face | |
| GLM-5.3-Flash Zhipu AI (Z.ai) | Für einen Assistenten oder Agenten, der den ganzen Tag über Tool-Aufrufe arbeitet, wo die Kosten pro Aufgabe wichtiger sind als Persönlichkeit. | 1M tokens | $0.15 / $0.50 | Schnell | OpenClaw, OpenRouter | |
| DeepSeek V4 Flash DeepSeek | Reasoning-Aufgaben mit hohem Volumen, bei denen Kosteneffizienz entscheidend ist. | 1M tokens | $0.14 / $0.28 | Schnell | OpenRouter |
Bilder erzeugen
Kein Kontextfenster hier, und Preise pro Bild oder pro Monat. Was zählt, ist, worin jedes Modell gut ist.
5 Modelle
GPT-Image-2.5
Kreative Bildarbeit ebenso wie UI-Design: konversationelle Bearbeitung, präzises Inpainting und textlastige Visuals, die lesbar bleiben müssen.
- Gut für
- Bearbeitung, lesbarer Text
- Preis
- $30 / Mio. Bild-Tokens
- Tempo
- Schnell
Nano Banana 2
UI/UX-Screen-Mockups, Infografiken und strukturierte Datenvisualisierung.
- Gut für
- UI-Screens, Infografiken
- Preis
- Gratis-Stufe in Gemini
- Tempo
- Schnell
Midjourney
Concept Art, stilisierte Illustrationen und rein künstlerische Ästhetik.
- Gut für
- Kunst, Stimmung, Stil
- Preis
- $10–120 / Monat
- Tempo
- Moderat
FLUX-2 Pro
Produktionsreifer Fotorealismus und präzise Prompt-Treue.
- Gut für
- Fotorealismus
- Preis
- ~$0.03–0.06 / Bild
- Tempo
- Moderat
Grok Imagine
Kreative, stilisierte oder abstrakte Motive, bei denen du dich vom sterilen KI-Look lösen willst.
- Gut für
- Stilisiert, abstrakt
- Preis
- SuperGrok $30 / Monat
- Tempo
- Schnell
| Modell | Am besten für | Gut für | Preis | Tempo | Wo | Bewertung |
|---|---|---|---|---|---|---|
| GPT-Image-2.5 Fabians Wahl OpenAI | Kreative Bildarbeit ebenso wie UI-Design: konversationelle Bearbeitung, präzises Inpainting und textlastige Visuals, die lesbar bleiben müssen. | Bearbeitung, lesbarer Text | $30 / Mio. Bild-Tokens | Schnell | ChatGPT, Poe | |
| Nano Banana 2 Google DeepMind | UI/UX-Screen-Mockups, Infografiken und strukturierte Datenvisualisierung. | UI-Screens, Infografiken | Gratis-Stufe in Gemini | Schnell | Gemini, Poe | |
| Midjourney Midjourney | Concept Art, stilisierte Illustrationen und rein künstlerische Ästhetik. | Kunst, Stimmung, Stil | $10–120 / Monat | Moderat | Midjourney | |
| FLUX-2 Pro Black Forest Labs | Produktionsreifer Fotorealismus und präzise Prompt-Treue. | Fotorealismus | ~$0.03–0.06 / Bild | Moderat | Poe | |
| Grok Imagine xAI | Kreative, stilisierte oder abstrakte Motive, bei denen du dich vom sterilen KI-Look lösen willst. | Stilisiert, abstrakt | SuperGrok $30 / Monat | Schnell | Grok Imagine |
Videos erzeugen
Bisher zwei Einträge, beide nach Sekunden Filmmaterial bepreist.
2 Modelle
Veo 3.1
Filmreife Aufnahmen in hoher Qualität und realistische Physiksimulation.
- Gut für
- Filmische Shots, Physik
- Preis
- ~$0.05–0.40 / Sek.
- Tempo
- Moderat
Grok Imagine Video
Stilisierte Animationen und schnelle Generierung von Videoclips.
- Gut für
- Stilisierte Clips
- Preis
- ~$0.05–0.14 / Sek.
- Tempo
- Schnell
| Modell | Am besten für | Gut für | Preis | Tempo | Wo | Bewertung |
|---|---|---|---|---|---|---|
| Veo 3.1 Fabians Wahl Google DeepMind | Filmreife Aufnahmen in hoher Qualität und realistische Physiksimulation. | Filmische Shots, Physik | ~$0.05–0.40 / Sek. | Moderat | Veo 3.1, Google AI Studio | |
| Grok Imagine Video xAI | Stilisierte Animationen und schnelle Generierung von Videoclips. | Stilisierte Clips | ~$0.05–0.14 / Sek. | Schnell | Grok Imagine |
Stimme & Musik
Sprache, die Emotion trägt, und ganze Songs mit einer Struktur, die du bestimmst.
2 Modelle
Eleven v3
Voiceovers, Hörbücher und emotionale Dialoge.
- Gut für
- Ausdrucksstarke Sprache
- Preis
- Credits, 1 pro Zeichen
- Tempo
- Schnell
Lyria 3 Pro
Erzeugt vollständige, strukturierte Musikstücke.
- Gut für
- Ganze Songs
- Preis
- ~$0.08 / Song
- Tempo
- Moderat
| Modell | Am besten für | Gut für | Preis | Tempo | Wo | Bewertung |
|---|---|---|---|---|---|---|
| Eleven v3 Fabians Wahl ElevenLabs | Voiceovers, Hörbücher und emotionale Dialoge. | Ausdrucksstarke Sprache | Credits, 1 pro Zeichen | Schnell | ElevenLabs | |
| Lyria 3 Pro Google DeepMind | Erzeugt vollständige, strukturierte Musikstücke. | Ganze Songs | ~$0.08 / Song | Moderat | Lyria |
Kein Modell passt dazu
Versuch den Anbieter (Anthropic, Google) oder ein Tool, das du nutzt (ChatGPT, Poe).
Fehlt ein Modell, auf das du dich verlässt? Sag es mir, und ich nehme es unter die Lupe.