Zum Inhalt springen

Welches Modell sollst du nehmen?

Jedes KI-Tool drückt dir heute ein Modell-Menü in die Hand. Die Namen sind Rauschen. Diese Seite sortiert die Modelle, die ich wirklich nutze, nach der Aufgabe, die du erledigen willst, und sagt dir, wo du jedes findest.

Dirigieren

Die Architekten-Stufe: die Arbeit planen, den Ansatz entwerfen und dann günstigere Modelle ausführen lassen, für jedes Teilstück das passende. Im Moment übernimmt Claude Opus diesen Job für fast alles; Fable bringt nur bei sehr grossen, lang laufenden Aufgaben etwas Vorsprung. Ich erwarte, dass sich das mit dem nächsten Fable-Release wieder dreht.

3 Modelle

Denken

Starkes Reasoning für harte Probleme: Strategie, Analyse, die Entscheidungen, bei denen die Qualität des Denkens alles Weitere bestimmt. Claude Opus ist hier mein Standard und für fast alles andere auch. GPT-6 gehört mit seiner Sol-Stufe hierher.

3 Modelle · Warum «teuer denken, günstig ausführen» →

Ausführen

Die Arbeitspferde. Entwürfe, Code, Formatierung, Zusammenfassungen, Agenten, die den ganzen Tag laufen. Von Hand wähle ich diese Modelle kaum noch: Am besten arbeiten sie als Subagenten, wenn ihnen ein stärkeres Modell einen klar umrissenen Job übergibt. GPT-6 kommt hier in zwei Stufen, Sol für die anspruchsvollere Arbeit und Luna für Volumen.

8 Modelle

Anthropic

Claude Sonnet

Fabians Wahl

Klar umrissene Coding-, Schreib- und Recherche-Jobs, die ihm Opus oder Fable als Subagent übergeben, und API-Arbeit mit hohem Volumen.

Kontext
1M tokens
Preis
$2 / $10
Tempo
Schnell
In Claude, Poe, Perplexity, Claude Code
OpenAI

GPT-6

Stufen: Sol · Luna

Ausführung im grossen Stil: Sol, wenn die Aufgabe schwierig ist oder Fehler teuer sind, Luna für Volumenarbeit, bei der Tempo und Preis am meisten zählen.

Kontext
1.05M tokens
Preis
Sol $2 / $10 · Luna $0.10 / $0.50
Tempo
Schnell
In ChatGPT, OpenAI Codex, Poe, OpenRouter
Zhipu AI (Z.ai)

GLM-5.3-Flash

Für einen Assistenten oder Agenten, der den ganzen Tag über Tool-Aufrufe arbeitet, wo die Kosten pro Aufgabe wichtiger sind als Persönlichkeit.

Kontext
1M tokens
Preis
$0.15 / $0.50
Tempo
Schnell
In OpenClaw, OpenRouter
Alibaba Cloud

Qwen3.7-Max

Komplexe, mehrstufige agentische Programmieraufgaben.

Kontext
1M tokens
Preis
~$0.65 / $3.25
Tempo
Moderat
In Poe, OpenRouter
DeepSeek

DeepSeek V4 Flash

Reasoning-Aufgaben mit hohem Volumen, bei denen Kosteneffizienz entscheidend ist.

Kontext
1M tokens
Preis
$0.14 / $0.28
Tempo
Schnell
In OpenRouter
Google

Gemini Flash

Ausführungsarbeit mit hohem Volumen: Coding, Agenten, Texte und alles, wo Geschwindigkeit und Preis wichtiger sind als maximale Intelligenz.

Kontext
1M tokens
Preis
$0.75 / $3.75
Tempo
Sofort
In Gemini, Poe, Google AI Studio, Antigravity
xAI

Grok 4.7

Der Einsatz in Grok Bot und ein Blick darauf, was die Leute auf X gerade über ein Thema sagen.

Kontext
500K tokens
Preis
$2 / $6
Tempo
Moderat
In Grok Bot, Poe, OpenRouter
Anthropic

Claude Haiku

Ein Subagent, der für ein stärkeres Modell grosse Dokumentsammlungen durchsucht.

Kontext
200K tokens
Preis
$1 / $5
Tempo
Sofort
In Claude, Poe

Lokal auf deinem eigenen Rechner

Open-Weights-Modelle, klein genug für einen Laptop oder eine Workstation. Nichts verlässt das Haus. Schwächer als die Cloud-Stufe, und genau das ist der Deal.

4 Modelle

Bilder erzeugen

Kein Kontextfenster hier, und Preise pro Bild oder pro Monat. Was zählt, ist, worin jedes Modell gut ist.

5 Modelle

Videos erzeugen

Bisher zwei Einträge, beide nach Sekunden Filmmaterial bepreist.

2 Modelle

Stimme & Musik

Sprache, die Emotion trägt, und ganze Songs mit einer Struktur, die du bestimmst.

2 Modelle

Fehlt ein Modell, auf das du dich verlässt? Sag es mir, und ich nehme es unter die Lupe.