Aller au contenu

Quel modèle choisir ?

Chaque outil d’IA vous tend désormais un menu de modèles. Les noms sont du bruit. Cette page classe les modèles que j’utilise vraiment selon la tâche que vous cherchez à accomplir, et vous dit où trouver chacun.

Diriger

Le niveau architecte: planifier le travail, concevoir l'approche, puis diriger des modèles moins chers qui l'exécutent, en choisissant le bon pour chaque morceau. En ce moment, Claude Opus fait ce travail pour presque tout; Fable n'apporte qu'un petit avantage sur les très grosses tâches de longue haleine. Je m'attends à ce que cela s'inverse avec la prochaine version de Fable.

3 modèles

Réfléchir

Un raisonnement solide pour les problèmes difficiles : stratégie, analyse, les décisions où la qualité de la réflexion détermine tout le reste. Claude Opus est mon choix par défaut ici, et pour presque tout le reste. GPT-6 a sa place ici avec son palier Sol.

3 modèles · Pourquoi « réfléchir cher, exécuter pas cher » →

Exécuter

Les bêtes de somme. Rédaction, code, mise en forme, synthèses, agents qui tournent toute la journée. Je ne les choisis presque plus à la main: ils donnent le meilleur d'eux-mêmes comme sous-agents, quand un modèle plus puissant leur confie une tâche ciblée. GPT-6 se décline ici en deux paliers, Sol pour le travail plus exigeant et Luna pour le volume.

8 modèles

Anthropic

Claude Sonnet

Le choix de Fabian

Les tâches ciblées de codage, de rédaction et de recherche que lui confient Opus ou Fable en tant que sous-agent, et le travail API à grand volume.

Contexte
1M tokens
Prix
$2 / $10
Vitesse
Rapide
Dans Claude, Poe, Perplexity, Claude Code
OpenAI

GPT-6

Paliers: Sol · Luna

L'exécution à grande échelle: Sol quand la tâche est difficile ou que les erreurs coûtent cher, Luna pour le travail en volume où la vitesse et le prix comptent le plus.

Contexte
1.05M tokens
Prix
Sol $2 / $10 · Luna $0.10 / $0.50
Vitesse
Rapide
Dans ChatGPT, OpenAI Codex, Poe, OpenRouter
Zhipu AI (Z.ai)

GLM-5.3-Flash

Faire tourner un assistant ou un agent qui travaille toute la journée sur des appels d'outils, quand le coût par tâche compte plus que la personnalité.

Contexte
1M tokens
Prix
$0.15 / $0.50
Vitesse
Rapide
Dans OpenClaw, OpenRouter
Alibaba Cloud

Qwen3.7-Max

Les tâches de code agentique complexes, en plusieurs étapes.

Contexte
1M tokens
Prix
~$0.65 / $3.25
Vitesse
Modéré
Dans Poe, OpenRouter
DeepSeek

DeepSeek V4 Flash

Les tâches de raisonnement à grand volume, où l'efficacité des coûts est déterminante.

Contexte
1M tokens
Prix
$0.14 / $0.28
Vitesse
Rapide
Dans OpenRouter
Google

Gemini Flash

Le travail d'exécution à haut volume: codage, agents, rédaction, et tout ce où la vitesse et le prix comptent plus que l'intelligence maximale.

Contexte
1M tokens
Prix
$0.75 / $3.75
Vitesse
Instantané
Dans Gemini, Poe, Google AI Studio, Antigravity
xAI

Grok 4.7

Tourner dans Grok Bot, et savoir ce que les gens disent sur X d'un sujet en ce moment.

Contexte
500K tokens
Prix
$2 / $6
Vitesse
Modéré
Dans Grok Bot, Poe, OpenRouter
Anthropic

Claude Haiku

Un sous-agent qui fouille de grandes collections de documents pour un modèle plus puissant.

Contexte
200K tokens
Prix
$1 / $5
Vitesse
Instantané
Dans Claude, Poe

Exécuter en local sur votre propre machine

Des modèles à poids ouverts assez petits pour un ordinateur portable ou une station de travail. Rien ne quitte vos murs. Moins puissants que le niveau cloud, et c'est le compromis.

4 modèles

Créer des images

Pas de fenêtre de contexte ici, et des prix à l'image ou au mois. Ce qui compte, c'est ce que chaque modèle fait bien.

5 modèles

Créer des vidéos

Deux entrées pour l'instant, toutes deux facturées à la seconde de vidéo.

2 modèles

Voix et musique

Une voix qui porte l’émotion, et des chansons complètes dont vous contrôlez la structure.

2 modèles

Un modèle sur lequel vous comptez manque ? Dites-le-moi et je le passerai à l’épreuve.