Quel modèle choisir ?
Chaque outil d’IA vous tend désormais un menu de modèles. Les noms sont du bruit. Cette page classe les modèles que j’utilise vraiment selon la tâche que vous cherchez à accomplir, et vous dit où trouver chacun.
Diriger
Le niveau architecte: planifier le travail, concevoir l'approche, puis diriger des modèles moins chers qui l'exécutent, en choisissant le bon pour chaque morceau. En ce moment, Claude Opus fait ce travail pour presque tout; Fable n'apporte qu'un petit avantage sur les très grosses tâches de longue haleine. Je m'attends à ce que cela s'inverse avec la prochaine version de Fable.
3 modèles
Claude Opus
Presque tout: planification, raisonnement approfondi, rédaction, recherche et codage agentique complexe. Fable n'apporte un avantage que sur les très grosses tâches de longue haleine.
- Contexte
- 1M tokens
- Prix
- $4 / $20
- Vitesse
- Modéré
Claude Fable
Les très grosses tâches agentiques de longue haleine, où un petit avantage sur Opus 5.5 vaut deux fois et demie le prix.
- Contexte
- 1M tokens
- Prix
- $10 / $50
- Vitesse
- Lent
GPT-6 Astra
Le travail où la réponse doit être juste du premier coup et où la facture en tokens n'est pas la contrainte.
- Contexte
- 1.05M tokens
- Prix
- $10 / $50
- Vitesse
- Modéré
| Modèle | Idéal pour | Contexte | Prixentrée / sortie par M de tokens | Vitesse | Où | Note |
|---|---|---|---|---|---|---|
| Claude Opus Le choix de Fabian Anthropic | Presque tout: planification, raisonnement approfondi, rédaction, recherche et codage agentique complexe. Fable n'apporte un avantage que sur les très grosses tâches de longue haleine. | 1M tokens | $4 / $20 | Modéré | Claude, Claude Code, Claude Cowork, Perplexity Computer, Poe | |
| Claude Fable Anthropic | Les très grosses tâches agentiques de longue haleine, où un petit avantage sur Opus 5.5 vaut deux fois et demie le prix. | 1M tokens | $10 / $50 | Lent | Claude, Poe, Claude Code | |
| GPT-6 Astra OpenAI | Le travail où la réponse doit être juste du premier coup et où la facture en tokens n'est pas la contrainte. | 1.05M tokens | $10 / $50 | Modéré | ChatGPT, OpenAI Codex, Poe, OpenRouter |
Réfléchir
Un raisonnement solide pour les problèmes difficiles : stratégie, analyse, les décisions où la qualité de la réflexion détermine tout le reste. Claude Opus est mon choix par défaut ici, et pour presque tout le reste. GPT-6 a sa place ici avec son palier Sol.
3 modèles · Pourquoi « réfléchir cher, exécuter pas cher » →
Claude Opus
Presque tout: planification, raisonnement approfondi, rédaction, recherche et codage agentique complexe. Fable n'apporte un avantage que sur les très grosses tâches de longue haleine.
- Contexte
- 1M tokens
- Prix
- $4 / $20
- Vitesse
- Modéré
Gemini Pro
Analyser d'immenses jeux de données, des bases de code complètes ou des vidéos d'une heure.
- Contexte
- 2M tokens
- Prix
- $1.25 / $10
- Vitesse
- Modéré
GPT-6
Paliers: Sol · Luna
L'exécution à grande échelle: Sol quand la tâche est difficile ou que les erreurs coûtent cher, Luna pour le travail en volume où la vitesse et le prix comptent le plus.
- Contexte
- 1.05M tokens
- Prix
- Sol $2 / $10 · Luna $0.10 / $0.50
- Vitesse
- Rapide
| Modèle | Idéal pour | Contexte | Prixentrée / sortie par M de tokens | Vitesse | Où | Note |
|---|---|---|---|---|---|---|
| Claude Opus Le choix de Fabian Anthropic | Presque tout: planification, raisonnement approfondi, rédaction, recherche et codage agentique complexe. Fable n'apporte un avantage que sur les très grosses tâches de longue haleine. | 1M tokens | $4 / $20 | Modéré | Claude, Claude Code, Claude Cowork, Perplexity Computer, Poe | |
| Gemini Pro Google | Analyser d'immenses jeux de données, des bases de code complètes ou des vidéos d'une heure. | 2M tokens | $1.25 / $10 | Modéré | Gemini, Poe, Google AI Studio | |
| GPT-6 OpenAI · Sol · Luna | L'exécution à grande échelle: Sol quand la tâche est difficile ou que les erreurs coûtent cher, Luna pour le travail en volume où la vitesse et le prix comptent le plus. | 1.05M tokens | Sol $2 / $10 · Luna $0.10 / $0.50 | Rapide | ChatGPT, OpenAI Codex, Poe, OpenRouter |
Exécuter
Les bêtes de somme. Rédaction, code, mise en forme, synthèses, agents qui tournent toute la journée. Je ne les choisis presque plus à la main: ils donnent le meilleur d'eux-mêmes comme sous-agents, quand un modèle plus puissant leur confie une tâche ciblée. GPT-6 se décline ici en deux paliers, Sol pour le travail plus exigeant et Luna pour le volume.
8 modèles
Claude Sonnet
Les tâches ciblées de codage, de rédaction et de recherche que lui confient Opus ou Fable en tant que sous-agent, et le travail API à grand volume.
- Contexte
- 1M tokens
- Prix
- $2 / $10
- Vitesse
- Rapide
GPT-6
Paliers: Sol · Luna
L'exécution à grande échelle: Sol quand la tâche est difficile ou que les erreurs coûtent cher, Luna pour le travail en volume où la vitesse et le prix comptent le plus.
- Contexte
- 1.05M tokens
- Prix
- Sol $2 / $10 · Luna $0.10 / $0.50
- Vitesse
- Rapide
GLM-5.3-Flash
Faire tourner un assistant ou un agent qui travaille toute la journée sur des appels d'outils, quand le coût par tâche compte plus que la personnalité.
- Contexte
- 1M tokens
- Prix
- $0.15 / $0.50
- Vitesse
- Rapide
Qwen3.7-Max
Les tâches de code agentique complexes, en plusieurs étapes.
- Contexte
- 1M tokens
- Prix
- ~$0.65 / $3.25
- Vitesse
- Modéré
DeepSeek V4 Flash
Les tâches de raisonnement à grand volume, où l'efficacité des coûts est déterminante.
- Contexte
- 1M tokens
- Prix
- $0.14 / $0.28
- Vitesse
- Rapide
Gemini Flash
Le travail d'exécution à haut volume: codage, agents, rédaction, et tout ce où la vitesse et le prix comptent plus que l'intelligence maximale.
- Contexte
- 1M tokens
- Prix
- $0.75 / $3.75
- Vitesse
- Instantané
Grok 4.7
Tourner dans Grok Bot, et savoir ce que les gens disent sur X d'un sujet en ce moment.
- Contexte
- 500K tokens
- Prix
- $2 / $6
- Vitesse
- Modéré
Claude Haiku
Un sous-agent qui fouille de grandes collections de documents pour un modèle plus puissant.
- Contexte
- 200K tokens
- Prix
- $1 / $5
- Vitesse
- Instantané
| Modèle | Idéal pour | Contexte | Prixentrée / sortie par M de tokens | Vitesse | Où | Note |
|---|---|---|---|---|---|---|
| Claude Sonnet Le choix de Fabian Anthropic | Les tâches ciblées de codage, de rédaction et de recherche que lui confient Opus ou Fable en tant que sous-agent, et le travail API à grand volume. | 1M tokens | $2 / $10 | Rapide | Claude, Poe, Perplexity, Claude Code | |
| GPT-6 OpenAI · Sol · Luna | L'exécution à grande échelle: Sol quand la tâche est difficile ou que les erreurs coûtent cher, Luna pour le travail en volume où la vitesse et le prix comptent le plus. | 1.05M tokens | Sol $2 / $10 · Luna $0.10 / $0.50 | Rapide | ChatGPT, OpenAI Codex, Poe, OpenRouter | |
| GLM-5.3-Flash Zhipu AI (Z.ai) | Faire tourner un assistant ou un agent qui travaille toute la journée sur des appels d'outils, quand le coût par tâche compte plus que la personnalité. | 1M tokens | $0.15 / $0.50 | Rapide | OpenClaw, OpenRouter | |
| Qwen3.7-Max Alibaba Cloud | Les tâches de code agentique complexes, en plusieurs étapes. | 1M tokens | ~$0.65 / $3.25 | Modéré | Poe, OpenRouter | |
| DeepSeek V4 Flash DeepSeek | Les tâches de raisonnement à grand volume, où l'efficacité des coûts est déterminante. | 1M tokens | $0.14 / $0.28 | Rapide | OpenRouter | |
| Gemini Flash Google | Le travail d'exécution à haut volume: codage, agents, rédaction, et tout ce où la vitesse et le prix comptent plus que l'intelligence maximale. | 1M tokens | $0.75 / $3.75 | Instantané | Gemini, Poe, Google AI Studio, Antigravity | |
| Grok 4.7 xAI | Tourner dans Grok Bot, et savoir ce que les gens disent sur X d'un sujet en ce moment. | 500K tokens | $2 / $6 | Modéré | Grok Bot, Poe, OpenRouter | |
| Claude Haiku Anthropic | Un sous-agent qui fouille de grandes collections de documents pour un modèle plus puissant. | 200K tokens | $1 / $5 | Instantané | Claude, Poe |
Chercher sur le web en direct
Des modèles reliés à un index de recherche. Pour tout ce où « à ce jour » compte et où vous voulez les sources, pas une supposition assurée.
2 modèles
Sonar Pro
La recherche web en temps réel, la vérification des faits et la synthèse de plusieurs sources en ligne avec des citations intégrées.
- Contexte
- 127K tokens
- Prix
- 1 $ forfait + frais de recherche
- Vitesse
- Rapide
Grok 4.7
Tourner dans Grok Bot, et savoir ce que les gens disent sur X d'un sujet en ce moment.
- Contexte
- 500K tokens
- Prix
- $2 / $6
- Vitesse
- Modéré
| Modèle | Idéal pour | Contexte | Prixentrée / sortie par M de tokens | Vitesse | Où | Note |
|---|---|---|---|---|---|---|
| Sonar Pro Le choix de Fabian Perplexity | La recherche web en temps réel, la vérification des faits et la synthèse de plusieurs sources en ligne avec des citations intégrées. | 127K tokens | 1 $ forfait + frais de recherche | Rapide | Perplexity | |
| Grok 4.7 xAI | Tourner dans Grok Bot, et savoir ce que les gens disent sur X d'un sujet en ce moment. | 500K tokens | $2 / $6 | Modéré | Grok Bot, Poe, OpenRouter |
Exécuter en local sur votre propre machine
Des modèles à poids ouverts assez petits pour un ordinateur portable ou une station de travail. Rien ne quitte vos murs. Moins puissants que le niveau cloud, et c'est le compromis.
4 modèles
Gemma 4 27B
Le code local et les tâches d'automatisation plus complexes sur des stations de travail.
- Tourne sur
- Une station de travail
- Prix
- Gratuit, en local
- Vitesse
- Modéré
Gemma 4 12B
Automatisation locale, tâches administratives et workflows privilégiant la confidentialité sur un ordinateur portable.
- Tourne sur
- Un ordinateur portable
- Prix
- Gratuit, en local
- Vitesse
- Rapide
GLM-5.3-Flash
Faire tourner un assistant ou un agent qui travaille toute la journée sur des appels d'outils, quand le coût par tâche compte plus que la personnalité.
- Tourne sur
- 1M tokens
- Prix
- $0.15 / $0.50
- Vitesse
- Rapide
DeepSeek V4 Flash
Les tâches de raisonnement à grand volume, où l'efficacité des coûts est déterminante.
- Tourne sur
- 1M tokens
- Prix
- $0.14 / $0.28
- Vitesse
- Rapide
| Modèle | Idéal pour | Tourne sur | Prix | Vitesse | Où | Note |
|---|---|---|---|---|---|---|
| Gemma 4 27B Le choix de Fabian Google | Le code local et les tâches d'automatisation plus complexes sur des stations de travail. | Une station de travail | Gratuit, en local | Modéré | Hugging Face | |
| Gemma 4 12B Google | Automatisation locale, tâches administratives et workflows privilégiant la confidentialité sur un ordinateur portable. | Un ordinateur portable | Gratuit, en local | Rapide | Hugging Face | |
| GLM-5.3-Flash Zhipu AI (Z.ai) | Faire tourner un assistant ou un agent qui travaille toute la journée sur des appels d'outils, quand le coût par tâche compte plus que la personnalité. | 1M tokens | $0.15 / $0.50 | Rapide | OpenClaw, OpenRouter | |
| DeepSeek V4 Flash DeepSeek | Les tâches de raisonnement à grand volume, où l'efficacité des coûts est déterminante. | 1M tokens | $0.14 / $0.28 | Rapide | OpenRouter |
Créer des images
Pas de fenêtre de contexte ici, et des prix à l'image ou au mois. Ce qui compte, c'est ce que chaque modèle fait bien.
5 modèles
GPT-Image-2.5
Le travail créatif d'image comme le design d'interface: retouche conversationnelle, inpainting précis, et visuels chargés de texte qui doivent rester lisibles.
- Fort pour
- Retouche, texte lisible
- Prix
- 30 $ / M de tokens image
- Vitesse
- Rapide
Nano Banana 2
Maquettes d'écrans UI/UX, infographies et visualisation structurée de données.
- Fort pour
- Écrans UI, infographies
- Prix
- Offre gratuite dans Gemini
- Vitesse
- Rapide
Midjourney
Concept art, illustrations stylisées et esthétique purement artistique.
- Fort pour
- Art, ambiance, style
- Prix
- 10–120 $ / mois
- Vitesse
- Modéré
FLUX-2 Pro
Le photoréalisme de production et le respect précis des prompts.
- Fort pour
- Photoréalisme
- Prix
- ~0,03–0,06 $ / image
- Vitesse
- Modéré
Grok Imagine
Des motifs créatifs, stylisés ou abstraits, pour sortir de l'esthétique IA trop lisse.
- Fort pour
- Stylisé, abstrait
- Prix
- SuperGrok 30 $ / mois
- Vitesse
- Rapide
| Modèle | Idéal pour | Fort pour | Prix | Vitesse | Où | Note |
|---|---|---|---|---|---|---|
| GPT-Image-2.5 Le choix de Fabian OpenAI | Le travail créatif d'image comme le design d'interface: retouche conversationnelle, inpainting précis, et visuels chargés de texte qui doivent rester lisibles. | Retouche, texte lisible | 30 $ / M de tokens image | Rapide | ChatGPT, Poe | |
| Nano Banana 2 Google DeepMind | Maquettes d'écrans UI/UX, infographies et visualisation structurée de données. | Écrans UI, infographies | Offre gratuite dans Gemini | Rapide | Gemini, Poe | |
| Midjourney Midjourney | Concept art, illustrations stylisées et esthétique purement artistique. | Art, ambiance, style | 10–120 $ / mois | Modéré | Midjourney | |
| FLUX-2 Pro Black Forest Labs | Le photoréalisme de production et le respect précis des prompts. | Photoréalisme | ~0,03–0,06 $ / image | Modéré | Poe | |
| Grok Imagine xAI | Des motifs créatifs, stylisés ou abstraits, pour sortir de l'esthétique IA trop lisse. | Stylisé, abstrait | SuperGrok 30 $ / mois | Rapide | Grok Imagine |
Créer des vidéos
Deux entrées pour l'instant, toutes deux facturées à la seconde de vidéo.
2 modèles
Veo 3.1
Plans cinématographiques haute fidélité et simulation réaliste de la physique.
- Fort pour
- Plans cinéma, physique
- Prix
- ~0,05–0,40 $ / s
- Vitesse
- Modéré
Grok Imagine Video
Animations stylisées et génération rapide de clips vidéo.
- Fort pour
- Clips stylisés
- Prix
- ~0,05–0,14 $ / s
- Vitesse
- Rapide
| Modèle | Idéal pour | Fort pour | Prix | Vitesse | Où | Note |
|---|---|---|---|---|---|---|
| Veo 3.1 Le choix de Fabian Google DeepMind | Plans cinématographiques haute fidélité et simulation réaliste de la physique. | Plans cinéma, physique | ~0,05–0,40 $ / s | Modéré | Veo 3.1, Google AI Studio | |
| Grok Imagine Video xAI | Animations stylisées et génération rapide de clips vidéo. | Clips stylisés | ~0,05–0,14 $ / s | Rapide | Grok Imagine |
Voix et musique
Une voix qui porte l’émotion, et des chansons complètes dont vous contrôlez la structure.
2 modèles
Eleven v3
Voix off, livres audio et dialogues chargés d'émotion.
- Fort pour
- Voix expressive
- Prix
- Crédits, 1 par caractère
- Vitesse
- Rapide
Lyria 3 Pro
Générer des morceaux de musique structurés et complets.
- Fort pour
- Chansons complètes
- Prix
- ~0,08 $ / chanson
- Vitesse
- Modéré
| Modèle | Idéal pour | Fort pour | Prix | Vitesse | Où | Note |
|---|---|---|---|---|---|---|
| Eleven v3 Le choix de Fabian ElevenLabs | Voix off, livres audio et dialogues chargés d'émotion. | Voix expressive | Crédits, 1 par caractère | Rapide | ElevenLabs | |
| Lyria 3 Pro Google DeepMind | Générer des morceaux de musique structurés et complets. | Chansons complètes | ~0,08 $ / chanson | Modéré | Lyria |
Aucun modèle ne correspond
Essayez le nom du fournisseur (Anthropic, Google) ou un outil que vous utilisez (ChatGPT, Poe).
Un modèle sur lequel vous comptez manque ? Dites-le-moi et je le passerai à l’épreuve.