Toutes les notes
4 min de lecture

Rapide ou profond : le bon modèle pour chaque tâche

Sonnet ou Opus, Luna, Sol ou Astra : le menu des modèles a été renouvelé en dix jours et presque personne n'y touche. Une question pour trancher, la grille métier par métier, et la méthode pour vérifier sur tes vrais cas.

modèlesclaudechatgptméthodeproductivité

Ton abonnement te donne deux ou trois modèles. Tu en utilises un, celui qui est réglé par défaut. Voici comment choisir à chaque tâche, sans y passer plus de deux secondes.

Ouvre Claude : Sonnet 5.5 ou Opus 5.5. Ouvre ChatGPT : Luna, Sol ou Astra. Les deux gammes ont été renouvelées en dix jours, fin septembre.

La plupart des gens ne touchent jamais à ce menu. Deux réflexes dominent. Garder le réglage par défaut, quoi qu'on demande. Ou mettre le plus gros modèle partout, pour être tranquille.

Les deux coûtent. Pas au même endroit.

Ce que chaque cran te coûte

Le modèle profond réfléchit plus longtemps. Il répond plus lentement, il use ton quota plus vite, et il coûte plus cher. Chez Anthropic, Opus 5.5 coûte deux fois le prix de Sonnet 5.5 : 4 $ le million de tokens en entrée, contre 2 $.

Si tu es sur un forfait, tu ne vois pas la facture. Tu vois le mur : le quota qui craque en milieu de semaine. Le gros modèle sur des tâches simples, c'est la façon la plus rapide d'y arriver. Le mécanisme est détaillé dans la note sur le contexte et le quota.

Le modèle rapide, lui, a un vrai angle mort. Il rate les tâches où il faut peser des choses contradictoires. Il te rend une réponse propre, bien tournée, et fausse sur le fond.

Les éditeurs le disent eux-mêmes. Anthropic réserve Sonnet 5.5 au travail quotidien bien cadré : documents, slides, tableurs. Opus 5.5 va à ce qui demande du jugement sur plusieurs étapes. OpenAI range Luna pour le volume, Sol pour le travail sérieux, Astra pour le plus dur.

La règle des deux minutes

Tout tient en une question, à te poser avant d'envoyer :

Est-ce que je saurai vérifier le résultat en deux minutes ?

Si oui, modèle rapide. Une relance, un résumé, un tri de verbatims : tu lis, tu corriges, c'est fini.

Si la réponse demande de relire un raisonnement, de croiser des sources ou de trancher entre deux options valables, modèle profond. Là, une erreur ne se voit pas à la relecture. Elle se voit trois semaines plus tard.

La question marche parce qu'elle ne porte pas sur la difficulté apparente. Une tâche longue peut être simple à vérifier. Une tâche courte peut cacher un arbitrage.

La grille, métier par métier

Métier Rapide Profond
Sales Transformer le compte rendu d'un rendez-vous en relance. Préparer trois questions avant un appel. Décortiquer un appel d'offres de 80 pages et repérer les clauses qui mangent la marge.
CSM Répondre à un ticket. Résumer une revue trimestrielle. Lire six mois de tickets d'un grand compte et dire pourquoi il risque de partir.
PM Écrire des user stories. Trier 200 verbatims par thème. Arbitrer une roadmap quand le commerce, le support et la tech veulent trois choses différentes.
PMM Décliner un message en cinq formats. Monter les slides d'un lancement. Trouver un positionnement face à cinq concurrents qui disent tous la même chose.
Direction Résumer un dossier de comité. Relire un contrat, ou un business plan dont les chiffres ne collent pas d'un onglet à l'autre.

Regarde la colonne de droite. Aucune de ces tâches n'est longue à écrire. Toutes demandent de tenir plusieurs contraintes en même temps. C'est ça, le signal.

Avant de monter d'un cran

Deux réflexes à prendre avant de changer de modèle.

Active le mode réflexion d'abord. Claude et ChatGPT savent prendre plus de temps avant de répondre, sans changer de gamme. Sur une tâche moyenne, c'est souvent suffisant. Et c'est moins cher que de passer au modèle du dessus.

Escalade sur preuve, pas sur intuition. Si le modèle rapide rate deux fois la même tâche, monte d'un cran. Une fois, ça peut être ton brief. Deux fois sur la même demande, c'est le modèle.

Ça donne un ordre simple : modèle rapide, puis mode réflexion, puis modèle profond. Tu ne montes que quand la marche d'en dessous a échoué.

Le vérifier sur tes vrais cas

La grille te donne un point de départ. Elle ne remplace pas ce qui se passe sur tes demandes à toi. Un modèle profond peut être inutile sur ton métier, un rapide peut suffire là où tu ne l'attendais pas.

Pour trancher, reprends la méthode des vingt cas, celle de la note sur les evals. Elle marche aussi entre deux modèles d'un même abonnement.

  1. Prends vingt demandes réelles de ta semaine. Pas des exemples inventés : des relances, des tickets, des briefs que tu as vraiment traités.
  2. Note pour chacune ce qui serait une bonne réponse, et ce qui serait inacceptable. Pas la réponse mot pour mot, le critère.
  3. Fais passer les deux modèles sur les mêmes vingt cas, avec le même brief.
  4. Compte. Là où le rapide fait aussi bien, garde le rapide. Là où il décroche, tu as ta liste de tâches pour le profond.

Ça prend une heure. Et ça se refait à chaque nouvelle version : il en sort une toutes les trois semaines, le gagnant de septembre peut perdre en octobre.

Une décision de délégation

Choisir un modèle, c'est la même décision que choisir à qui confier un dossier. Le plus senior de l'équipe n'est pas la bonne personne pour tout. Il coûte plus cher, il est plus lent, et il a mieux à faire.

Le plus gros modèle partout, c'est confier les mails de relance à ton directeur juridique.