survol

← Tous les articles · Décryptage

Décryptage

« Les astuces de prompt, c'est terminé » : Mollick, Wharton et la revanche de la spec

Quatre rapports du laboratoire d'IA générative de Wharton passent au banc d'essai les recettes magiques du prompting : la politesse, les pourboires, les menaces, les personas d'expert, le « think step by step ». Verdict : rien de tout cela ne tient. Ce qui marche, résume Ethan Mollick, c'est « spécifier vos objectifs, votre sortie, ce à quoi ressemblent un bon et un mauvais résultat, et comment tester - oui, c'est juste du management ». Nous, on appelle ça une spec. Et c'est le pari fondateur de Survol.

A
Adrien Torris 14 juillet 20267 min de lecture
La fin des astuces de prompt : la spec gagne

Le 7 juillet, Ethan Mollick - professeur à Wharton et l'une des voix les plus écoutées sur l'IA en entreprise - publie un message qui dépasse les 22 000 vues en quelques heures. Traduction libre :

« Même avant la révolution agentique, les astuces de prompt avaient cessé d'apporter grand-chose, comme nos recherches l'ont montré. La meilleure approche de l'IA aujourd'hui : spécifier clairement vos objectifs, votre sortie, ce à quoi ressemblent un bon et un mauvais résultat, et comment tester… (oui, c'est juste du management). » - Ethan Mollick, 7 juillet 2026

En appui, quatre rapports techniques du Generative AI Labs de Wharton, la série Prompting Science, décortiqués dans une excellente synthèse d'explainx.ai. Leur objet : tester scientifiquement, sur des benchmarks exigeants (GPQA, MMLU-Pro), les incantations que la culture du prompt engineering a vendues pendant deux ans. Et la meilleure réponse du fil résume tout : « le déblocage, c'était d'écrire une vraie spec. Ça l'a toujours été - les astuces de prompt le cachaient. »

On ne va pas se mentir : chez Survol, on a lu tout ça avec un grand sourire.

Ce que Wharton a réellement testé - et enterré

Les quatre rapports, un par croyance populaire :

L'honnêteté oblige à lire les limites : ces études mesurent la justesse sur des QCM difficiles, pas le travail créatif ou stratégique. Les personas restent utiles pour la voix (résumé pour un dirigeant vs doc pour un développeur), et le chain-of-thought n'est pas interdit - il est simplement devenu marginal sur les modèles récents. Mollick ne dit pas « les prompts ne comptent pas » ; il dit que les astuces ne comptent pas. Les specs, si.

Ce qui remplace les astuces : quatre questions de manager

La grille de Mollick tient en quatre points, et c'est une grille de management :

  1. L'objectif - quel résultat cette session doit produire. Pas « aide-moi sur le code » : « le client doit pouvoir payer sa réservation en trois fois, sans casser le parcours mobile ».
  2. La sortie - format, périmètre, contraintes, ce qu'il ne faut pas toucher.
  3. Le bon et le mauvais - critères d'acceptation et anti-patterns : ce qui fait qu'on valide, ce qui fait qu'on refuse.
  4. Les tests - comment on vérifie avant de livrer.

Et Mollick d'insister sur un point que nous trouvons capital : le format importe moins que le contenu. PRD, cahier des charges, procédure - utilisez ce que votre organisation lit déjà. Le modèle ne récompense pas l'esthétique du prompt ; il récompense des exigences lisibles. Exactement comme un bon ingénieur ou un bon prestataire.

Pourquoi l'ère agentique rend ça vital

Mollick le précise : les astuces avaient perdu leur valeur avant la révolution agentique. Mais les agents changent l'échelle du problème. En question-réponse, une consigne floue produit une mauvaise réponse - l'humain la voit, corrige, on recommence. En développement agentique, une consigne floue produit des heures d'exécution multi-fichiers, multi-outils… dans la mauvaise direction. Un agent sous-spécifié n'échoue pas poliment : il livre la mauvaise chose avec assurance.

C'est la conclusion pratique de la synthèse d'explainx.ai : la valeur est montée d'un étage. Elle n'est plus dans la formule magique du prompt, elle est dans la qualité de la spécification, l'assemblage du contexte et les boucles de vérification. Le discours de l'industrie a suivi - on parle de moins en moins de prompt engineering, de plus en plus d'ingénierie du contexte et des boucles.

« C'est juste du management » - c'est exactement notre pari

Quand nous avons commencé à construire Survol, nous avons posé un principe qui semblait presque provocateur : l'utilisateur ne tape jamais de prompt - la spécification validée EST le prompt. Les rapports de Wharton et le fil de Mollick décrivent, preuves à l'appui, pourquoi c'est la bonne interface. La grille de Mollick, nous l'avons littéralement transformée en produit :

Même notre position sur l'optimisation s'en trouve confortée : si les incantations ne servent à rien, chaque token dépensé en boilerplate « réfléchis très fort » est un token perdu. C'est pour cela que Survol taille le contexte au strict nécessaire - la spec validée, les décisions tranchées, les fichiers concernés - et choisit le modèle selon la tâche. La science du prompting rejoint la gestion de budget.

Et il y a un corollaire que nous trouvons profondément enthousiasmant : si la compétence clé est de spécifier, alors les meilleurs « ingénieurs prompt » de l'ère agentique sont les gens de produit. Celles et ceux qui savent décrire un besoin, arbitrer, fixer des critères d'acceptation. Le développement agentique ne demande pas d'apprendre un grimoire - il demande de faire bien son métier de pilote de produit, avec un outillage qui transforme ce travail en instructions exécutables.

Ce qu'on en retient

  1. Les astuces de prompt (politesse, pourboires, menaces, personas, CoT systématique) ne résistent pas au banc d'essai : effets contingents, coûts certains.
  2. Ce qui marche : objectif, sortie attendue, critères bon/mauvais, tests. Une spec, donc - dans le format que votre équipe lit déjà.
  3. Les agents amplifient l'enjeu : sous-spécifié, un agent livre la mauvaise chose avec assurance. La vérification doit être outillée, pas espérée.
  4. La compétence rare se déplace vers le produit : décrire, arbitrer, fixer les critères. C'est une très bonne nouvelle pour les équipes produit.

« Oui, c'est juste du management », conclut Mollick. On ajouterait volontiers : du management de produit. C'est le métier que Survol outille - la spec comme instruction, les décisions comme garde-fous, les tests comme porte de sortie. Deux ans de folklore du prompt viennent de se dissoudre dans quatre rapports de recherche ; ce qui reste, c'est ce qui a toujours fait les bons produits. On ne va pas s'en plaindre.

Sources : « Ethan Mollick: Prompting Tricks Are Over - Wharton Prompting Science Backs Real Specs », explainx.ai, 7 juillet 2026 · Wharton Generative AI Labs, série Prompting Science, rapports 1 à 4 · fil X d'Ethan Mollick (@emollick) du 7 juillet 2026.

#prompt-engineering #specification #developpement-agentique #recherche
A

Adrien Torris

Fondateur de Survol

Développeur devenu orchestrateur d'agents. J'écris sur le pilotage produit à l'ère du développement agentique, et sur les coulisses de la construction de Survol.

Ne ratez pas le prochain article

Un e-mail par mois, nos meilleurs décryptages de l'actualité de l'IA en entreprise et les nouveautés de Survol.