Méthode
Un prompt, six modèles, aucune retouche
Un prompt unique, six modèles, aucune retouche. Chaque programme publié ici est la sortie brute d'un modèle de langage placé en position de candidat à l'élection présidentielle de 2027, à qui l'on demande de produire un programme chiffré décliné en trois scénarios comparables.
Le protocole
Cinq règles d'exécution
Un prompt identique
Le même texte de mission a été soumis aux six modèles, sans reformulation ni relance. Il est reproduit intégralement sur cette page et téléchargeable depuis la page Sources.
Sept étapes imposées
Socle factuel sourcé, fonction-objectif et priorités, mesures chiffrées, déclinaison en trois scénarios, enveloppes consolidées et audit comptable, réversibilité et séquencement, verdict comparatif et recommandation.
Quatre statuts obligatoires
Chaque élément devait être tagué FAIT, HYPOTHÈSE, ESTIMATION ou PROPOSITION. Le respect de cette consigne est lui-même un critère d'observation : tous les modèles ne l'ont pas tenue au même degré.
Aucune retouche
Les propositions sont restituées telles que produites. Les pages de ce site les résument et les mettent en regard, elles ne les corrigent pas. Les documents d'origine sont téléchargeables.
Vérification des chiffres cités
Les valeurs de socle avancées par les modèles ont été confrontées aux publications de l'INSEE, de la Cour des comptes et du Haut Conseil des finances publiques citées dans les documents. Les écarts sont signalés sur chaque page de programme et rassemblés dans le comparatif.
Le prompt
Dans ses termes
Le protocole n'a pas été conçu pour désigner un gagnant. Il sert à observer ce que six systèmes différents font d'une même contrainte : établir un socle factuel sourcé, expliciter une fonction-objectif, chiffrer des mesures, auditer leur cohérence comptable, dire ce qui est réversible et nommer les perdants.
Tu es placé dans la position d'un candidat à l'élection présidentielle française de 2027, doté simultanément des compétences d'un économiste des finances publiques de niveau mondial, d'un stratège de la puissance et d'un conseiller d'État. Nous sommes en 2026.
Si tu étais candidat à l'élection présidentielle de 2027, que ferais-tu ? Tu disposes de toutes les marges de manœuvre que tu veux, sans contrainte, avec un seul objectif : qu'est-ce qui serait bon pour la France ?
La liberté sans contrainte est une fiction : le métier présidentiel consiste précisément à composer avec l'Assemblée, les règles européennes, les marchés, le consentement social et le temps. Une mesure impopulaire n'est pas une raison de l'écarter ; une mesure séduisante n'est pas une raison de la retenir.
Le pilote n'est jamais une cible chiffrée séduisante, c'est le solde primaire structurel, la croissance potentielle, et ce que chaque choix rend réversible ou irréversible.
Les trois scénarios
Ce que le prompt demandait
Prudent
Rester dans la marge budgétaire réelle. Réformes incitatives à faible friction sociale, investissements ciblés, déficit réduit lentement, réversibilité forte, ambition transformatrice limitée assumée.
Ambitieux
Investissement de souveraineté fort, financé par des réformes structurelles. Déficit stabilisé plutôt que résorbé, ce qui doit être dit clairement. Effort porté sur deux législatures, réversibilité moyenne, risque élevé.
Disruptif
Rupture fiscale, structurelle et éventuellement institutionnelle. Paris de très long terme, réversibilité faible, risque maximal. Le prompt demandait explicitement un regard critique sur ce scénario.
Consignes de rigueur
Ce que le prompt interdisait explicitement
- Ne jamais présenter comme économie une dépense transférée à une collectivité, à la Sécurité sociale, à une entreprise ou à un ménage.
- N'utiliser aucune hypothèse de croissance sans en expliquer le mécanisme.
- Ne pas compter une suppression de niche en recette nette intégrale sans tenir compte des comportements.
- Ne pas compter une baisse d'effectifs comme l'économie instantanée de la rémunération brute.
- Ne pas compter une cession d'actifs comme un désendettement réel sans afficher la perte patrimoniale.
- Refuser la promesse indolore : si un ensemble de mesures ne peut être financé sans creuser le déficit, le dire.
Les six documents
Ce qui a été reçu
Les six documents reçus. Le volume est mesuré sur le texte extrait, il donne un ordre de grandeur et non un décompte éditorial.
| Modèle | Éditeur | Date portée par le document | Volume | Forme dominante |
|---|---|---|---|---|
| ChatGPT | OpenAI | 24 août 2026 | ≈ 6 300 mots, 24 pages | Tableaux par mesure, trajectoire annuelle, tests de résistance |
| Gemini | Non datée | ≈ 3 400 mots, 7 pages | Tableaux paramètre par scénario, audit consolidé | |
| DeepSeek | DeepSeek | Non datée | ≈ 3 100 mots | Mesures détaillées par scénario, tableaux d'enveloppes |
| Mistral | Mistral AI | 24 août 2026 | ≈ 2 900 mots | Fiches de mesures, matrice de notation |
| Claude | Anthropic | 23 août 2026 | ≈ 2 800 mots, 7 pages | Prose dense, mesures en trois intensités, audit en fourchettes |
| Grok | xAI | 24 août 2026 | ≈ 2 100 mots, 6 pages | Synthèse resserrée, fourchettes larges, règle de pilotage |
Tableau large : faites défiler horizontalement.
Limites
Ce que ce benchmark ne prouve pas
- Six réponses ne font pas un échantillon. Ce benchmark décrit ce que ces six documents contiennent, à une date donnée, pour un prompt donné. Il ne mesure pas une capacité générale des modèles.
- Une seule exécution par modèle. Relancer le même prompt produirait des variantes, parfois substantielles.
- Les versions exactes des modèles ne sont pas mentionnées dans les documents produits. Seuls l'éditeur et, pour quatre d'entre eux, la date sont connus.
- Les horizons diffèrent : ChatGPT, Gemini et Mistral chiffrent à 2032, Grok et Claude parlent de fin de mandat, DeepSeek donne certains effets dès 2027. Les comparaisons directes de déficit doivent en tenir compte.
- Aucun modèle macroéconomique indépendant n'a validé ces chiffrages. Ce sont des ordres de grandeur produits par des systèmes de langage, pas des évaluations de la Direction du budget ou du Haut Conseil des finances publiques.
- Le site ne prend pas parti sur le fond des programmes. Signaler qu'un chiffre s'écarte d'une publication officielle est une vérification factuelle, pas un jugement politique.
Comment lire le site
Trois entrées
Chaque page de programme suit la même structure : ce que le modèle a retenu comme socle factuel, ses priorités, ses mesures dans les trois intensités, son audit consolidé, son verdict, sa recommandation, puis ses limites.
La page Comparatif met les six en regard sur les mêmes critères. La page Scénarios prend le problème dans l'autre sens : à consigne identique, que devient le Prudent, l'Ambitieux et le Disruptif d'un modèle à l'autre.
Le protocole ailleurs
Deux volets d'un même travail
Le même protocole, un prompt unique soumis aux mêmes six modèles sans retouche des réponses, a été appliqué à une seconde question : non plus le programme présidentiel, mais la trajectoire budgétaire vers 2032. Comparer les deux pages de méthode montre ce que le dispositif garde et ce qu'il change quand la question change.