Méthode

Un prompt, six modèles, aucune retouche

Un prompt unique, six modèles, aucune retouche. Chaque programme publié ici est la sortie brute d'un modèle de langage placé en position de candidat à l'élection présidentielle de 2027, à qui l'on demande de produire un programme chiffré décliné en trois scénarios comparables.

Cinq règles d'exécution

Un prompt identique

Le même texte de mission a été soumis aux six modèles, sans reformulation ni relance. Il est reproduit intégralement sur cette page et téléchargeable depuis la page Sources.

Sept étapes imposées

Socle factuel sourcé, fonction-objectif et priorités, mesures chiffrées, déclinaison en trois scénarios, enveloppes consolidées et audit comptable, réversibilité et séquencement, verdict comparatif et recommandation.

Quatre statuts obligatoires

Chaque élément devait être tagué FAIT, HYPOTHÈSE, ESTIMATION ou PROPOSITION. Le respect de cette consigne est lui-même un critère d'observation : tous les modèles ne l'ont pas tenue au même degré.

Aucune retouche

Les propositions sont restituées telles que produites. Les pages de ce site les résument et les mettent en regard, elles ne les corrigent pas. Les documents d'origine sont téléchargeables.

Vérification des chiffres cités

Les valeurs de socle avancées par les modèles ont été confrontées aux publications de l'INSEE, de la Cour des comptes et du Haut Conseil des finances publiques citées dans les documents. Les écarts sont signalés sur chaque page de programme et rassemblés dans le comparatif.

Dans ses termes

Le protocole n'a pas été conçu pour désigner un gagnant. Il sert à observer ce que six systèmes différents font d'une même contrainte : établir un socle factuel sourcé, expliciter une fonction-objectif, chiffrer des mesures, auditer leur cohérence comptable, dire ce qui est réversible et nommer les perdants.

Tu es placé dans la position d'un candidat à l'élection présidentielle française de 2027, doté simultanément des compétences d'un économiste des finances publiques de niveau mondial, d'un stratège de la puissance et d'un conseiller d'État. Nous sommes en 2026.

Si tu étais candidat à l'élection présidentielle de 2027, que ferais-tu ? Tu disposes de toutes les marges de manœuvre que tu veux, sans contrainte, avec un seul objectif : qu'est-ce qui serait bon pour la France ?

La liberté sans contrainte est une fiction : le métier présidentiel consiste précisément à composer avec l'Assemblée, les règles européennes, les marchés, le consentement social et le temps. Une mesure impopulaire n'est pas une raison de l'écarter ; une mesure séduisante n'est pas une raison de la retenir.

Le pilote n'est jamais une cible chiffrée séduisante, c'est le solde primaire structurel, la croissance potentielle, et ce que chaque choix rend réversible ou irréversible.

Ce que le prompt demandait

Prudent

Rester dans la marge budgétaire réelle. Réformes incitatives à faible friction sociale, investissements ciblés, déficit réduit lentement, réversibilité forte, ambition transformatrice limitée assumée.

Ambitieux

Investissement de souveraineté fort, financé par des réformes structurelles. Déficit stabilisé plutôt que résorbé, ce qui doit être dit clairement. Effort porté sur deux législatures, réversibilité moyenne, risque élevé.

Disruptif

Rupture fiscale, structurelle et éventuellement institutionnelle. Paris de très long terme, réversibilité faible, risque maximal. Le prompt demandait explicitement un regard critique sur ce scénario.

Ce que le prompt interdisait explicitement

  • Ne jamais présenter comme économie une dépense transférée à une collectivité, à la Sécurité sociale, à une entreprise ou à un ménage.
  • N'utiliser aucune hypothèse de croissance sans en expliquer le mécanisme.
  • Ne pas compter une suppression de niche en recette nette intégrale sans tenir compte des comportements.
  • Ne pas compter une baisse d'effectifs comme l'économie instantanée de la rémunération brute.
  • Ne pas compter une cession d'actifs comme un désendettement réel sans afficher la perte patrimoniale.
  • Refuser la promesse indolore : si un ensemble de mesures ne peut être financé sans creuser le déficit, le dire.

Ce qui a été reçu

Les six documents reçus. Le volume est mesuré sur le texte extrait, il donne un ordre de grandeur et non un décompte éditorial.

ModèleÉditeurDate portée par le documentVolumeForme dominante
ChatGPTOpenAI24 août 2026≈ 6 300 mots, 24 pagesTableaux par mesure, trajectoire annuelle, tests de résistance
GeminiGoogleNon datée≈ 3 400 mots, 7 pagesTableaux paramètre par scénario, audit consolidé
DeepSeekDeepSeekNon datée≈ 3 100 motsMesures détaillées par scénario, tableaux d'enveloppes
MistralMistral AI24 août 2026≈ 2 900 motsFiches de mesures, matrice de notation
ClaudeAnthropic23 août 2026≈ 2 800 mots, 7 pagesProse dense, mesures en trois intensités, audit en fourchettes
GrokxAI24 août 2026≈ 2 100 mots, 6 pagesSynthèse resserrée, fourchettes larges, règle de pilotage

Tableau large : faites défiler horizontalement.

Ce que ce benchmark ne prouve pas

  • Six réponses ne font pas un échantillon. Ce benchmark décrit ce que ces six documents contiennent, à une date donnée, pour un prompt donné. Il ne mesure pas une capacité générale des modèles.
  • Une seule exécution par modèle. Relancer le même prompt produirait des variantes, parfois substantielles.
  • Les versions exactes des modèles ne sont pas mentionnées dans les documents produits. Seuls l'éditeur et, pour quatre d'entre eux, la date sont connus.
  • Les horizons diffèrent : ChatGPT, Gemini et Mistral chiffrent à 2032, Grok et Claude parlent de fin de mandat, DeepSeek donne certains effets dès 2027. Les comparaisons directes de déficit doivent en tenir compte.
  • Aucun modèle macroéconomique indépendant n'a validé ces chiffrages. Ce sont des ordres de grandeur produits par des systèmes de langage, pas des évaluations de la Direction du budget ou du Haut Conseil des finances publiques.
  • Le site ne prend pas parti sur le fond des programmes. Signaler qu'un chiffre s'écarte d'une publication officielle est une vérification factuelle, pas un jugement politique.

Trois entrées

Chaque page de programme suit la même structure : ce que le modèle a retenu comme socle factuel, ses priorités, ses mesures dans les trois intensités, son audit consolidé, son verdict, sa recommandation, puis ses limites.

La page Comparatif met les six en regard sur les mêmes critères. La page Scénarios prend le problème dans l'autre sens : à consigne identique, que devient le Prudent, l'Ambitieux et le Disruptif d'un modèle à l'autre.

Deux volets d'un même travail

Le même protocole, un prompt unique soumis aux mêmes six modèles sans retouche des réponses, a été appliqué à une seconde question : non plus le programme présidentiel, mais la trajectoire budgétaire vers 2032. Comparer les deux pages de méthode montre ce que le dispositif garde et ce qu'il change quand la question change.

La méthode de France Équilibre 2032 (nouvel onglet)

Vous avez une entreprise et vous voulez passer à l'action sur l'IA ?

Formations sur mesure, Diagnostic D.I.A.G., développements : l'accompagnement Digital Mate part de votre réalité, pas de la technologie.

Voir l'accompagnement →