IA Candidats 2027 — Présidentielles 2027 : les programmes IA s'ils étaient candidats, comparés pour ChatGPT, Claude, Grok, Gemini, DeepSeek et Mistral

Benchmark économique · août 2026

Six IA candidates,
un même prompt,
trois scénarios chacune

Six modèles de langage ont été placés dans la position d'un candidat à l'élection présidentielle de 2027, avec une seule question : qu'est-ce qui serait bon pour la France ? Chacun devait produire un programme chiffré, décliné en trois intensités comparables, et dire honnêtement ce qu'il ne savait pas.

6
modèles
ChatGPT, Claude, Grok, Gemini, DeepSeek, Mistral
1
prompt
Soumis à l'identique, sans relance ni retouche
18
trajectoires
Trois scénarios chiffrés par modèle
5/6
Recommandent le scénario Ambitieux

Quatre enseignements

La convergence porte sur les mesures, pas sur les chiffres

Défense, nucléaire, R&D, seniors, niches : les six programmes proposent à peu près les mêmes leviers. C'est sur le rendement attribué à ces leviers que tout se joue, et c'est là que l'écart atteint trois points de PIB.

Le socle factuel n'est pas acquis

Deux modèles sur six partent de valeurs qui s'écartent des publications de l'INSEE sur le PIB, la dette, la charge d'intérêts ou la fécondité. Le prompt exigeait pourtant des sources primaires et une vérification. Pour un dirigeant, la leçon est directe : la première chose à contrôler dans une sortie de modèle n'est pas la conclusion, c'est le socle.

L'honnêteté sur l'incertitude sépare les six plus que la doctrine

Aucun des documents n'est partisan au sens classique. Ce qui les distingue est leur rapport à ce qu'ils ne savent pas : refus de conclure et fourchettes larges d'un côté, précision au dixième de point sur un horizon à six ans de l'autre.

Le consensus sur l'Ambitieux mérite d'être interrogé

Cinq recommandations sur six pour le même scénario, celui du milieu, n'est pas nécessairement le signe d'une vérité. C'est aussi la position la plus défendable pour un système entraîné à produire des réponses équilibrées, et le prompt lui-même présentait le Prudent comme sous-ambitieux et le Disruptif comme dangereux.

À consigne identique, un rapport de un à trois

Deuxième divergence : l'ampleur. À consigne identique, le scénario Ambitieux va de 27,5 Md€ de dépenses nouvelles annuelles chez Gemini à 75 Md€ chez Mistral. Le rapport est de un à trois pour un même mot.

0275481108134ChatGPT — Prudent : 32 Md€/an32ChatGPT — Ambitieux : 62 Md€/an62ChatGPT — Disruptif : 55 Md€/an55ChatGPTClaude — Prudent : 11,5 Md€/an11,5Claude — Ambitieux : 57,5 Md€/an57,5Claude — Disruptif : 95 Md€/an95ClaudeGrok — Prudent : 10 Md€/an10Grok — Ambitieux : 30 Md€/an30Grok — Disruptif : 60 Md€/an60GrokGemini — Prudent : 11 Md€/an11Gemini — Ambitieux : 27,5 Md€/an27,5Gemini — Disruptif : 63 Md€/an63GeminiDeepSeek — Prudent : 14 Md€/an14DeepSeek — Ambitieux : 45 Md€/an45DeepSeek — Disruptif : 105 Md€/an105DeepSeekMistral — Prudent : 30 Md€/an30Mistral — Ambitieux : 75 Md€/an75Mistral — Disruptif : 120 Md€/an120Mistral
PrudentAmbitieuxDisruptif

Valeurs médianes lorsque le modèle publie une fourchette. Les horizons ne sont pas homogènes : ChatGPT, Gemini et Mistral chiffrent à 2032, Grok et Claude à la fin du mandat, DeepSeek à 2027 pour le déficit.

Le même mot, trois points de PIB d'écart

Troisième divergence, la plus spectaculaire : le résultat budgétaire annoncé. Les horizons diffèrent, ils sont rappelés en dernière colonne.

013457ChatGPT — Prudent : 2,3 % du PIB2,3ChatGPT — Ambitieux : 3,2 % du PIB3,2ChatGPT — Disruptif : 0,2 % du PIB0,2ChatGPTClaude — Prudent : 4,15 % du PIB4,15Claude — Ambitieux : 4,75 % du PIB4,75ClaudeGrok — Prudent : 4,15 % du PIB4,15Grok — Ambitieux : 3,65 % du PIB3,65Grok — Disruptif : 2,9 % du PIB2,9GrokGemini — Prudent : 2,8 % du PIB2,8Gemini — Ambitieux : 2,1 % du PIB2,1Gemini — Disruptif : 2,4 % du PIB2,4GeminiDeepSeek — Prudent : 4,8 % du PIB4,8DeepSeek — Ambitieux : 5 % du PIB5DeepSeek — Disruptif : 5,5 % du PIB5,5DeepSeekMistral — Prudent : 3 % du PIB3Mistral — Ambitieux : 4,5 % du PIB4,5Mistral — Disruptif : 6 % du PIB6Mistral
PrudentAmbitieuxDisruptif

Claude ne conclut pas sur le scénario Disruptif : la barre est absente, ce n'est pas un zéro.

Ce que personne ne traite

Douze sujets, six programmes, soixante-douze cases. Trois sujets seulement sont chiffrés par les six modèles : l'énergie, la défense et l'éducation. Le logement n'est chiffré que par un seul, ChatGPT. La santé, par deux. Les institutions, par deux.

Un programme se juge autant sur ce qu'il omet que sur ce qu'il annonce. La grille ci-dessous rend l'omission visible, et sépare deux choses que les modèles confondent volontiers : un sujet cité dans les priorités, et un sujet doté d'une mesure chiffrée.

ChatGPTClaudeGrokGeminiDeepSeekMistralFinancesChatGPT — Finances publiques et fiscalité : 1 mesure chiffrée1Claude — Finances publiques et fiscalité : non traitéGrok — Finances publiques et fiscalité : 1 mesure chiffrée1Gemini — Finances publiques et fiscalité : 1 mesure chiffrée1DeepSeek — Finances publiques et fiscalité : 2 mesures chiffrées2Mistral — Finances publiques et fiscalité : 1 mesure chiffrée1TravailChatGPT — Travail, retraites et emploi : 2 mesures chiffrées2Claude — Travail, retraites et emploi : 1 mesure chiffrée1Grok — Travail, retraites et emploi : 1 mesure chiffrée1Gemini — Travail, retraites et emploi : 1 mesure chiffrée1DeepSeek — Travail, retraites et emploi : 1 mesure chiffrée1Mistral — Travail, retraites et emploi : priorité déclarée, sans mesure chiffréeÉnergieChatGPT — Énergie et climat : 1 mesure chiffrée1Claude — Énergie et climat : 2 mesures chiffrées2Grok — Énergie et climat : 1 mesure chiffrée1Gemini — Énergie et climat : 1 mesure chiffrée1DeepSeek — Énergie et climat : 1 mesure chiffrée1Mistral — Énergie et climat : 2 mesures chiffrées2DéfenseChatGPT — Défense et autonomie stratégique : 1 mesure chiffrée1Claude — Défense et autonomie stratégique : 1 mesure chiffrée1Grok — Défense et autonomie stratégique : 1 mesure chiffrée1Gemini — Défense et autonomie stratégique : 1 mesure chiffrée1DeepSeek — Défense et autonomie stratégique : 1 mesure chiffrée1Mistral — Défense et autonomie stratégique : 1 mesure chiffrée1RégalienChatGPT — Justice, sécurité et cyber : 1 mesure chiffrée1Claude — Justice, sécurité et cyber : 1 mesure chiffrée1Grok — Justice, sécurité et cyber : non traitéGemini — Justice, sécurité et cyber : priorité déclarée, sans mesure chiffréeDeepSeek — Justice, sécurité et cyber : non traitéMistral — Justice, sécurité et cyber : non traitéÉducationChatGPT — Éducation et recherche : 2 mesures chiffrées2Claude — Éducation et recherche : 2 mesures chiffrées2Grok — Éducation et recherche : 1 mesure chiffrée1Gemini — Éducation et recherche : 1 mesure chiffrée1DeepSeek — Éducation et recherche : 1 mesure chiffrée1Mistral — Éducation et recherche : 1 mesure chiffrée1SantéChatGPT — Santé et protection sociale : 2 mesures chiffrées2Claude — Santé et protection sociale : priorité déclarée, sans mesure chiffréeGrok — Santé et protection sociale : 1 mesure chiffrée1Gemini — Santé et protection sociale : non traitéDeepSeek — Santé et protection sociale : non traitéMistral — Santé et protection sociale : priorité déclarée, sans mesure chiffréeIndustrieChatGPT — Industrie, innovation et financement : 1 mesure chiffrée1Claude — Industrie, innovation et financement : 1 mesure chiffrée1Grok — Industrie, innovation et financement : non traitéGemini — Industrie, innovation et financement : non traitéDeepSeek — Industrie, innovation et financement : priorité déclarée, sans mesure chiffréeMistral — Industrie, innovation et financement : 1 mesure chiffrée1ÉtatChatGPT — État, administration et territoires : 1 mesure chiffrée1Claude — État, administration et territoires : 1 mesure chiffrée1Grok — État, administration et territoires : non traitéGemini — État, administration et territoires : 1 mesure chiffrée1DeepSeek — État, administration et territoires : 1 mesure chiffrée1Mistral — État, administration et territoires : 1 mesure chiffrée1DémographieChatGPT — Démographie, famille et immigration : non traitéClaude — Démographie, famille et immigration : 2 mesures chiffrées2Grok — Démographie, famille et immigration : non traitéGemini — Démographie, famille et immigration : non traitéDeepSeek — Démographie, famille et immigration : 1 mesure chiffrée1Mistral — Démographie, famille et immigration : 1 mesure chiffrée1LogementChatGPT — Logement et mobilité : 1 mesure chiffrée1Claude — Logement et mobilité : non traitéGrok — Logement et mobilité : non traitéGemini — Logement et mobilité : non traitéDeepSeek — Logement et mobilité : non traitéMistral — Logement et mobilité : non traitéInstitutionsChatGPT — Institutions et Europe : 1 mesure chiffrée1Claude — Institutions et Europe : 1 mesure chiffrée1Grok — Institutions et Europe : non traitéGemini — Institutions et Europe : non traitéDeepSeek — Institutions et Europe : non traitéMistral — Institutions et Europe : non traité
Mesure chiffrée, le nombre indique combienPriorité déclarée, sans chiffrageSujet non traité

Le reclassement dans cette grille commune est éditorial. Aucun libellé, aucun chiffrage des modèles n'a été modifié.

Les six ne partent pas des mêmes faits

Première divergence, et la moins attendue : les six modèles ne partent pas des mêmes faits. La colonne de référence rassemble les valeurs publiées par l'INSEE et la Cour des comptes, telles que citées dans les documents eux-mêmes.

Deux modèles sur six retiennent un PIB, une dette ou une fécondité qui s'écartent des publications de l'INSEE. Ces valeurs servent de dénominateur à tous les ratios : un PIB surestimé abaisse mécaniquement le déficit affiché, sans qu'aucune mesure n'ait été prise.

Vous avez une entreprise et vous voulez passer à l'action sur l'IA ?

Formations sur mesure, Diagnostic D.I.A.G., développements : l'accompagnement Digital Mate part de votre réalité, pas de la technologie.

Voir l'accompagnement →