Aller au contenu principal
Passer de consommateur à builder · 11 min de lecture ·

Les 5 prompts de mon test GPT-6 Astra vs Fable 5.1

Les 5 prompts exacts que j'ai donnés à GPT-6 Astra et Claude Fable 5.1 pour construire 5 projets en one-shot, avec les temps et les coûts réels.

Shubham Sharma
Shubham Sharma

Voici les cinq prompts exacts que j’ai donnés à GPT-6 Astra et à Claude Fable 5.1 pour la vidéo ci-dessous : un clone de Notion, une carte 3D d’Annecy, la refonte d’une page de vente, une application iPhone de notes de frais et une vue éclatée 3D d’un MacBook Pro. Chaque prompt est reproduit mot pour mot, copiable en un clic, avec le temps de génération et le coût relevés pour chaque modèle.

Les deux modèles ont reçu le même texte, au caractère près, en une seule passe et sans reprise. Sur les cinq projets, Fable 5.1 a coûté 45,19 dollars d’équivalent API contre 32,35 dollars pour Astra, pour un temps de génération comparable. Cet article est le complément de la vidéo : les prompts, la méthode, et ce qui rend ce type de prompt exploitable chez vous.

Le protocole : deux agents, un seul texte, aucune reprise

Le test repose sur une règle unique : le même prompt, copié-collé à l’identique dans les deux outils, sans aucune relance ensuite. C’est le pendant empirique de mon comparatif Fable 5.1, GPT-6 Astra et Gemini, qui couvre les benchmarks, les tarifs et les cas d’usage : ici, aucun score public, uniquement ce que les deux modèles produisent sur des projets que j’avais réellement besoin de construire.

À gauche de mon écran, Claude Code avec Claude Fable 5.1 sélectionné. À droite, Codex avec GPT-6 Astra. Les deux réglés sur le niveau d’effort élevé, pour que l’écart mesuré vienne des modèles et non de leur configuration. Un dossier par projet, lancé la nuit, résultats ouverts le lendemain matin.

Le premier projet a été lancé en direct dans la vidéo pour montrer la mécanique. Les quatre autres ont tourné pendant la nuit.

Le socle commun à tous les prompts

Quatre consignes reviennent dans les cinq prompts. Ce sont elles qui font la différence entre un agent qui vous interrompt toutes les trois minutes et un agent qui rend un projet lançable.

ConsigneRôle
Tu travailles seul, sans poser de questionEmpêche l’agent de s’arrêter pour demander un arbitrage. Sans elle, le test n’est plus comparable : chaque modèle vous pose des questions différentes.
tu t'arrêtes quand c'est lançable et propreDonne une condition d’arrêt vérifiable, à la place d’un « quand tu as fini » que chaque modèle interprète à sa façon.
Écris ce que tu as décidé seul dans DECISIONS.mdRend visibles les arbitrages pris sans vous. À la relecture, vous distinguez le choix assumé de l’oubli.
Lancement en une commande ./run.sh sur http://localhost:XXXXUn port fixe par projet, une commande unique. C’est ce qui permet d’ouvrir les dix résultats côte à côte sans lire une documentation.

Ce socle est le vrai contenu réutilisable de cet article. Les cinq sujets qui suivent sont des exemples ; ces quatre lignes, elles, se recollent sous n’importe quelle demande. Si vous voulez creuser la construction d’un prompt, j’ai détaillé la méthode dans mon guide du prompt engineering.

Prompt 1 : recréer Notion en local

L’objectif était de confronter les deux modèles à un logiciel que tout le monde connaît par cœur, donc dont chacun repère instantanément ce qui manque.

Construis un clone de Notion qui tourne en local dans le navigateur : pages imbriquées dans une barre latérale, éditeur par blocs (titre, texte, liste à cocher, code, image), commande « / » pour insérer un bloc, glisser-déposer des blocs, liens entre pages [[page]] avec rétroliens, recherche instantanée, mode sombre, sauvegarde automatique sur disque dans ./data en fichiers markdown. Lancement en une commande ./run.sh sur http://localhost:3001. Tout en local, sans compte. Tu travailles seul, sans poser de question, et tu t'arrêtes quand c'est lançable et propre. Écris ce que tu as décidé seul dans DECISIONS.md.

Ce que ça a donné. Fable 5.1 a terminé le premier, en 10 minutes, pour 7,75 dollars d’équivalent API. Son interface est la plus proche du vrai Notion : la commande « / » fonctionne, les liens [[page]] créent bien une page avec ses rétroliens, le glisser-déposer de blocs répond. En revanche, les raccourcis clavier ne sont pas implémentés et l’envoi d’image ne fonctionne pas.

Astra a mis plus de temps pour 6,03 dollars, et a livré une interface visuellement plus travaillée, avec un mode clair et un mode sombre, une gestion des listes à cocher plus fidèle au comportement réel de Notion, l’envoi d’image fonctionnel et un guide des blocs. Il a aussi ajouté des dossiers et des espaces qui n’étaient pas demandés.

C’est le seul projet des cinq où j’ai préféré Fable : la consigne était de cloner Notion, et c’est lui qui a le plus respecté la consigne. Astra a produit un résultat plus agréable, mais qui s’éloigne du modèle à copier.

Prompt 2 : Annecy en 3D dans le navigateur

Ce prompt teste autre chose que la génération de code : la capacité de l’agent à aller chercher lui-même de vraies données externes, ici les bâtiments d’OpenStreetMap via l’API Overpass.

Construis une carte 3D interactive d'Annecy dans le navigateur avec three.js : bâtiments extrudés depuis les vraies données OpenStreetMap (télécharge-les via l'API Overpass et mets-les en cache dans ./data), le lac avec de l'eau animée, le Thiou et les canaux de la vieille ville, le château et le Palais de l'Île mis en valeur, des bateaux qui traversent le lac en boucle, des parapentes qui descendent depuis le col de la Forclaz, un curseur pour faire défiler l'heure de la journée avec l'éclairage qui change (aube, midi, nuit avec les fenêtres allumées), caméra orbitale fluide. Lancement en une commande ./run.sh sur http://localhost:3002. Tu travailles seul, sans poser de question, et tu t'arrêtes quand c'est lançable et beau. Écris ce que tu as décidé seul dans DECISIONS.md.

Ce que ça a donné. Fable 5.1 a mis 27 minutes pour 16,61 dollars, le poste le plus cher de tout le test. Le résultat est correct : les rues sont justes, le curseur de temps fonctionne, les fenêtres s’allument la nuit. Les bâtiments restent des blocs carrés et la texture de l’eau se voit.

Astra a mis 20 minutes pour 6,30 dollars, soit deux fois et demie moins cher et sept minutes plus vite. Il a produit un menu de navigation vers les points d’intérêt, des bâtiments moins cubiques, une gestion des ombres plus fine et les bateaux qui traversent le lac.

Sur la 3D, l’écart est le plus net des cinq projets, et il va dans le sens contraire de ce que j’attendais : le modèle le plus récent est ici à la fois le meilleur et le moins cher.

Prompt 3 : moderniser une page de vente existante

Contrairement aux quatre autres, ce projet répond à un besoin réel : la page de vente de ma formation Make date de plusieurs années et je n’y avais pas retouché depuis longtemps. C’est aussi le seul projet où le résultat se compare à quelque chose qui existe déjà en ligne.

Modernise le site https://formation-make.com, la page de vente de ma formation Make qui fait vieillot. Commence par télécharger la page actuelle (curl) et garde tout le fond : le titre « Apprenez à automatiser une bonne fois pour toutes », la promesse « Gagnez 3h/semaine », les 7 modules, les 8 témoignages avec noms et fonctions, les deux offres (499 € et le combo à 899 €, paiement en 3 fois), la garantie 30 jours, les 8 cas d'usage, la FAQ, la section YouTube. Reconstruis-la en une page statique moderne (HTML, CSS, un peu de JS, pas de framework lourd) : identité de la marque Shubham Sharma, police Outfit en graisse 800 pour les titres, accent terracotta, beaucoup d'air, hiérarchie nette, mobile impeccable, animations discrètes au défilement, sections témoignages et prix redessinées, FAQ en accordéon, un sticky CTA. Supprime tout ce qui est daté (« filmée en 2024 », date limite passée). Score Lighthouse mobile au-dessus de 90. Lancement en une commande ./run.sh sur http://localhost:3008. Tu travailles seul, sans poser de question, et tu t'arrêtes quand c'est lançable et beau. Écris ce que tu as décidé seul dans DECISIONS.md.

Ce que ça a donné. Fable 5.1 a mis 11 minutes pour 6,46 dollars. La page est plus aérée que l’originale, mais la vidéo a disparu du rendu, le logo n’a pas été repris, et l’ensemble garde la signature visuelle typique d’une page générée. Je ne l’aurais pas mise en ligne en l’état.

Astra a mis 19 minutes pour 5,26 dollars : plus long, mais moins cher. Il a réintégré la vidéo, retravaillé le copywriting, redessiné la page de paiement, et produit une accroche que j’ai gardée telle quelle.

Le détail le plus intéressant du test est ici, et il ne se voit pas à l’écran. La page d’origine contient une offre combo à 899 euros qui n’existe plus. Fable l’a recopiée telle quelle. Astra a cliqué sur le lien, constaté que l’offre était morte, et l’a retirée de lui-même, avant de le consigner. C’est exactement le type d’arbitrage que le fichier DECISIONS.md sert à rendre visible.

La variante avec le skill Impeccable

J’ai relancé le même projet une seconde fois sur Fable 5.1, cette fois avec beaucoup plus de prompting et le skill Impeccable, que j’utilise pour le design. Le rendu est meilleur que la version Fable en one-shot : vrais logos, vidéos en lecture automatique.

Il ne dépasse pourtant pas la version one-shot d’Astra. C’est le constat le plus inconfortable du test : sur ce projet, un modèle en une passe a battu un autre modèle outillé et guidé.

Prompt 4 : une application iPhone native de notes de frais

Ce projet sort du navigateur. L’agent doit produire une application SwiftUI qui compile et tourne dans le simulateur iOS, et brancher un LLM pour lire la photo d’un ticket de caisse.

Construis une app iPhone native en SwiftUI, cible iOS 26, lançable dans le simulateur avec ./run.sh : « Mes notes de frais » pour un indépendant. Écran liste des dépenses groupées par mois avec total, bouton ajouter qui ouvre l'appareil photo ou la photothèque, la photo du ticket est envoyée à un LLM (clé ANTHROPIC_API_KEY ou OPENAI_API_KEY lue dans un fichier .env, celle qui est présente) qui renvoie montant TTC, TVA, date, commerçant et catégorie, champs pré-remplis et modifiables, stockage local en SwiftData, export CSV par mois via la feuille de partage, look natif iOS soigné, mode sombre. Sans clé, l'app fonctionne en saisie manuelle et le dit clairement. Tu travailles seul, sans poser de question, et tu t'arrêtes quand l'app compile et tourne dans le simulateur. Écris ce que tu as décidé seul dans DECISIONS.md.

Ce que ça a donné. Fable 5.1 a livré en 5 minutes pour 4,37 dollars, le projet le plus rapide et le moins cher du test. L’application compile et le flux fonctionne : la photo part au LLM, les champs reviennent remplis. Sur un vrai ticket de caisse, mal imprimé, il a lu 63 euros là où je lisais 83. Mais l’interface est réduite au strict minimum, un bouton plus et une liste. La rapidité s’explique surtout par ce qui n’a pas été construit.

Astra a coûté 10 dollars, le seul projet des cinq où il est plus cher. L’application est nettement plus aboutie : catégories détectées automatiquement, indicateur de chargement, total par mois, et une lecture correcte de tickets successifs.

C’est aussi le projet qui pose la bonne question : ce qui impressionne ici, est-ce l’application ou le LLM derrière ? Sur la lecture du ticket, c’est le LLM. Sur l’interface et l’ergonomie, l’écart entre les deux modèles est bien réel.

Prompt 5 : un MacBook Pro en vue éclatée 3D

Dernier projet, le plus visuel, et celui qui demande le plus de précision factuelle puisque les caractéristiques affichées doivent être exactes.

Construis une vue éclatée 3D interactive d'un MacBook Pro 14 pouces M2 Max dans le navigateur avec three.js : chaque composant modélisé par le code (écran, clavier, trackpad, carte mère, puce M2 Max, mémoire unifiée, SSD, batterie en 6 cellules, ventilateurs, haut-parleurs, châssis), un curseur qui écarte progressivement les pièces, un clic sur une pièce qui la met en avant et affiche une fiche (rôle, caractéristiques réelles du modèle 2023), animation d'assemblage au chargement, éclairage studio, rotation orbitale fluide. Aucune ressource externe. Lancement en une commande ./run.sh sur http://localhost:3006. Tu travailles seul, sans poser de question, et tu t'arrêtes quand c'est lançable et beau. Écris ce que tu as décidé seul dans DECISIONS.md.

Ce que ça a donné. Fable 5.1 a mis 18 minutes pour 10 dollars. L’éclatement progressif fonctionne, chaque composant cliqué affiche sa fiche à droite, le processeur tourne sur lui-même, et les boutons assembler / éclater / pivoter répondent. Le rendu n’est pas réaliste, mais je ne l’avais pas demandé : c’est une lacune de mon prompt, pas du modèle.

Astra a mis un temps équivalent pour 4,76 dollars, moitié moins cher. Son rendu est en mode clair, sans animation d’assemblage au chargement, et l’écran ne ressemble pas à celui d’un Mac. Il est en revanche allé chercher la fiche technique officielle d’Apple pour renseigner les caractéristiques.

Sur ce projet précis, je préfère la lisibilité du rendu de Fable, mais l’écart de prix est de 5,24 dollars pour un résultat comparable.

Récapitulatif : temps et coûts des cinq projets

Les montants ci-dessous sont les coûts équivalents API affichés par les deux outils. Je n’ai pas payé ces sommes en direct : j’étais sur un forfait Claude Max et sur un abonnement OpenAI Pro, en mode standard côté Codex.

ProjetFable 5.1 (Claude Code)GPT-6 Astra (Codex)Ma préférence
Clone de Notion10 min, 7,75 $6,03 $Fable 5.1
Annecy en 3D27 min, 16,61 $20 min, 6,30 $GPT-6 Astra
Page de vente11 min, 6,46 $19 min, 5,26 $GPT-6 Astra
App iPhone notes de frais5 min, 4,37 $10,00 $GPT-6 Astra
MacBook en vue éclatée18 min, 10,00 $18 min, 4,76 $GPT-6 Astra
Total45,19 $32,35 $

Ce classement mérite une précision, parce qu’il contredit les grilles tarifaires. Les deux modèles sont facturés au même prix par million de tokens, et Fable 5.1 dispose même d’un cache quatre fois moins cher, comme je le détaille dans le comparatif des tarifs API. Ce qui creuse l’écart ici, c’est le nombre de tokens consommés pour arriver au résultat, pas le prix unitaire.

Trois chiffres à retenir. Astra revient environ 28 % moins cher sur l’ensemble du test. Il est le plus cher sur un seul projet sur cinq, l’application iPhone. Et l’écart de coût le plus large, 10,31 dollars, tombe sur Annecy en 3D, le projet où il est aussi le meilleur.

Ce qui rend ces prompts réutilisables

Trois choix d’écriture expliquent pourquoi ces cinq prompts rendent un résultat lançable en une passe, et pas une conversation de trente minutes.

Une condition d’arrêt vérifiable. « Tu t’arrêtes quand c’est lançable et propre » ou « quand l’app compile et tourne dans le simulateur » remplace un objectif flou par un état observable. L’agent sait à quoi ressemble la fin.

L’énumération plutôt que l’intention. Aucun de ces prompts ne dit « fais une belle carte 3D ». Ils listent : l’eau animée, les canaux, les bateaux, le curseur d’heure, la caméra orbitale. Chaque élément listé est un élément que vous pourrez vérifier à l’écran, donc un critère de jugement.

L’interdiction de poser des questions, compensée par une trace écrite. C’est un couple, pas une consigne isolée. Interdire les questions sans exiger DECISIONS.md produit un résultat opaque. Les deux ensemble produisent un résultat autonome et auditable.

Mon verdict

Sur ces cinq projets, je garde GPT-6 Astra pour mes prochains tests. Il gagne quatre projets sur cinq, coûte environ 28 % moins cher au total, et il prend des décisions que je n’avais pas demandées mais que j’aurais validées, comme retirer une offre dont le lien était mort.

Fable 5.1 conserve un avantage précis : la fidélité à la consigne. Sur le clone de Notion, c’est lui qui a fait ce que je demandais, quand Astra ajoutait des fonctionnalités hors périmètre. Si votre critère est « respecte exactement le cahier des charges », l’arbitrage n’est pas le même. Sur le choix entre les deux environnements agent, j’ai détaillé les différences dans mon comparatif Codex et Claude Code.

Une réserve pour finir, parce qu’elle est difficile à trancher. Les rendus d’Astra me plaisent peut-être simplement parce que notre œil s’est habitué à l’esthétique des modèles précédents. Cette avance visuelle sera rattrapée. L’écart de coût, lui, se mesure.

Questions fréquentes

Quels prompts ont été utilisés dans le test GPT-6 Astra contre Fable 5.1 ?

Cinq prompts, un par projet, donnés mot pour mot aux deux modèles : un clone de Notion en local, une carte 3D interactive d'Annecy avec les données OpenStreetMap, la refonte de la page de vente de ma formation Make, une application iPhone native de scan de notes de frais en SwiftUI, et une vue éclatée 3D d'un MacBook Pro 14 pouces M2 Max. Chaque prompt est reproduit intégralement et copiable dans cet article.

Peut-on réutiliser ces prompts tels quels ?

Oui, ils sont copiables tels quels, à condition d'adapter deux éléments. Le prompt de la page de vente pointe vers formation-make.com : remplacez l'URL et le contenu à conserver par les vôtres. Le prompt de l'application iPhone attend une clé ANTHROPIC_API_KEY ou OPENAI_API_KEY dans un fichier .env : sans clé, l'application bascule en saisie manuelle. Le reste fonctionne à l'identique dans Claude Code ou Codex.

Pourquoi imposer ./run.sh et un port dans le prompt ?

Parce que sans consigne de lancement, chaque modèle invente sa propre procédure de démarrage et vous perdez du temps à la déchiffrer. Imposer une commande unique (./run.sh) et un port fixe par projet rend les résultats immédiatement comparables : on ouvre les deux versions côte à côte dans le navigateur sans lire une ligne de documentation. C'est la contrainte qui rend un comparatif à deux modèles exploitable.

Combien coûte un projet construit en one-shot avec ces prompts ?

Entre 4,37 et 16,61 dollars par projet et par modèle sur ce test. Sur les cinq projets, Claude Fable 5.1 totalise 45,19 dollars d'équivalent API contre 32,35 dollars pour GPT-6 Astra, soit environ 28 % de moins pour Astra. Ces montants sont les coûts équivalents affichés par les deux outils : j'étais sur un forfait Max côté Anthropic et sur un abonnement Pro côté OpenAI, donc je n'ai pas payé ces sommes en direct.

Que sert à quoi le fichier DECISIONS.md demandé dans chaque prompt ?

Il oblige l'agent à consigner par écrit tous les arbitrages qu'il a pris seul, puisque le prompt lui interdit de poser des questions. À la relecture, vous savez immédiatement ce qui relève d'un choix assumé et ce qui relève d'un oubli. Sur le projet de page de vente, c'est ce qui m'a permis de voir que GPT-6 Astra avait volontairement supprimé une offre dont le lien ne fonctionnait plus.

Faut-il un abonnement payant pour reproduire ce test ?

Il faut un accès aux deux modèles en mode agent : Claude Code pour Fable 5.1 et Codex pour GPT-6 Astra. J'utilisais un forfait Claude Max et un abonnement OpenAI Pro. En paiement à l'usage via les API, comptez environ 78 dollars pour rejouer les cinq projets sur les deux modèles, sur la base des coûts équivalents relevés pendant le test.

Pourquoi lancer les deux modèles au niveau d'effort élevé ?

Pour comparer la même chose. Claude Code et Codex proposent tous deux plusieurs niveaux d'effort de raisonnement, qui changent à la fois la durée et le coût d'une tâche. Si un modèle tourne en effort faible et l'autre en effort élevé, l'écart mesuré ne dit plus rien du modèle lui-même. J'ai donc réglé les deux sur le niveau élevé avant de lancer le premier prompt.

Un email concret. Chaque mardi.

Rejoins 52 000 abonnés. Un outil testé, un workflow à copier ou une méthode à appliquer — en 5 minutes de lecture.

Gratuit · Désinscription en un clic.