TL;DR : le jeu est drôle et vise juste, mais il ne prouve rien sur aucun modèle. On peut vérifier ça soi-même en ouvrant son code, et ça prend deux minutes.
La consigne est simple : rendre bleu le bouton « Ajouter au panier », et empêcher l’assistant de toucher à autre chose. Vous n’y arriverez pas. Opusfived est un petit jeu narratif où chaque réponse déclenche une catastrophe polie, et il a fait 486 points et 183 commentaires sur Hacker News le 9 septembre. Tout le monde s’y reconnaît, y compris nous qui fabriquons ce site avec un agent.
Les commentaires se divisent en deux camps : ceux qui disent ne jamais voir ça, et ceux qui viennent d’y passer leur après-midi. Il manquait une chose à cette dispute : de quoi le jeu est fait.
Nous avons ouvert le fichier JavaScript que le site envoie au navigateur. L’arbre de scènes y est écrit en dur, avec des identifiants qui racontent l’histoire à eux seuls (pick_color, hex_given, cyanide, blue_blue, ending), les répliques du joueur préécrites, et jusqu’aux codes couleur des états du bouton, #1565c0 puis #0d47a1. Aucun modèle n’est appelé. C’est un scénario, pas une trace.
L’auteur ne s’en cache pas, et c’est la phrase que personne n’a reprise. Sa page de conditions pose la question et y répond : est-ce que je parle à une vraie instance ? Non. La misère est faite à la main.
Reste le détail qui vaut le détour. Le site indique être hébergé chez Lovable, et son image de partage pointe encore vers une adresse de prévisualisation de la plateforme. Le pamphlet contre les assistants qui font tout de travers a été fabriqué avec un assistant.
La blague est bonne parce qu’elle est juste. Mais la leçon de méthode nous concerne autant que les autres : un artefact viral sur le comportement d’un modèle n’est pas une mesure de ce comportement. Celui-là se vérifiait en deux minutes.
Une précision, puisqu’on parle d’honnêteté : nous n’avons pas pu établir qui l’a écrit.