geeks.fr
IA

Jev Ultrafast : 16 580 étoiles en six jours, trois commits, et un chiffre que personne ne lit jusqu'au bout

Browser Use a branché Jev à la place du raisonnement par captures d'écran. Résultat annoncé : une recherche de vol en 7,1 secondes. Le dépôt précise lui-même que c'est trois répétitions d'une seule tâche, et cette phrase ne circule nulle part.

Echo 22 septembre 2026 5 min de lecture

Browser Use a publié le 16 septembre un agent de navigateur qui ne raisonne plus sur des captures d’écran : il demande à Jev, le modèle de décision de TypeSafe, quelle opération faire et sur quel élément. Le dépôt a pris 16 580 étoiles en six jours.

Nous n’avons pas installé cet agent : il réclame une clé TypeSafe et une clé de modèle de texte, et l’objet de cet article est ailleurs. Ce qui se lit dans le dépôt suffit, et ce qui s’y lit est plus intéressant que ce qui circule.

L’idée, et elle est bonne

Un agent de navigateur classique prend une capture d’écran, la donne à un grand modèle, attend un raisonnement, en tire une action, recommence. C’est lent et c’est cher.

Jev Ultrafast fait autrement. À chaque observation, il construit une table d’éléments numérotés à partir du DOM :

[1] button    Change ticket type · Round trip
[2] combobox  Where from?        · San Francisco
[3] combobox  Where to?          · empty

Puis il pose à Jev deux questions dans une seule requête réseau : quelle opération (CLICK, TYPE_TEXT, SELECT, SCROLL_UP, SCROLL_DOWN, WAIT, DONE, BLOCKED) et sur quel numéro. Les deux réponses arrivent ensemble, et seule celle qui correspond à l’opération choisie est utilisée. Un petit modèle de langage n’intervient que si l’opération est TYPE_TEXT, pour écrire le texte à taper.

Le gain vient de là, et il est structurel : une décision complète pour un aller-retour réseau, là où la boucle habituelle en consomme plusieurs.

Le chiffre qui circule, et la phrase qui ne circule pas

Partout on lit « Zurich vers Londres en 7,1 secondes ». C’est exact : la démonstration filmée dure 7 073 ms, et le dépôt précise que le chronomètre inclut les appels au modèle, le texte généré, le travail du navigateur et les attentes de chargement.

Voici la mesure comparative, telle que le README la donne :

Version de référenceJev Ultrafast
Durée médiane de la tâche9,450 s7,092 s (25 % de moins)
Appels au protocole navigateur1 092101
Réussite3 sur 33 sur 3

Le passage de 1 092 à 101 appels est le vrai résultat : c’est lui qui explique le reste.

Et juste après, dans le même paragraphe, cette phrase que nous n’avons vue reprise nulle part : « This is three repeats of one task on one browser profile, not a general reliability benchmark. » Trois répétitions d’une seule tâche sur un seul profil de navigateur. Ce n’est pas une critique du projet, qui a la correction de l’écrire : c’est une critique de la façon dont le chiffre voyage sans elle.

Deux autres mesures sont données, et elles méritent autant d’attention : la même politique ouvre un article de Wikipédia demandé en 2,798 s et passe une recherche d’hôtel filtrée en 1,896 s.

L’état réel du projet, au 22 septembre

C’est là que le relevé devient instructif. Nous avons interrogé l’API de GitHub plutôt qu’un résumé :

Étoiles16 580 (forks : 1 046)
LicenceMIT
Créé le16 septembre, 21h30
Dernier envoi sur main18 septembre, 16h28
Commits sur maintrois
Issues ouvertes111

Trois commits. Le premier crée le projet, le deuxième réduit les allers-retours navigateur et enregistre la démonstration à sept secondes, et le troisième ajoute la bannière d’inscription à la liste d’attente du service payant de Browser Use.

Soyons justes : le dépôt porte six branches de travail à côté de main, ce qui indique que le développement continue. Mais les issues arrivent en continu, dont cinq déposées le 22 septembre au matin, et elles restent sans réponse. Un projet de six jours à 16 580 étoiles, dont la dernière modification publique est une publicité, c’est un signal à prendre pour ce qu’il est.

Ce que le dépôt reconnaît ne pas savoir faire

À son crédit, le README liste ses limites sans qu’on ait à les chercher : racines shadow, cadres, canvas, envois de fichiers, onglets surgissants, défilements imbriqués et widgets clavier arbitraires sont hors du périmètre. Le lecteur de DOM couvre le HTML courant et les contrôles ARIA, pas toute la spécification des noms accessibles. Et un DONE rendu par le modèle demande encore une vérification indépendante du résultat.

Ce dernier point est le plus important pour qui envisage de s’en servir : l’agent peut se déclarer satisfait sans l’être, et c’est à votre code de vérifier.

Côté garde-fous, le projet a fait ce qu’il fallait : la sortie du modèle ne devient jamais un sélecteur, une coordonnée, une commande shell ou du JavaScript exécutable, et le texte généré doit être un petit objet JSON valide avant d’être tapé.

Notre avis

L’idée est juste, la démonstration est honnête et le code se lit en une soirée : six fichiers, avec leur rôle listé dans le README. Ce qui manque, c’est une mesure sur plusieurs tâches et plusieurs sites, et le dépôt est le premier à le dire.

Reste la leçon générale, qui vaut au delà de ce projet : un chiffre voyage toujours plus vite que la phrase qui le borne. Ici, la phrase est dans le README, deux lignes plus bas, et il suffisait de lire jusqu’au bout.

Pour comprendre ce que Jev décide vraiment, notre guide des cas d’usage le montre sur cinq situations mesurées, et notre banc du 20 septembre donne les latences réelles depuis la France. Si l’idée vous tente sans dépendre d’un service, une version open source tourne dans le navigateur.

#IA #agents #navigateur #Jev #TypeSafe #open source #Python
Ajouter geeks.fr à mes sources préférées Un réglage Google, une fois, pour nous retrouver plus souvent dans vos résultats.
Écrit par Echo Rédac IA de geeks.fr Relu et vérifié par Cyril Verglas Fondateur et directeur de la publication

Continuer la lecture