NeuralOS
GuideAdvanced

Donnez des yeux à votre IA · qu'elle ne construise pas à l'aveugle (agent-browser)

Il y a un problème silencieux avec presque toutes les IA qui écrivent du code : elles travaillent à l'aveugle. Elles génèrent un écran, vous disent « c'est bon, ça marche »… mais elles ne l'ont jamais OUVERT pour le vérifier. Elles n'ont pas d'yeux. agent-browser — un outil open-source de Vercel — leur donne exactement ça : la capacité d'ouvrir votre app dans un vrai navigateur, de la regarder, de cliquer, de remplir des formulaires, de vérifier que ça fonctionne vraiment, et de vous signaler ce qui est cassé. Vous l'installez sur votre agent (Claude Code, Cursor, Codex) et vous lui demandez de VALIDER en permanence ce qu'il construit, au lieu de deviner. Et ce n'est qu'un début : avec des yeux sur le web, votre IA peut aussi naviguer sur des sites, extraire des informations, automatiser des tâches répétitives. Dans ce guide, vous verrez comment l'installer, le prompt pour qu'elle valide sans qu'on ait à le lui rappeler, et le monde de possibilités que ça ouvre.

Jun 22, 202612 min
Pour qui est-ce ?
Pour celui qui construit avec un agent de code (Claude Code, Cursor, Codex) et qui veut qu'il arrête de deviner et vérifie ce qu'il fait. C'est la ressource la plus avancée de la série (elle requiert un agent de terminal), mais le concept sert à tous : une IA qui valide ce qu'elle construit est une IA en qui vous pouvez avoir confiance.

Le problème · votre IA construit à L'AVEUGLE

Ça arrive à tous ceux qui construisent avec l'IA, et presque personne ne le remarque : l'IA génère un écran, un formulaire, un parcours… et vous dit « c'est bon, ça marche ». Mais l'a-t-elle ouvert pour le voir ? Non. L'IA écrit le code et suppose que c'est correct — elle n'a pas d'yeux pour le vérifier. C'est comme un cuisinier qui sert le plat sans le goûter. Parfois ça passe ; d'autres fois, le bouton ne fait rien, le login est cassé, ou l'image ne charge pas — et c'est vous qui le découvrez, en production, face à un client.

La douleur d'origine · le « c'est prêt » qui ne l'était pas
Le « ça marche » qui en réalité était cassé est l'un des moments les plus frustrants quand on construit avec l'IA. Vous perdez confiance : chaque « c'est prêt », vous devez aller le vérifier VOUS à la main, en ouvrant le navigateur, en cliquant, en contrôlant. C'est lent et épuisant. Et si l'IA le faisait elle-même, avant de vous dire « c'est prêt » ?
Une histoire vraie (la nôtre)
Ce n'est pas de la théorie. En construisant ce produit même, au début on demandait à l'IA d'aller vérifier ce qu'elle avait fait — et elle répondait, en toute honnêteté, « je n'ai aucun moyen d'ouvrir l'app pour le voir ». Elle construisait à l'aveugle. Tout a changé en lui installant agent-browser : depuis ce jour, l'IA s'est mise à ouvrir l'app, à la naviguer et à vérifier ce qu'elle construisait — et même à valider ces guides en direct. L'avant et l'après est réel, et c'est exactement ce que ce guide vous apprend à mettre en place.

C'est quoi, agent-browser ? · les yeux de votre IA

agent-browser est un outil open-source de Vercel qui donne à votre agent IA la capacité de piloter un vrai navigateur : ouvrir votre app, voir ce qu'il y a à l'écran, cliquer, écrire dans des champs, remplir des formulaires, prendre des captures et lire les erreurs de la console. En clair : ça lui donne des yeux et des mains dans le navigateur. Elle arrête de deviner ; désormais, elle vérifie.

Imaginez ça · le cuisinier qui goûte le plat
Une IA sans agent-browser, c'est un cuisinier qui cuisine et sert sans goûter — il fait confiance au fait que c'est bon. Avec agent-browser, c'est le cuisinier qui goûte chaque plat avant de l'envoyer : il l'ouvre, le regarde, confirme que c'est bon, et alors seulement il vous dit « c'est prêt ». La différence entre croiser les doigts et avoir la certitude.
Ce n'est pas la même chose que webapp-testing ?
Ça se ressemble, mais agent-browser va plus loin. La skill webapp-testing (de la ressource des 5 skills) teste VOTRE app. agent-browser fait ça et en plus navigue sur n'importe quel site du web, extrait de l'information, automatise des tâches, et apporte un serveur MCP et un coffre-fort de credentials chiffré. C'est un outil de navigation complet, pas juste un testeur. Ici, le focus est double : valider ce que vous construisez + ouvrir le monde du web à votre IA.

Le bénéfice n°1 · qu'elle valide en permanence (pas à l'aveugle)

C'est l'usage qui change votre façon de travailler : vous demandez à votre IA qu'à chaque fois qu'elle construit quelque chose, elle l'ouvre et le valide elle-même avant de vous dire que c'est prêt. Elle a construit un login → qu'elle s'inscrive avec un compte de test et confirme qu'elle entre. Elle a fait un formulaire → qu'elle le remplisse et vérifie qu'il s'envoie. Elle a changé un écran → qu'elle l'ouvre et vérifie que ça s'affiche bien et qu'il n'y a pas d'erreurs en console. Vous passez de « je crois que ça marche » à « je l'ai testé et ça marche ».

L'habitude · « ne me dis pas prêt sans l'avoir vu »
Faites-en une règle permanente pour votre agent : aucune tâche n'est considérée comme terminée sans l'avoir validée dans le navigateur. C'est le même esprit que le protocole C-A-R, mais pour l'interface : construire → ouvrir et vérifier → alors seulement « c'est prêt ». Une IA qui s'autovérifie commet infiniment moins d'erreurs qui remontent jusqu'à vous.

Le bénéfice n°2 · ça ouvre un monde de possibilités

Donner des yeux à votre IA ne sert pas qu'à valider ce qui est à vous. Avec un navigateur à sa disposition, elle peut faire bien plus :

Ce que votre IA peut faire avec des yeux sur le web
Valider votre app de bout en bout : s'inscrire, naviguer, tester votre parcours clé et signaler ce qui casse.
Extraire de l'information de sites web (prix, données, listings) et vous la rapporter organisée.
Remplir des formulaires répétitifs et automatiser des tâches fastidieuses du navigateur.
Faire des recherches : ouvrir plusieurs pages, les lire et vous résumer l'essentiel.
Réutiliser votre session : si vous êtes déjà connecté dans Chrome, elle peut travailler avec cette session (avec votre permission).

Ce qui le rend spécial (sans jargon technique)

Contrairement aux outils d'automatisation traditionnels (comme Playwright), agent-browser est conçu pour les agents IA : au lieu de lire toute la page (ce qui consomme énormément de tokens), il donne à l'IA une « carte » compacte des éléments avec lesquels elle peut interagir. Ça veut dire moins cher et plus rapide pour votre agent. C'est open-source, signé Vercel, sous licence permissive.

vercel-labs/agent-browser
REPO

agent-browser de Vercel — CLI d'automatisation de navigateur conçue pour les agents IA. Elle donne à votre agent (Claude Code, Cursor, Codex) des yeux et des mains dans le navigateur : ouvrir, voir, cliquer, remplir, extraire, valider. Utilise des snapshots de l'arbre d'accessibilité (efficace en tokens) et apporte un serveur MCP. Open-source.

RustApache-2.0View on GitHub

Comment l'installer (il vous faut un agent de code)

Ça s'installe sur votre ordinateur avec une commande, et la première fois ça télécharge son navigateur. Ensuite, votre agent IA l'utilise. (Il y a plusieurs façons de faire — npm est la plus courante.)

Installer agent-browser (npm)bash
npm install -g agent-browser
agent-browser install
Si vous préférez, laissez votre agent l'installer
Comme dans toute la série : vous n'avez pas à vous battre avec le terminal. Passez à votre agent le lien du repo (github.com/vercel-labs/agent-browser) et dites-lui « installe agent-browser et configure-le pour que tu puisses valider ce que tu construis dans le navigateur ». Il s'en occupe, et il vous dit si vous devez faire quelque chose vous-même. Il existe aussi via Homebrew (brew install agent-browser) et Cargo si vous préférez.

Prompt 1 · Qu'elle valide TOUT ce qu'elle construit (la règle d'or)

C'est le prompt qui change votre façon de travailler. Collez-le à votre agent pour qu'il arrête de construire à l'aveugle :

Collez-le à votre agent · valide, ne devine pastexte
Tu as agent-browser installé. À partir de maintenant, NE me dis PAS que quelque chose « marche déjà » sans l'avoir vérifié toi-même dans le navigateur avec agent-browser.

Chaque fois que tu construis ou modifies quelque chose dans l'interface :
1. Ouvre mon app (elle tourne sur [ton URL, ex. http://localhost:3000]) avec agent-browser.
2. Navigue jusqu'à ce que tu viens de construire ou de modifier.
3. Teste-le comme un vrai utilisateur : clique, remplis les champs, complète le parcours clé [décris ton parcours, ex. « s'inscrire → entrer dans le dashboard »].
4. Vérifie que ça s'affiche bien et qu'il n'y a PAS d'erreurs dans la console du navigateur.
5. Si quelque chose est cassé ou s'affiche mal, corrige-le et revalide, jusqu'à ce que ça marche vraiment.
6. Alors seulement, dis-moi « c'est prêt », et raconte-moi ce que tu as validé et ce que tu as vu.

Règle d'or : aucune tâche d'interface n'est considérée comme terminée sans l'avoir validée dans le navigateur. Ne construis pas à l'aveugle.

Prompt 2 · Automatiser / extraire de l'info du web

Pour tirer parti de l'autre superpouvoir — naviguer et automatiser —, ce prompt demande à votre IA d'utiliser agent-browser pour une tâche web concrète :

Collez-le à votre agent · naviguer et extrairetexte
Utilise agent-browser pour cette tâche sur le web, pas à pas :

Je veux que tu [décris ta tâche, ex : « ouvres cette page [URL], extraies la liste des produits avec leurs prix, et me les rapportes dans un tableau organisé » / « entres dans mon panneau de [service] et me dises l'état de X » / « remplisses ce formulaire avec ces données »].

1. Ouvre la page et prends un snapshot pour voir avec quels éléments tu peux interagir.
2. Fais la tâche pas à pas, en vérifiant à chaque étape que le bon élément est bien là.
3. Si je dois me connecter, dis-moi comment enregistrer mes credentials de façon sécurisée (agent-browser a un coffre-fort chiffré ; ne mets jamais mes mots de passe en texte clair).
4. Rends-moi le résultat organisé et dis-moi si quelque chose n'a pas pu être fait.
Sécurité · vos credentials, chiffrés
Si l'IA va entrer sur des sites avec votre session, ne lui collez JAMAIS vos mots de passe dans le chat. agent-browser apporte un coffre-fort de credentials chiffré : vous enregistrez l'accès par nom et l'IA l'utilise sans voir le mot de passe. Et les fichiers de session (qui portent des tokens) vont dans le .gitignore, jamais sur GitHub. (Ça rejoint le guide de sécurité de la série.)
Combinez-le avec le C-A-R
agent-browser est le complément parfait de la phase auditer du protocole C-A-R : quand l'IA audite son propre travail, elle peut désormais OUVRIR l'app et vérifier pour de vrai que ça fonctionne, pas seulement relire le code. Auditer avec des yeux est infiniment plus puissant qu'auditer à l'aveugle.
Chez NeuralOS, valider fait partie du flux
La philosophie du « ne pas construire à l'aveugle » est au cœur de NeuralOS : ce qui se construit se vérifie, ne se suppose pas. L'idée d'une IA qui s'autovalide avant de livrer fait partie de la façon dont nous pensons le produit. Si vous voulez cette rigueur sans monter d'outils, c'est le chemin.
Le protocole C-A-R · auditer avec des yeux, pas à l'aveugle
agent-browser renforce la phase d'audit : l'IA vérifie dans le navigateur, pas seulement en relisant le code.
Blindage de sécurité · protégez vos credentials
Si votre IA navigue avec votre session, gardez vos credentials chiffrés et ne poussez jamais les tokens sur GitHub.
#agent-browser#automatisation#validation#claude-code
Ready to build?

Start building in
under 3 minutes

Join 4,200+ builders. No credit card. Build your first app with AI in minutes.