Aller au contenu principal

Navigateurs à session partagée pour agents IA : le modèle ego lite

Intermédiaire

Pendant la majeure partie de 2025, la réponse pratique à "comment mon agent de coding pilote-t-il le web ?" était Playwright ou Puppeteer enveloppé dans un outil. Cela fonctionne pour les flux scriptés, mais échoue sur les cas intéressants — tout ce qui se trouve derrière un login, tout ce qui nécessite un vrai profil Chrome, tout ce que vous préféreriez ne pas ré-authentifier à chaque exécution. Un nouveau modèle a émergé mi-2026 : un navigateur à session partagée qui tourne parallèlement à vos propres onglets, donne à chaque agent son propre espace de travail isolé, et vous restitue des snapshots structurés de page au lieu de HTML brut. Le 24 juillet 2026, l'implémentation de référence — citrolabs/ego-lite — a atteint la #1 place du GitHub Trending, et chaque grande CLI d'agent (Claude Code, Codex, Cursor, Kiro) a reçu son support la même semaine.

Cette page est la lecture pratique de ce modèle : ce qu'il corrige que les outils de navigateur headless ne corrigent pas, comment il se branche sur Claude Code en particulier, et le compromis de sécurité que vous acceptez dès l'instant où vous laissez un agent partager votre session Google.

What you'll learn
  • Comprendre ce qu'est un « navigateur à session partagée pour agents » et pourquoi il surpasse Playwright headless dans les cas intéressants
  • Voir comment les Spaces isolent les onglets de l'agent des vôtres sans lancer de profils séparés
  • Apprendre ce que renvoie un snapshot sémantique (et pourquoi il utilise moins de tokens qu'un dump DOM)
  • Installer ego lite et son skill dans Claude Code avec deux commandes
  • Peser le coût de sécurité réel lié à la transmission à un agent de vos cookies de connexion — et savoir ce qu'il ne faut PAS faire

Le problème que ce modèle résout

Chaque agent ayant tenté de naviguer sur le web s'est heurté aux trois mêmes murs :

  1. Les murs de login. Tout ce qui se trouve derrière un SSO — GitHub, votre email, votre outil de suivi de projet, votre banque — est invisible pour un profil Playwright fraîchement créé. Stocker des identifiants dans la configuration d'un agent pour contourner cela est un incendie de sécurité.
  2. Les dumps DOM font exploser le budget de tokens. Une page Google Docs ou une application React moderne se transforme en snapshots de dizaines de milliers de tokens de bruit. La majeure partie est de l'échafaudage de mise en page dont le modèle n'a pas besoin.
  3. Votre Chrome et le Chrome de l'agent se battent pour la même fenêtre. Lancez une longue tâche de navigation et soit vous ne pouvez plus utiliser votre navigateur pendant 20 minutes, soit les onglets de l'agent interfèrent avec votre travail.

L'approche d'ego lite — et la raison pour laquelle le même modèle se répand désormais — est de traiter cela comme un seul et même problème. Faire tourner un unique build Chromium personnalisé. Donner à l'utilisateur ses propres onglets. Donner à chaque agent son propre Space — un espace de travail isolé avec sa propre pile d'onglets mais partageant le profil. Émettre des snapshots sémantiques au lieu de DOM brut. Tout reste local ; pas de gestion de profil séparée, pas de HTML envoyé ailleurs.

Spaces : comment l'isolation fonctionne réellement

D'après la documentation d'ego lite : « Les Spaces sont des espaces de travail que vous et votre agent pouvez utiliser tous les deux. Regroupez vos onglets par projet dans le vôtre ; votre agent exécute ses tâches dans le sien. » Le détail important est ce qu'un Space n'est pas — ce n'est pas un profil de navigateur séparé et ce n'est pas un pot de cookies séparé. C'est une surface d'onglets partitionnée partageant la même session sous-jacente. C'est ce qui rend possible la session partagée : lorsque le Space de l'agent navigue vers github.com, il hérite des mêmes cookies d'authentification que vos onglets connectés, sans que l'agent ait besoin de voir ou stocker vos identifiants.

L'isolation se situe au niveau de l'UX et de la gestion des onglets, et non au niveau de la frontière de sécurité. C'est la distinction porteuse que la plupart des reviewers ratent. C'est ce qui rend le modèle pratique (les agents fonctionnent tout simplement sur vos sites connectés) et c'est aussi pourquoi la section sécurité ci-dessous importe (un agent opérant dans un Space a les mêmes privilèges effectifs que vous).

Watch out

Le modèle Space partage les cookies de session par conception. C'est tout l'intérêt — et tout le risque. Tout ce qu'un agent compromis ou prompt-injecté peut faire dans son Space, il peut le faire en votre nom, sur n'importe quel site où vous êtes connecté. Traitez « donner un Space à mon agent » comme équivalent à « laisser mon agent agir en mon nom sur le web » — parce que c'est le cas.

Snapshots sémantiques vs. HTML brut

L'autre changement concerne ce que l'agent lit lorsqu'il « regarde » une page. Playwright vous remet un DOM. ego lite remet au modèle un snapshot sémantique — un résumé structuré des éléments interactifs de la page avec des références stables sur lesquelles agir, produit depuis l'intérieur d'un moteur Chromium personnalisé plutôt qu'un shim JavaScript sur Chrome standard. L'éditeur affirme que « les tâches complexes de navigateur se terminent jusqu'à 3,45x plus vite qu'avec agent-browser, avec moins de tokens » (lite.ego.app). Le multiplicateur exact dépend de la tâche ; la direction — moins de tokens, des actions ref plus fiables à travers les iframes et le shadow DOM — est l'insight durable, et c'est la même raison pour laquelle l'Accessibility Tree des Chrome DevTools et les propositions W3C émergentes de DOM orientées IA vont dans le même sens.

Pourquoi cela importe au-delà d'ego lite : l'idée « donner au modèle une vue sémantique, pas un dump DOM » va se répandre. Lorsque vous évaluerez un outil de navigateur-pour-agents au cours des 12 prochains mois, demandez quelle forme a le snapshot. S'il s'agit d'un dump HTML, vous le payez dans le nombre de tokens de chaque tour. S'il s'agit d'un snapshot structuré et référençable, l'agent peut planifier dessus à moindre coût.

Installer ego lite pour Claude Code

Deux artefacts, deux commandes. D'abord l'application navigateur (un build Chromium pour macOS — Windows et Linux sont sur la feuille de route mais pas livrés fin juillet 2026), puis le skill qui apprend à vos agents à lui parler.

Guided walkthrough1 of 5
  1. Téléchargez le .dmg depuis le site du projet (Apple Silicon ou Intel), ou installez via le flux documenté du projet. Le premier lancement propose une migration optionnelle des logins, cookies, extensions et signets Chrome vers le profil ego lite.

Claude Code — commencer petit : l'agent exécute une seule tâche authentifiée dans son propre Space

/ego-browser
Open my GitHub notifications tab. For each notification from the last 24 hours,
report: repo, kind (issue/PR/mention), title, and a one-line summary of the
newest comment. Do not click through, do not mark anything as read, do not
navigate away from the notifications page.

Remarquez ce que fait le prompt : il définit la surface (page de notifications), le périmètre en lecture seule (rapporter ; ne pas cliquer ; ne pas marquer), et l'artefact (une liste structurée). Chaque prompt que vous donnez à un agent à session partagée devrait avoir ces trois éléments, parce que vous l'exécutez en votre nom.

Ce qu'il y a réellement dans le skill ego-browser

Le skill expose un petit ensemble d'outils appelables en JavaScript contre lesquels l'agent écrit des snippets — navigate, snapshot, click, fill, wait, capture. L'approche basée sur le code est délibérée : au lieu d'une boucle d'appels d'outils bavarde où l'agent demande « clique s'il te plaît sur l'élément ref-12 », l'agent écrit un bloc JavaScript qui compose plusieurs actions et reçoit en retour un résultat structuré unique. C'est de là que vient en pratique l'affirmation « moins de tours, moins de tokens » — le nombre d'aller-retours chute.

Vous n'avez pas besoin d'écrire ces snippets vous-même. Le skill et le modèle le font. Ce que vous devez savoir, c'est :

  • Chaque action est référencée par rapport au dernier snapshot. Si la page a changé sous l'agent, la ref est périmée et l'outil renvoie une erreur — une propriété d'auto-correction importante.
  • Le skill inclut un install.md dans skills/ego-browser/references/ — un bon endroit à lire si votre agent se plaint de ne pas trouver le navigateur.
  • Le code source sous licence MIT vit sous citrolabs/ego-lite à environ 4,3k étoiles fin juillet 2026, et le même repo héberge les sources du skill ego-browser.

Le coût de sécurité que vous acceptez

C'est ici que la plupart des tweets enthousiastes s'arrêtent et où l'ingénierie intéressante commence.

Remettre à un agent un Space qui hérite de vos sessions connectées est fonctionnellement équivalent à lui donner vos cookies de session. Tout ce que la same-origin policy vous autoriserait vous à faire dans un navigateur — poster en votre nom, exfiltrer des documents de Google Drive, transférer de l'argent depuis une session bancaire, inviter un collaborateur extérieur à un repo privé — est dans les capacités de l'agent. Ce n'est pas un bug d'ego lite ; c'est la proposition de valeur. La posture de sécurité est le prix de l'ergonomie.

Trois pratiques concrètes réduisent le rayon d'explosion sans renoncer au bénéfice :

  • Des Spaces différents pour des niveaux de confiance différents. Google personnel + email dans un Space. SaaS professionnels dans un autre. Tout ce qui est expérimental ou non fiable (URLs arbitraires d'Internet) dans un troisième qui a été déconnecté de tout ce qui compte.
  • Ne jamais pointer un agent à session partagée vers une URL non fiable que vous n'avez pas récupérée vous-même. Toute la classe d'attaques par prompt injection indirecte atterrit le plus durement ici — une page peut porter des instructions cachées qui pilotent l'agent vers une action d'exfiltration de données contre vos autres sites connectés. Voir aussi : Navigateurs agentiques et risque same-origin.
  • Prompts en lecture seule par défaut. Demandez d'abord des résumés et des listes. N'introduisez des actions (clics, remplissages de formulaires) qu'après avoir vu le snapshot sur lequel l'agent raisonne. C'est la même discipline qui rend les exécutions autonomes sûres.

Où va ce modèle

Grok, Cursor et Kiro ont tous ajouté des intégrations de navigateur partagé le même mois, et le mécanisme sous-jacent — un Chromium personnalisé plus une couche skill qui émet des snapshots sémantiques — est susceptible d'être standardisé plutôt que possédé par un seul projet. La question intéressante à court terme n'est pas si chaque agent de coding obtient un mode navigateur partagé ; c'est de savoir si le format de snapshot converge (afin qu'un skill d'agent écrit pour un navigateur fonctionne sur un autre) ou se fragmente comme l'ont fait les premiers serveurs MCP.

Le concept à retenir : le navigateur devient une surface partagée entre humains et agents, pas deux navigateurs séparés pointant vers les mêmes pages. Cela remodèle ce que coûte « l'utilisation d'ordinateur » et ce vers quoi elle peut être pointée en toute sécurité. Voir aussi Agents d'utilisation d'ordinateur pour comparer la fonctionnalité de contrôle de navigateur propre à Claude avec ce modèle.

Vérifiez vos acquis

0/4
  1. Qu'est-ce qu'un Space dans ego lite ?
  2. Pourquoi un snapshot sémantique surpasse-t-il un dump DOM brut pour le travail d'agent ?
  3. Quel est le principal risque de sécurité d'un agent navigateur à session partagée ?
  4. Vous voulez essayer ego lite pour la première fois avec Claude Code. Quel est le prompt initial le plus sûr ?
Key takeaways
  • Les navigateurs à session partagée donnent aux agents leur propre Space dans votre vraie session de navigateur — résolvant les murs de login, le coût en tokens des dumps DOM et la contention de fenêtre en un seul design.
  • ego lite livre ce modèle pour macOS aujourd'hui ; le skill ego-browser (npx skills add citrolabs/ego-lite) le rend disponible pour Claude Code, Codex, Cursor et Kiro.
  • Les snapshots sémantiques réduisent les tokens par tour et fournissent des refs d'action stables ; le multiplicateur exact varie, la direction est l'insight durable.
  • Le coût de sécurité est réel : un agent dans un Space partagé a vos privilèges sur chaque site où vous êtes connecté. Utilisez des Spaces séparés par niveau de confiance, gardez les URLs non fiables à l'écart, préférez d'abord les prompts en lecture seule.
  • C'est un modèle, pas un produit. Attendez-vous à une convergence sur « le navigateur comme surface partagée entre humains et agents » à travers l'écosystème dans les 6 à 12 prochains mois.

Sources & lectures complémentaires