FAQ

Foire aux questions

Réponses rapides sur la configuration, les modèles, la facturation, la sécurité et le fonctionnement de WebBrain dans votre navigateur.

À propos de WebBrain

6
WebBrain est-il une alternative gratuite au plugin navigateur de Claude ?

Oui. WebBrain fournit des capacités d'agent IA similaires — lecture de pages, extraction de données, clics sur boutons, remplissage de formulaires et automatisation de flux multi-étapes. Contrairement au plugin propriétaire de Claude, qui nécessite un abonnement Claude Pro et ne fonctionne qu'avec les modèles d'Anthropic, WebBrain est totalement gratuit, open source (licence MIT) et prend en charge plusieurs fournisseurs de LLM, y compris des modèles locaux exécutés entièrement sur votre machine.

Quelle est la différence entre WebBrain et OpenClaw, Browser-Use et les autres frameworks d'agents IA ?

Ce sont des catégories d'outils différentes. WebBrain est une extension de navigateur — vous l'installez dans Chrome ou Firefox et discutez avec elle dans un panneau latéral, sans coder. Des frameworks comme OpenClaw et Browser-Use sont des SDK pour développeurs, destinés à construire des pipelines automatisés en Python, généralement avec des navigateurs headless et CDP. Autrement dit : WebBrain est pour naviguer au quotidien avec un assistant IA ; les frameworks sont pour construire des bots de scraping et automatiser des tests. Vous pouvez utiliser les deux — ils sont complémentaires.

WebBrain fonctionne-t-il sur Firefox ?

Oui. WebBrain est livré avec une version Chrome (Manifest V3, via l'API sidePanel) et une version Firefox (Manifest V2, via sidebar_action). Les deux versions ont les mêmes fonctionnalités. La version Firefox peut être chargée comme module temporaire pour le développement, ou publiée sur addons.mozilla.org pour une installation permanente.

Comment utiliser WebBrain pour le scraping et l'extraction de données ?

Ouvrez n'importe quelle page web, ouvrez le panneau latéral WebBrain et demandez en langage naturel : « Extrais tous les noms de produits et prix de cette page », « Donne-moi toutes les adresses e-mail de cette page » ou « Résume cet article en puces ». L'agent lit le contenu, comprend la structure et renvoie les données extraites. Pour du scraping plus complexe, passez en mode Agir : l'agent peut naviguer entre les pages, cliquer sur les boutons de pagination et agréger les données sur plusieurs pages.

WebBrain prend-il en charge un mode dry-run ?

À partir de la version 7.0.0, pas encore. Le mode dry-run est prévu et figure déjà sur la feuille de route.

Puis-je contribuer à WebBrain ?

Absolument ! WebBrain est sous licence MIT et accueille les contributions. Consultez le dépôt GitHub pour les issues, demandes de fonctionnalités et consignes de contribution.

Cloud et facturation

4
Combien coûte un abonnement WebBrain Cloud ?

WebBrain Cloud coûte actuellement 5 $/mois par profil d’appareil, bien moins cher que Claude Pro pour le moment. L’usage est actuellement illimité dans le cadre d’une politique d’utilisation équitable : l’usage personnel normal convient, mais l’abus, l’automatisation excessive, la revente ou les volumes anormalement élevés ne sont pas autorisés.

L’abonnement est lié à l’identifiant d’appareil généré par l’extension pour ce GUID navigateur + OS, pas à un compte utilisateur. Si cet identifiant est perdu parce que vous réinitialisez le stockage de l’extension, supprimez le profil du navigateur, réinstallez le navigateur, changez de navigateur/OS ou perdez l’appareil, nous ne pouvons pas le récupérer ni le transférer et nous ne remboursons pas cette perte.

Comment gérer ou annuler mon abonnement ?

Gérez la facturation sur api.webbrain.one/account et connectez-vous avec votre adresse e-mail.

Comment fonctionne la synchronisation cloud chiffrée ?

Cloud Sync est une fonctionnalité optionnelle pour les abonnés actifs à WebBrain Cloud. Elle synchronise vos mémoires WebBrain, le texte d'auto-remplissage du profil et la configuration des fournisseurs prise en charge, y compris les clés API. Elle ne synchronise pas l'historique de chat, l'historique du navigateur, les captures de page, ni les jetons OAuth d'accès et d'actualisation hérités.

Votre navigateur chiffre le coffre de synchronisation avant l'envoi avec un mot de passe que vous choisissez. WebBrain Cloud ne stocke que le coffre chiffré ; il ne peut pas lire vos mémoires, le texte du profil, les paramètres des fournisseurs ni les clés API, et ne peut pas récupérer le mot de passe de synchronisation pour vous.

Le champ e-mail sert à l'authentification de facturation/abonnement par magic-link WebBrain Cloud. Ce n'est pas un mot de passe de compte. Si l'interface indique de changer le mot de passe dans Cloud Sync, il s'agit du mot de passe de chiffrement de la synchronisation, pas d'un mot de passe de compte WebBrain.

Si vous oubliez le mot de passe de synchronisation, l'ancien coffre chiffré dans le cloud ne peut pas être déchiffré. Vous pouvez réinitialiser le coffre cloud et téléverser une nouvelle copie chiffrée depuis un appareil qui possède encore les données en local.

Comment WebBrain garde-t-il sous contrôle les factures des LLM cloud ?

Trois couches indépendantes :

Captures économes en tokens. Avant qu'une image ne quitte votre machine, WebBrain la redimensionne (côté court plafonné, ratio conservé) et la compresse itérativement en JPEG jusqu'à entrer dans le budget de tokens d'image par tour. Une capture 2000×1200 qui vous coûterait environ 1 500 tokens d'entrée sur GPT-4o est ramenée à environ 300–500 tokens sans perte pratique pour la lecture de pages. Implémenté dans _fitImageDimensions avec des tests unitaires sur le calcul du budget.

Rognage intelligent du contexte. Historique, sortie d'outils et dumps DOM inline sont plafonnés par tour et rognés du plus ancien au plus récent quand le contexte du modèle actif approche de la saturation. Vous ne verrez pas une exécution passer silencieusement de 10 k à 100 k tokens parce qu'un read_page a renvoyé un article interminable.

Modèle de vision dédié. Combinez un modèle texte bon marché (par ex. GPT-4o-mini) pour la planification et les appels d'outils avec un modèle de vision (par ex. GPT-4o) réservé aux captures, pour ne pas payer le tarif multimodal à chaque tour. À configurer dans Paramètres → Vision.

Résultat : les longues sessions avec des fournisseurs cloud restent prévisibles. Pour un contrôle total, utilisez llama.cpp en local — coût par token nul.

Modèles et configuration locale

7
Puis-je utiliser WebBrain totalement hors ligne ?

Oui. Le fournisseur par défaut de WebBrain est llama.cpp, qui exécute un modèle IA local sur votre ordinateur. Aucune clé d'API, aucune connexion Internet pour l'IA et aucune donnée ne quitte votre machine. Téléchargez un modèle GGUF, démarrez llama-server et vous disposez d'un agent IA totalement privé. Vous pouvez aussi utiliser Ollama via son endpoint compatible OpenAI.

Quels modèles d'IA WebBrain prend-il en charge ?

WebBrain prend en charge quatre types de fournisseurs : llama.cpp (n'importe quel modèle GGUF local), OpenAI (GPT-4o, GPT-4, etc.), Claude (Claude Opus, Sonnet, Haiku via l'API native) et OpenRouter (accès à plus de 100 modèles de divers fournisseurs). Tout endpoint compatible OpenAI fonctionne : vous pouvez donc aussi utiliser des services comme Together AI, Groq, Mistral ou tout serveur local à interface compatible OpenAI.

Pourquoi WebGPU est-il disponible uniquement dans le mode Apocalypse ?

Parce que nous ne considérons pas encore l'inférence de texte WebGPU dans le navigateur comme suffisamment fiable pour la plupart des utilisateurs, et nous ne voulons pas vous imposer une mauvaise expérience. Si vous souhaitez utiliser localement le même modèle LFM2.5 2.6B, exécutez l'inférence sur votre machine avec llama.cpp ou Ollama, puis configurez WebBrain pour utiliser ce point de terminaison local au lieu de dépendre de WebGPU.

Le mécanisme de secours visuel WebGPU reste disponible, car son modèle est beaucoup plus petit et il n'est utilisé qu'occasionnellement.

J'obtiens « Failed to fetch » en me connectant à un serveur LLM local (vLLM, Ollama, llama.cpp) sur mon réseau

Si votre serveur LLM est sur une autre machine du réseau local (par ex. http://192.168.1.x:8000), Chrome bloque la requête sauf si le serveur envoie des en-têtes CORS. La solution dépend du serveur :

vLLM : démarrer avec --allowed-origins '["*"]' (la valeur doit être une liste JSON).
Ollama : définir la variable OLLAMA_ORIGINS=* avant le démarrage.
llama.cpp : CORS est activé par défaut — rien à changer.

Si votre serveur tourne sur localhost (même machine que le navigateur), CORS n'est généralement pas requis. Le problème concerne seulement les connexions entre machines sur le réseau local. Vérifiez que l'URL de base dans les paramètres WebBrain se termine par /v1 (par ex. http://192.168.1.47:8000/v1). Exception : Ollama utilisé depuis une extension navigateur peut quand même nécessiter OLLAMA_ORIGINS ; consultez la FAQ Ollama ci-dessous.

Pourquoi Ollama sur localhost renvoie-t-il 403 depuis l’extension WebBrain ?

Les versions récentes d’Ollama peuvent rejeter les requêtes provenant d’origines d’extensions navigateur même quand Ollama tourne sur la même machine. L’extension envoie une origine Origin comme chrome-extension://... ou moz-extension://..., et Ollama peut répondre 403 si ces origines ne sont pas autorisées.

Quittez toute application de bureau Ollama qui occupe déjà le port 11434, puis démarrez Ollama avec l’une de ces commandes :

OLLAMA_ORIGINS="*" ollama serve
OLLAMA_ORIGINS="chrome-extension://*,moz-extension://*" ollama serve

Gardez l’URL de base Ollama de WebBrain sur http://localhost:11434/v1. Les tests curl dans le terminal peuvent toujours fonctionner sans ce réglage, car ils n’envoient pas d’origine d’extension navigateur.

Puis-je l'utiliser aussi dans LM Studio ?

Oui. Les outils réseau en lecture seule de WebBrain — fetch_url et research_url — sont aussi publiés comme plugin autonome LM Studio sur webbrain/web-tools. Installez-le avec lms clone webbrain/web-tools et activez-le dans n'importe quel chat LM Studio — tout modèle compatible avec les outils peut alors appeler ces deux outils sans que vous installiez l'extension navigateur. Pur Node, pas de navigateur headless. Source : lmstudio-plugin/.

Navigateurs et utilisation quotidienne

5
Puis-je déplacer la barre latérale de Firefox de la gauche vers la droite, comme le panneau latéral de Chrome ?

Oui — la barre latérale de Firefox est à gauche par défaut, mais vous pouvez la basculer à droite. Faites un clic droit dans l'en-tête de la barre latérale et choisissez Déplacer la barre latérale à droite (ou passez par Affichage → Barre latérale → Déplacer la barre latérale à droite dans la barre de menus). La position est conservée entre les redémarrages. Le sidePanel de Chrome est à droite par défaut et n'est pas déplaçable par l'utilisateur depuis le panneau lui-même.

Y a-t-il des limitations lorsque WebBrain est utilisé dans le panneau Web de Vivaldi ?

Oui. Les panneaux Web de Vivaldi bloquent les boîtes de dialogue JavaScript natives telles que confirm(), alert() et prompt(). Le sélecteur des modes Ask, Act et Dev de WebBrain ne dépend plus de ces boîtes de dialogue, mais quelques actions secondaires les utilisent encore.

Enregistrement : N'utilisez pas encore /record dans Vivaldi. Si l'enregistrement échoue, Vivaldi peut masquer l'alerte d'erreur et ne fournir aucune explication visible.

Paramètres, Historique, Traces et transfert vers Ollama : Ces pages contiennent aussi des boîtes de dialogue natives, mais WebBrain les ouvre normalement dans des onglets ordinaires, où elles fonctionnent. Si vous en placez une manuellement dans un panneau Web, ouvrez-la dans un onglet normal avant d'utiliser une action dépendant d'une boîte de dialogue.

Puis-je faire défiler la page vers le haut ou le bas pendant que WebBrain travaille dans mon onglet ?

La plupart du temps, oui — surtout en mode Ask pour les demandes en lecture seule telles que « Résume cette page ». Vous pouvez continuer à faire défiler la page pendant que WebBrain travaille.

Quand faut-il éviter de le faire ? Les captures automatiques reflètent la zone actuellement visible dans l'onglet. Lorsque WebBrain inspecte ou manipule activement du contenu visible en mode Act ou Dev, le défilement peut déplacer une cible ou modifier ce que voit le modèle. Laissez cette étape se terminer avant de faire défiler la page ; en dehors de ces moments, vous pouvez continuer à l'utiliser.

Puis-je changer d'onglet pendant que WebBrain travaille sur une page ?

Oui. Depuis la version 27.0.0, WebBrain évite de prendre le focus dans les navigateurs basés sur Chromium comme dans Firefox, sauf si un accès au premier plan est strictement nécessaire. L'exécution reste liée à l'onglet où elle a commencé, vous pouvez donc travailler sans risque dans un autre onglet.

Si une étape rare exige que l'onglet d'origine soit au premier plan, WebBrain peut lui donner brièvement le focus. Évitez de cliquer ou de saisir du texte dans ce même onglet pendant que WebBrain y effectue activement des actions.

Que fait WebBrain avec les bannières de cookies et les paywalls ?

Bannières de cookies : WebBrain reconnaît les bannières de consentement des frameworks courants (OneTrust, Cookiebot, Didomi, Quantcast, Google Funding Choices, TrustArc) et les écarte avant de raisonner sur la page. Priorité à « Tout refuser » / « Refuser non essentiels » / « Uniquement nécessaires » quand c'est clairement visible ; par défaut, il choisit « Tout accepter » plutôt que de se perdre dans le labyrinthe « Gérer les préférences ».

Paywalls : WebBrain signale le paywall honnêtement et vous dit ce qu'il a réellement pu voir (titre, chapô, premiers paragraphes). Il n'essaie pas de contourner les paywalls — pas d'archive.today, pas de 12ft.io, pas d'effacement de cookies, pas de désactivation du JS, pas de ruses de mode lecture. Pour l'article complet, connectez-vous avec un abonnement ou demandez à WebBrain de chercher une couverture gratuite de la même histoire.

Sécurité et confidentialité

7
WebBrain est-il sûr ? Peut-il modifier les pages web ?

WebBrain comporte trois modes. Le mode Demander (par défaut) est en lecture seule et ne peut rien modifier sur la page. Le mode Agir permet de cliquer, saisir et naviguer, tandis que le mode Dev ajoute des outils de débogage de page. Les actions ayant des conséquences demandent une approbation par défaut ; si cette barrière d'autorisation est désactivée, WebBrain affiche un avertissement visible. Vous pouvez arrêter l'agent à tout moment avec le bouton Arrêter. Le code source de l'extension est entièrement ouvert à l'audit sur GitHub.

Qu'est-ce que la bannière « WebBrain started debugging this browser » ? Pourquoi WebBrain utilise-t-il CDP ?

Pour agir sur une page de manière fiable, WebBrain utilise le Chrome DevTools Protocol (CDP) via l'API d'extension standard chrome.debugger — c'est ce qui déclenche la bannière de Chrome « WebBrain started debugging this browser ». CDP permet à l'agent de cliquer et de saisir avec des événements d'entrée de confiance que les sites modernes acceptent réellement ; les événements synthétiques émis depuis un content script sont rejetés par de nombreux sites, par les Web Components et par les champs contrôlés par des frameworks. C'est aussi ainsi que WebBrain capture des captures d'écran au pixel près pour le repli vision et accède aux iframes cross-origin et au shadow DOM que les content scripts ne peuvent pas voir.

Le mode Demander, en lecture seule, n'a pas besoin de CDP : les lectures de la page et de l'arbre d'accessibilité passent par des content scripts ordinaires. Ce sont la fiabilité du mode Agir et le travail cross-origin qui l'exigent, et dans une extension Manifest V3 il n'existe aucune API sans débogueur pour l'entrée de confiance. WebBrain attache le débogueur uniquement quand une action en a besoin, par onglet, et toute l'extension est open source, vous pouvez donc auditer exactement ce que fait la session. CDP est puissant, c'est pourquoi nous traitons son empreinte comme quelque chose à contenir (attacher à la demande, garder les lectures en dehors), et la réduire davantage figure dans notre feuille de route sécurité.

Il me pose trop de questions. Puis-je désactiver cela ?

Ces demandes d’approbation servent à votre sécurité. Même sur des sites auxquels vous faites confiance, des acteurs malveillants peuvent imiter des instructions de LLM ou injecter du contenu qui tente de faire agir l’agent en votre nom d’une manière que vous n’approuveriez pas. C’est pourquoi WebBrain demande votre accord avant les actions importantes. Si vous ne voulez quand même pas passer par ces demandes, vous pouvez les désactiver : ouvrez le plugin latéral, cliquez sur l’icône de roue dans l’en-tête, allez dans l’onglet Permissions de settings.html, puis désactivez Ask before consequential actions.

WebBrain appelle-t-il les API directement ou passe-t-il toujours par l'interface ?

Par défaut, WebBrain passe toujours par l'interface visible pour toute action qui crée, modifie, supprime, envoie, publie, poste ou achète quoi que ce soit. Il navigue jusqu'à la page, remplit le formulaire et clique sur le bouton — exactement comme vous. Il refuse d'appeler directement des endpoints REST/GraphQL via fetch() en arrière-plan pour des mutations. C'est délibéré : les actions par API sont invisibles (vous ne voyez pas ce qui est envoyé), exigent souvent des jetons d'auth que vous n'avez peut-être pas configurés, et ont un rayon d'impact bien plus large qu'un mauvais clic visible. UI-first signifie que tout est à l'écran, dans votre session habituelle, et interruptible.

Pour lire des données — récupérer un README, consulter un ticket, comparer des prix, vérifier une page de statut — WebBrain utilise librement les requêtes HTTP en arrière-plan via les outils fetch_url et research_url. Lire n'est pas agir ; rien ne change sur un service distant, donc les garde-fous ne s'appliquent pas.

Si vous voulez autoriser les mutations par API pour une tâche précise, tapez /allow-api en début de message (éventuellement suivi d'une courte description). Cette dérogation par conversation permet à WebBrain de basculer vers des endpoints API quand l'interface échoue vraiment, tout en privilégiant l'UI quand elle fonctionne. Un badge collant reste visible au-dessus de la zone de saisie tant que la dérogation est active, et se dissipe quand vous réinitialisez la conversation.

Comment fonctionne l'auto-remplissage de profil, et est-ce sûr ?

L'auto-remplissage de profil est une fonctionnalité optionnelle dans Paramètres → Profil. Vous saisissez une courte bio — nom, e-mail pro, entreprise et un mot de passe jetable pour les inscriptions à faible enjeu — et vous l'activez. Une fois actif, WebBrain ajoute ce texte au prompt système de l'agent, afin qu'il puisse remplir les formulaires d'inscription sans vous demander à chaque fois.

Le texte est stocké en clair dans le stockage local du navigateur. Il n'est pas transmis au projet WebBrain, mais il est envoyé au fournisseur de LLM que vous avez configuré à chaque tour, dans le prompt système. Désactivé par défaut.

N'y mettez pas les mots de passe de comptes importants (Google, Apple, iCloud, banque, SSO pro, e-mail principal). Ces comptes devraient utiliser la 2FA et ne devraient pas être confiés à un agent. L'usage prévu est un mot de passe jetable réutilisé pour des newsletters et des essais gratuits.

Le réglage Floutage des captures d'écran garantit-il que mes données privées n'atteignent jamais un modèle de vision cloud ?

Non — cela réduit l'exposition, ce n'est pas une garantie. Une fois activé (Paramètres → Multimodal → Floutage des captures d'écran, désactivé par défaut), WebBrain pixellise les champs de formulaire et le texte qui ressemble à une adresse e-mail ou un numéro de téléphone sur chaque capture d'écran avant qu'elle soit envoyée à un modèle de vision. La détection s'exécute entièrement sur votre appareil via des heuristiques DOM ; rien de plus n'est transmis.

C'est du meilleur effort, en mode fail-open. Si le détecteur ne peut pas s'exécuter sur une page — par exemple juste après une navigation, dans les visionneuses PDF, ou sur des pages restreintes du navigateur — la capture est quand même envoyée non floutée plutôt que d'annuler votre tâche. Un contenu que les heuristiques DOM ne peuvent pas voir (texte dessiné sur un canvas, données personnelles dans des images, widgets inhabituels) peut aussi passer au travers. Et le réglage ne couvre que les captures d'écran : le texte de la page envoyé au modèle n'est pas flouté par ce réglage.

Pour une confidentialité totale en vision, utilisez un modèle local. Avec un fournisseur hors ligne comme llama.cpp ou Ollama, les captures d'écran et le texte de la page ne quittent jamais votre machine, donc il n'y a rien à flouter au départ — c'est la seule configuration où la confidentialité est garantie. Voir « Puis-je utiliser WebBrain totalement hors ligne ? » ci-dessus.

Pas de machine capable de faire tourner un modèle local avec vision ? Un bon compromis consiste à utiliser un petit modèle local pour la planification et les appels d'outils (assez léger pour un CPU/GPU modeste), associé à un fournisseur cloud pour les sous-appels de vision, avec le Floutage des captures d'écran activé. Votre conversation et le texte de la page restent sur l'appareil, et chaque capture qui part vers la vision cloud a déjà ses champs de formulaire et e-mails/téléphones détectés floutés — moins d'exposition cloud, sans besoin de matériel pour un modèle de vision local complet. Configurez cette répartition sous Paramètres → Vision (voir « Comment WebBrain garde-t-il sous contrôle les factures des LLM cloud ? » ci-dessus).

WebBrain envoie-t-il l’intégralité du DOM au modèle d’IA ?

Non. Par défaut, WebBrain n’envoie ni le HTML brut ni une copie brute du DOM. Il commence par l’URL et le titre de la page, les indications correspondant au site et, si la vision est activée, une capture facultative de la zone visible.

Lorsqu’une tâche nécessite le contenu de la page, WebBrain le lit à la demande sous forme d’arbre d’accessibilité sémantique réduit ou de texte extrait. Les lectures sont filtrées selon la visibilité lorsque c’est pertinent, limitées en nombre de caractères et paginées. L’accès au code source brut de la page est réservé au mode Dev.