A IA de código aberto Agente do navegador

WebBrain é uma extensão de navegador gratuita e de código aberto que traz recursos de agente de IA para o seu navegador. Leia páginas, extraia dados e automatize tarefas da web - com a tecnologia de LLM de sua escolha. A alternativa auto-hospedável aos plug-ins proprietários de IA de navegador.

Instalar extensão Ver em GitHub
https://magazine.dev/local-ai-2026

O futuro da IA local

Por Jane Smith · 8 min de leitura
WebBrain.one
Resuma este artigo
Os LLMs locais agora correspondem à qualidade da nuvem em muitas tarefas – impulsionados por melhor quantização, GPUs de consumo mais rápidas e uma mudança que prioriza a privacidade.
O que o autor prevê para 2026?
Lembrando o contexto do artigo
Por 2026, o autor espera que mais de 70% das cargas de trabalho de IA do consumidor sejam executadas no dispositivo.
Pergunte qualquer coisa sobre esta página...
Demonstração

Veja WebBrain em ação

Veja como o WebBrain lê páginas, extrai dados e automatiza tarefas do navegador.

Recursos

Tudo que você precisa em um navegador AI

Um agente de IA completo que fica na barra lateral do seu navegador e entende qualquer página da web.

📖

Compreensão da página

Lê e compreende qualquer página da web – artigos, documentos, painéis, formulários. Faça perguntas e obtenha respostas instantâneas do conteúdo atual da página.

🤖

Agente de navegador completo

Clique, digite, role, navegue e interaja com as páginas em seu nome. Automatize tarefas repetitivas com instruções em linguagem natural.

📊

Extração de dados

Extraia dados estruturados de qualquer página — tabelas, listas, links, formulários. Exporte catálogos de produtos, resultados de pesquisa ou qualquer conteúdo de página. Funciona com PDFs.

🔌

LLM multi-provedor

Funciona com llama.cpp, OpenAI, Claude e OpenRouter locais. Use seu modelo preferido ou execute totalmente offline com IA local.

🛡️

Privacidade em primeiro lugar

Seus dados permanecem seus. Execute com um LLM local para zero vazamento de dados. Sem telemetria, sem rastreamento, sem necessidade de contas. Totalmente de código aberto.

Contexto Inteligente

O gerenciamento automático de contexto evita o estouro de token. Reduz de forma inteligente o histórico de conversas e limita a saída da ferramenta para sessões tranquilas e ininterruptas.

👁️

Modelo de visão dedicado

Combine um modelo rápido somente de texto para planejamento com um modelo separado com capacidade de visão para leitura de capturas de tela. Mais barato e rápido do que usar um único grande modelo multimodal para tudo.

👤

Preenchimento automático de perfil

Biografia opcional em texto simples - nome, e-mail comercial, empresa, uma senha descartável - permite que o agente passe rapidamente por formulários de inscrição de baixo risco sem perguntar sempre. Desativado por padrão, todos armazenados localmente.

🍪

Ciente de cookies e acesso pago

Ignora banners de consentimento (OneTrust, Cookiebot, Didomi, Quantcast) antes de raciocinar sobre a página. Detecta paywalls e informa honestamente, em vez de fabricar o conteúdo do artigo ou tentar contorná-los.

🧩

Solucionador CAPTCHA opcional

Conecte um CapSolver A chave de API e o agente resolverão automaticamente reCAPTCHA v2/v3, hCaptcha e Cloudflare Turnstile quando bloquearem uma etapa – em vez de parar para perguntar. Desativado por padrão, chave BYO, nenhum serviço captcha é enviado ou contatado a menos que você o ative.

🌐

UI multilíngue

O plugin é fornecido em inglês, espanhol, francês, turco e 中文. Detecta automaticamente o idioma do seu navegador na primeira utilização; alterne a qualquer momento no ícone do globo no painel lateral. O site de marketing está localizado para corresponder.

💰

Consciente do Token

As capturas de tela são redimensionadas e compactadas iterativamente em JPEG antes de saírem da máquina, mantendo os tokens de imagem pequenos. O corte inteligente de contexto e os limites de saída de ferramentas mantêm as contas da nuvem previsíveis – sem gastos surpreendentes em sessões longas.

Segurança

Como WebBrain mantém você no controle

O navegador é onde o trabalho real acontece – e uma superfície adversária. WebBrain inicia no modo Ask somente leitura, pergunta antes de agir, defende contra injeções de prompt ocultas e lida com campos confidenciais com regras mais rígidas.

Provedores de LLM

Traga sua própria IA

Conecte-se a qualquer API compatível com OpenAI ou execute um modelo local. Troque de provedor a qualquer momento nas configurações da extensão. Para modelos locais, forneça a eles pelo menos uma janela de contexto de 16 mil tokens (8k funciona no modo Compacto) — WebBrain compacta automaticamente a conversa à medida que ela se aproxima do limite.

🦙
llama.cpp
Ollama
OpenAI
Claude
OpenRouter
LM Studio
vLLM
Grok
Gemini
DeepSeek
Mistral
Logotipo WebBrain, um coração e o logotipo Ollama para o anúncio de transferência de lançamento
Transferência de lançamento Ollama

Escolha um modelo Ollama e entregue-o a WebBrain

Um novo caminho de inicialização pode configurar WebBrain para um modelo Ollama local a partir de um comando de terminal. Ele está disponível hoje em nossa filial Ollama enquanto trabalhamos para integração upstream.

Leia o anúncio
Comece

Instale WebBrain

Disponível para Chrome, Edge e Firefox. Gratuito, de código aberto, sem necessidade de conta.

Chrome e cromo

Manifest V3 · Chrome 116+ · Também funciona com Brave, Opera, Vivaldi e outros navegadores compatíveis com Chromium.

Firefox

Manifesto V2 · Firefox 109+

Microsoft Edge

Manifesto V3 · Windows 10/11 · Requer Microsoft Edge no Windows.

Por que WebBrain?

Como o WebBrain se compara?

WebBrain fica na interseção de plug-ins de IA nativos do navegador e estruturas completas de agentes. Veja como isso se compara.

vs. plug-ins de IA do navegador

Recurso WebBrain Claude em Chrome
Código abertoLicença MITProprietário
PreçoGrátis para sempreRequer Claude Pro (US$ 20/mês)
Suporte LLM localllama.cpp, OllamaNão - apenas Claude
Multi-provedorTodos os endpoints compatíveis com OpenAIApenas Cláudio
ChromeSim (MV3)Sim
FirefoxSim (MV2)Não
IU do painel lateralSimSim
Modos Perguntar/AgirSimSemelhante
Totalmente off-lineSim (com LLM local)Não – nuvem necessária
Auto-hospedávelSimNão

versus estruturas de agente de IA (categoria diferente)

Aspecto WebBrain OpenClaw / Uso do navegador / etc.
O que é isso?Extensão do navegador (ferramenta do usuário final)Estrutura de agente/SDK (ferramenta de desenvolvedor)
Usuário alvoQualquer pessoa – sem necessidade de codificaçãoDesenvolvedores criando automações
InstalaçãoInstalação do navegador com um cliqueConfiguração Python/Docker necessária
IUBate-papo integrado no painel lateralSem UI – apenas código ou API
Controle do navegadorScript de conteúdo (leve)CDP / Dramaturgo (controle total)
Fluxos de trabalho com várias guiasConversas por guiaOrquestração multi-guias programável
Modo sem cabeçaNão – é executado no seu navegadorSim – automação sem cabeça
ExtensibilidadeAdicione provedores de LLM personalizadosSDK Python completo, ferramentas personalizadas
Melhor paraAssistente de IA de navegação diáriaPipelines de raspagem/teste automatizados

WebBrain é uma extensão de navegador para usuários finais que desejam um assistente de IA enquanto navegam. Estruturas de agentes como OpenClaw são ferramentas de desenvolvedor para construir pipelines de navegador automatizados. Ferramentas diferentes para trabalhos diferentes — e você pode usar ambas.

Perguntas frequentes

Perguntas frequentes

WebBrain é uma alternativa gratuita ao plugin do navegador de Claude?

Sim. WebBrain fornece recursos semelhantes de agente de navegador de IA – leitura de páginas, extração de dados, clique em botões, preenchimento de formulários e automatização de fluxos de trabalho de várias etapas. Ao contrário do plugin de navegador proprietário de Claude, que requer uma assinatura Claude Pro e só funciona com os modelos Anthropic, WebBrain é totalmente gratuito, de código aberto (licença MIT) e oferece suporte a vários provedores LLM, incluindo modelos locais que rodam inteiramente em sua máquina.

Quanto custa uma assinatura do WebBrain Cloud?

WebBrain Nuvem está atualmente US$ 5/mês por perfil de dispositivo, muito mais barato que Claude Pro por enquanto. O uso é atualmente ilimitado de acordo com uma política de uso justo: o uso pessoal normal é aceitável, mas o uso abusivo, automatizado, de revenda ou de volume incomumente alto não é permitido.

A assinatura está vinculada ao identificador do dispositivo gerado pela extensão desse navegador + GUID do sistema operacional, e não a uma conta de usuário. Se esse identificador for perdido porque você redefiniu o armazenamento da extensão, excluiu o perfil do navegador, reinstalou o navegador, alterou o navegador/sistema operacional ou perdeu o dispositivo, não poderemos recuperá-lo ou transferi-lo e não emitimos reembolsos por essa perda.

Você pode assinar ou gerenciar o faturamento no Conta seção da página de configurações do plugin com o Gerenciar faturamento botão. Para cancelar manualmente, entre em contato conosco por e-mail com o endereço de e-mail que você usou na finalização da compra.

Como funciona o Cloud Sync criptografado?

Cloud Sync é um recurso opcional para assinantes WebBrain Cloud ativos. Ele sincroniza suas memórias WebBrain, texto de preenchimento automático de perfil e configuração de provedor compatível, incluindo chaves de API. Isso acontece não sincronizar histórico de bate-papo, histórico do navegador, capturas de tela de páginas ou acesso OAuth legado e tokens de atualização.

Seu navegador criptografa o cofre de sincronização antes do upload com uma senha que você escolher. WebBrain Cloud armazena apenas o cofre criptografado; ele não pode ler suas memórias, texto do perfil, configurações do provedor ou chaves de API e não pode recuperar a senha de sincronização para você.

O campo de e-mail é para autenticação de assinatura/faturamento de link mágico WebBrain Cloud. Não é uma senha de conta. Se a IU disser alterar senha no Cloud Sync, isso significa que o senha de criptografia de sincronização, não uma senha de conta WebBrain.

Se você esquecer a senha de sincronização, o antigo cofre na nuvem criptografado não poderá ser descriptografado. Você pode redefinir o cofre na nuvem e fazer upload de uma nova cópia criptografada de um dispositivo que ainda tenha os dados localmente.

Como o WebBrain se compara ao OpenClaw, Browser-Use e outras estruturas de agente de IA?

São categorias diferentes de ferramentas. WebBrain é uma extensão do navegador – você a instala em Chrome ou Firefox e conversa com ela em um painel lateral, sem necessidade de codificação. Frameworks como OpenClaw e Browser-Use são SDKs de desenvolvedor para construir pipelines de navegador automatizados em Python, normalmente usando navegadores headless e CDP. Pense desta forma: WebBrain é para navegação diária com um assistente de IA; estruturas de agentes servem para construir bots de scraping e automação de testes. Você pode usar ambos – eles se complementam.

Posso usar o WebBrain totalmente offline?

Sim. O provedor padrão do WebBrain é llama.cpp, que executa um modelo de IA local em seu computador. Nenhuma chave de API é necessária, nenhuma Internet é necessária para a IA e nenhum dado sai de sua máquina. Basta baixar um modelo GGUF, iniciar o llama-server e você terá um agente de navegador de IA totalmente privado. Você também pode usar Ollama com seu endpoint compatível com OpenAI.

Quais modelos de IA o WebBrain suporta?

WebBrain oferece suporte a quatro tipos de provedores: llama.cpp (qualquer modelo GGUF local), OpenAI (GPT-4o, GPT-4, etc.), Claude (Claude Opus, Sonnet, Haiku via API nativa) e OpenRouter (acesso a mais de 100 modelos de vários fornecedores). Qualquer endpoint de API compatível com OpenAI funciona, então você também pode usar serviços como Together AI, Groq, Mistral ou qualquer servidor local com uma interface compatível com OpenAI.

Qual é o modelo mais recomendado?

A partir de 21 de abril de 2026, a principal recomendação é Qwen 3.6 35B. Por quê: em nosso benchmark de visão (tiroteio de modelo de visão), superou o Gemma 4 na compreensão de capturas de tela, permanecendo prático para inferência local.

Para GPUs de consumo, o RTX 5090 é ideal, e o RTX 4090 geralmente funciona com quantização INT4 AutoRound via Intel/Qwen3.6-35B-A3B-int4-AutoRound.

Para velocidade máxima, recomendamos servir em vLLM. Comando de exemplo:

python -u -m vllm.entrypoints.openai.api_server --model Intel/Qwen3.6-35B-A3B-int4-AutoRound --served-model-name qwen3.6-35b --quantization auto --dtype bfloat16 --max-model-len 65536 --max-num-batched-tokens 32768 --max-num-seqs 4 --host 0.0.0.0 --port 8000 --gpu-memory-utilization 0.92 --enable-prefix-caching --enable-chunked-prefill --limit-mm-per-prompt '{"image": 4, "video": 1}' --mm-processor-cache-type shm --reasoning-parser qwen3 --enable-auto-tool-choice --tool-call-parser qwen3_coder --trust-remote-code --allowed-origins '["*"]' --speculative-config '{"method": "dflash", "model": "z-lab/Qwen3.6-35B-A3B-DFlash", "num_speculative_tokens": 15}' --attention-backend flash_attn

A decodificação especulativa DFlash é opcional.

Estou recebendo "Falha ao buscar" ao conectar-me a um servidor LLM local (vLLM, Ollama, llama.cpp) na minha rede

Se o seu servidor LLM estiver em uma máquina diferente na sua rede local (por exemplo, http://192.168.1.x:8000), Chrome bloqueia a solicitação, a menos que o servidor envie Cabeçalhos CORS. A correção depende do seu servidor:

vLLM: Comece com --allowed-origins '["*"]' (o valor deve ser uma lista JSON).
Ollama: Defina a variável de ambiente OLLAMA_ORIGINS=* antes de começar.
llama.cpp: O CORS está habilitado por padrão – nenhuma alteração é necessária.

Se o seu servidor for executado em localhost (mesma máquina do navegador), o CORS geralmente não é necessário. O problema afeta apenas conexões entre máquinas na rede local. Certifique-se de que seu URL base nas configurações WebBrain termine com /v1 (por exemplo http://192.168.1.47:8000/v1). Exceção: Ollama usado em uma extensão do navegador ainda pode precisar OLLAMA_ORIGINS; consulte as perguntas frequentes sobre Ollama abaixo.

Por que Ollama em localhost retorna 403 da extensão WebBrain?

Versões recentes do Ollama podem rejeitar solicitações de origens de extensão do navegador, mesmo quando o Ollama está sendo executado na mesma máquina. A extensão envia um Origin como chrome-extension://... ou moz-extension://...e Ollama podem responder 403, a menos que essas origens sejam permitidas.

Encerre qualquer aplicativo de desktop Ollama que já esteja segurando a porta 11434e inicie Ollama com um destes comandos:

OLLAMA_ORIGINS="*" ollama serve
OLLAMA_ORIGINS="chrome-extension://*,moz-extension://*" ollama serve

Mantenha o URL base WebBrain de Ollama definido como http://localhost:11434/v1. Terminais curl as verificações ainda podem funcionar sem essa configuração porque não enviam uma origem de extensão do navegador.

WebBrain funciona em Firefox?

Sim. WebBrain é fornecido com uma versão Chrome (Manifesto V3, usando a API sidePanel) e uma versão Firefox (Manifesto V2, usando sidebar_action). Ambas as versões possuem recursos idênticos. A versão Firefox pode ser carregada como um complemento temporário para desenvolvimento ou publicada em addons.mozilla.org para instalação permanente.

Posso mover a barra lateral do Firefox da esquerda para a direita, como o painel lateral do Chrome?

Sim – o padrão da barra lateral do Firefox é para a esquerda, mas você pode invertê-la. Clique com o botão direito em qualquer lugar no cabeçalho da barra lateral e escolha Mover a barra lateral para a direita (ou usar Exibir → Barra lateral → Mover barra lateral para a direita na barra de menu). A posição persiste durante as reinicializações. O sidePanel do Chrome é padronizado para a direita e não pode ser movido pelo usuário a partir do próprio painel.

Há alguma limitação ao usar WebBrain no Web Panel do Vivaldi?

Sim. Os Vivaldi Web Panels suprimem diálogos JavaScript nativos, como confirm(), alert()e prompt(). A alternância dos modos Ask, Act e Dev do WebBrain não depende mais dessas caixas de diálogo, mas algumas ações secundárias ainda dependem.

Nova conversa: No Web Panel, o botão pode parecer não fazer nada porque sua caixa de diálogo de confirmação está suprimida. Clique com o botão direito no ícone do painel WebBrain e escolha Abrir em → Nova guiae usar Nova conversa daquela guia normal.

Gravação: Não use /record em Vivaldi por enquanto. Se a gravação falhar, Vivaldi pode ocultar o alerta de erro e não deixar nenhuma explicação visível.

Configurações, histórico, rastreamentos e transferência Ollama: Eles também contêm caixas de diálogo nativas, mas WebBrain normalmente os abre como guias normais, onde funcionam. Se você colocar um manualmente em um Web Panel, abra-o em uma guia normal antes de usar ações dependentes de diálogo.

O WebBrain é seguro para uso? Ele pode modificar páginas da web?

WebBrain possui três modos. O modo Ask (padrão) é somente leitura e não pode modificar nada na página. O modo Act permite ações do navegador, como clicar, digitar e navegar, enquanto o modo Dev adiciona ferramentas de depuração de página. Ações consequentes requerem aprovação por padrão; se esse portão de permissão estiver desativado, WebBrain exibirá um banner de aviso visível. Você pode parar o agente a qualquer momento com o botão Parar. O código-fonte da extensão está totalmente aberto para auditoria em GitHub.

O que é o banner "WebBrain iniciou a depuração deste navegador"? Por que WebBrain usa CDP?

Para atuar em uma página de maneira confiável, WebBrain usa o protocolo Chrome DevTools (CDP) por meio do padrão chrome.debugger API de extensão - é isso que aciona o banner "WebBrain começou a depurar este navegador" do Chrome. CDP é o que permite ao agente clicar e digitar com eventos de entrada confiáveis que os sites modernos realmente honram; eventos sintéticos disparados a partir de um script de conteúdo são rejeitados por muitos sites, componentes da Web e entradas controladas por estrutura. É também como o WebBrain captura capturas de tela com precisão de pixels para o retorno da visão e alcança iframes de origem cruzada e shadow DOM que os scripts de conteúdo não podem ver.

Somente leitura O modo Ask não precisa de CDP - as leituras de páginas e árvores de acessibilidade passam por scripts de conteúdo comuns. É Modo de ação confiabilidade e trabalho de origem cruzada que exigem isso, e em uma extensão do Manifest V3 não há API não depuradora para entrada confiável. WebBrain anexa o depurador somente quando uma ação precisa, por guia, e toda a extensão é de código aberto para que você possa auditar exatamente o que a sessão faz. O CDP é poderoso, por isso tratamos sua presença como algo a ser contido — anexamos sob demanda, mantemos leituras — e reforçar ainda mais isso está em nosso roteiro de segurança.

Está me fazendo muitas perguntas. Posso desativar isso?

Esses avisos de aprovação são para sua segurança. Mesmo em sites em que você confia, atores mal-intencionados podem imitar instruções do LLM ou injetar conteúdo que tente fazer com que o agente faça coisas em seu nome que você não aprovaria. É por isso que WebBrain pergunta antes de ações consequentes. Se você ainda não quiser seguir essas instruções, digite /dangerously-skip-permissions no painel lateral, ou abra o plugin lateral, clique no ícone de roda no cabeçalho, vá para o Permissões guia em settings.htmle desligue Pergunte antes de ações consequentes.

Como uso WebBrain para web scraping e extração de dados?

Basta abrir qualquer página da web, abrir o painel lateral WebBrain e perguntar em linguagem natural: "Extraia todos os nomes e preços de produtos desta página", "Obtenha todos os endereços de e-mail nesta página" ou "Resuma este artigo em marcadores". O agente de IA lê o conteúdo da página, entende a estrutura e retorna os dados extraídos. Para uma raspagem mais complexa, mude para o modo Act e o agente poderá navegar entre as páginas, clicar nos botões de paginação e agregar dados em várias páginas.

WebBrain chama APIs diretamente ou sempre clica na IU?

Por padrão, WebBrain sempre passa pela UI visível para qualquer ação que crie, modifique, exclua, envie, envie, publique ou compre qualquer coisa. Ele navegará até a página, preencherá o formulário e clicará no botão – exatamente como você faria. Ele se recusa a chamar endpoints REST/GraphQL diretamente em segundo plano fetch() para mutações. Isso é deliberado: as ações da API são invisíveis (você não vê o que está sendo enviado), geralmente exigem tokens de autenticação separados que você pode não ter configurado e têm um raio de explosão muito maior do que um clique errado visível. UI-first significa que tudo está na tela, na sessão normal do navegador, e pode ser interrompido.

Para lendo dados - buscando um README, procurando um problema, comparando preços entre sites, verificando uma página de status - WebBrain usa livremente solicitações HTTP em segundo plano por meio do fetch_url e research_url ferramentas. Ler não é o mesmo que atuar; isso não muda nada em um serviço remoto, portanto as preocupações de segurança não se aplicam.

Se você deseja permitir especificamente mutações de API para uma tarefa específica, digite /allow-api no início da sua mensagem (opcionalmente seguido por uma breve descrição da tarefa). Essa substituição por conversa permite que WebBrain retorne aos endpoints da API quando a IU estiver realmente falhando ou impraticável, ao mesmo tempo que ainda prefere a IU quando a IU funciona. Um emblema adesivo permanece visível acima da área de entrada enquanto a substituição está ativa e desaparece quando você reinicia a conversa.

Posso usá-lo em LM Studio também?

Sim. Ferramentas de rede somente leitura do WebBrain — fetch_url e research_url - também enviado como independente LM Studio plug-in em webbrain / ferramentas da web. Instalar com lms clone webbrain/web-tools e ative-o em qualquer bate-papo LM Studio – qualquer modelo compatível com ferramentas pode chamar essas duas ferramentas sem você instalar a extensão do navegador. Pure Node, sem navegador sem cabeça. Fonte: plugin-lmstudio/.

Posso mudar para outra guia enquanto WebBrain está trabalhando em uma página?

Sim, em Chrome – o agente é executado no service worker em segundo plano e está vinculado à guia em que foi iniciado, portanto, continua clicando, digitando e lendo essa guia específica, mesmo quando você move o foco para outro lugar. Todas as ferramentas direcionadas a uma guia (clique, digitação, navegação, captura de tela do CDP) funcionam em guias em segundo plano no Chrome. A barra lateral bloqueia a entrada enquanto uma tarefa está em execução para que você não possa iniciar acidentalmente uma segunda tarefa na nova guia – você precisará esperar ou interromper a atual. Observe que os navegadores aceleram os temporizadores e as animações nas guias de fundo, portanto, sites muito animados podem responder um pouco mais lentamente.

No Firefox, o agente continuará executando em sua guia original também, mas as capturas de tela automáticas são limitadas: a API de captura de tela do Firefox só pode capturar a guia atualmente ativa, não uma guia específica em segundo plano. WebBrain detecta isso e pula a captura de tela desse turno, em vez de alimentar o modelo com uma imagem de uma página não relacionada. O agente continuará planejando no contexto baseado em texto até você voltar para sua guia.

Evite clicar ou digitar ativamente na mesma guia em que o agente está trabalhando – isso cria condições de corrida onde você e o agente brigam pela mesma página. Alternar entre guias é bom; co-dirigir a mesma guia não é.

Como funciona o preenchimento automático do perfil e é seguro?

O preenchimento automático do perfil é um recurso opcional no Configurações → Perfil. Você insere uma breve biografia - nome, e-mail comercial, empresa e um descartável senha para inscrições de apostas baixas – e ative-a. Quando ativado, WebBrain anexa esse texto ao prompt do sistema do agente para que ele possa preencher formulários de inscrição sem perguntar sempre.

O texto é armazenado em texto simples no armazenamento local do seu navegador. É não transmitido para o projeto WebBrain, mas é enviado para qualquer provedor LLM que você configurou a cada turno, como parte do prompt do sistema. Desativado por padrão.

Não coloque senhas para contas importantes (Google, Apple, iCloud, serviços bancários, SSO comercial, e-mail principal) aqui. Essas contas devem usar 2FA e, de qualquer maneira, não devem ser entregues a um agente. Uma senha descartável que você reutiliza para inscrições em boletins informativos e avaliações gratuitas é o caso de uso pretendido.

A configuração de redação de captura de tela garante que meus dados privados nunca cheguem a um modelo de visão em nuvem?

Não – reduz a exposição, não é uma garantia. Quando ativado (Configurações → Multimodal → Redação de captura de tela, desativado por padrão), WebBrain pixeliza campos de formulário e texto que se parece com um endereço de e-mail ou número de telefone em cada captura de tela antes ele é enviado para um modelo de visão. A detecção é executada inteiramente no seu dispositivo usando heurística DOM; nada extra é transmitido.

É o melhor esforço e a falha aberta. Se o detector não puder ser executado em uma página — por exemplo, imediatamente após uma navegação, em visualizadores de PDF ou em páginas restritas do navegador — a captura de tela ainda será enviada não editado em vez de abortar sua tarefa. O conteúdo que a heurística do DOM não consegue ver (texto desenhado em uma tela, PII dentro de imagens, widgets incomuns) também pode escapar. E a configuração cobre apenas capturas de tela: página texto enviado ao modelo não é editado por ele.

Para total privacidade visual, use um modelo local. Com um provedor off-line como llama.cpp ou Ollama, as capturas de tela e o texto da página nunca saem da sua máquina, portanto, em primeiro lugar, não há nada para editar — essa é a única configuração em que a privacidade é garantida. Consulte "Posso usar WebBrain totalmente offline?" acima.

Não tem uma máquina que possa executar um modelo local com capacidade de visão? Um bom meio-termo é um pequeno modelo local para planejamento e chamadas de ferramentas (rápido e leve o suficiente para uma CPU/GPU modesta) emparelhado com um provedor de nuvem para as subchamadas de visão, com a edição de captura de tela ativada. Você ainda mantém sua conversa e o texto da página no dispositivo, e cada captura de tela que sai para a visão na nuvem tem campos de formulário e e-mails/telefones detectados desfocados primeiro – exposição reduzida à nuvem sem a necessidade de hardware para um modelo de visão local completo. Configure a divisão de visão em Configurações → Visão (consulte "Como o WebBrain mantém as contas do Cloud LLM sob controle?" acima).

O que WebBrain faz com banners de cookies e acesso pago?

Banners de cookies: WebBrain reconhece banners de consentimento de estruturas comuns (OneTrust, Cookiebot, Didomi, Quantcast, Google Funding Choices, TrustArc) e os descarta antes de raciocinar sobre a página. A prioridade é “Rejeitar tudo” / “Rejeitar não essencial” / “Apenas necessário” quando claramente visível; ele volta para "Aceitar tudo" em vez de desaparecer no labirinto "Gerenciar preferências".

Acessos pagos: WebBrain relata o acesso pago honestamente e informa o que ele realmente pode ver (título, descrição, primeiros parágrafos). Isso acontece não tentativa de contornar paywalls – sem archive.today, 12ft.io, limpeza de cookies, desabilitação de JS ou truques de modo leitor. Se você quiser o artigo completo, faça login com uma assinatura ou peça ao WebBrain para procurar cobertura gratuita da mesma história.

O WebBrain oferece suporte ao modo de simulação?

A partir de 7.0.0, ainda não. O modo de simulação está planejado e já está no roteiro.

Como WebBrain mantém as contas do Cloud LLM sob controle?

Três camadas independentes:

Capturas de tela com reconhecimento de token. Antes de qualquer imagem sair de sua máquina, WebBrain a redimensiona (lado mais curto, preservando a proporção de aspecto) e a compacta iterativamente em JPEG até que ela caiba no orçamento de token de imagem por turno. Uma captura de tela de 2.000 × 1.200 que custaria cerca de 1.500 tokens de entrada no GPT-4o é compactada para cerca de 300-500 tokens sem perda prática para tarefas de leitura de página. Implementado em _fitImageDimensions com testes unitários para a matemática do orçamento.

Corte de contexto inteligente. O histórico de conversas, as saídas de ferramentas e os dumps DOM embutidos são limitados por turno e cortados mais antigos primeiro quando a janela de contexto do modelo ativo está quase cheia. Você não verá uma corrida silenciosa aumentar de 10 mil tokens para 100 mil porque um read_page retornou um artigo do tamanho de um romance.

Modelo de visão dedicado. Combine um modelo de texto barato (por exemplo, GPT-4o-mini) para planejamento e chamadas de ferramentas com um modelo separado com capacidade de visão (por exemplo, GPT-4o) apenas para capturas de tela, para que você não pague preços de modelos multimodais em cada curva. Configurar em Configurações → Visão.

Resultado líquido: longas sessões com provedores de nuvem permanecem previsíveis. Para controle total, use llama.cpp localmente – custo zero por token.

Posso contribuir para WebBrain?

Absolutamente! WebBrain é licenciado pelo MIT e aceita contribuições. Confira o Repositório GitHub para problemas, solicitações de recursos e diretrizes de contribuição.

Espalhe a palavra, compartilhe o amor

WebBrain é licenciado pelo MIT e funciona inteiramente em seu navegador. Se for útil, deixe-nos uma estrela ou compartilhe-a - é assim que projetos independentes de código aberto são encontrados.