প্রায়শই জিজ্ঞাসিত প্রশ্নাবলী
সেটআপ, মডেল, বিলিং, নিরাপত্তা এবং আপনার ব্রাউজারে WebBrain কীভাবে কাজ করে সে সম্পর্কে দ্রুত উত্তর।
এই অনুসন্ধানের সঙ্গে মেলে এমন কোনো উত্তর নেই।
WebBrain সম্পর্কে
6WebBrain কি Claude এর ব্রাউজার প্লাগইনের একটি বিনামূল্যের বিকল্প?
হ্যাঁ। WebBrain অনুরূপ AI ব্রাউজার এজেন্ট ক্ষমতা প্রদান করে — পৃষ্ঠা পড়া, ডেটা বের করা, বোতামে ক্লিক করা, ফর্ম পূরণ করা এবং বহু-পদক্ষেপের কর্মপ্রবাহ স্বয়ংক্রিয় করা। Claude এর মালিকানাধীন ব্রাউজার প্লাগইনের বিপরীতে যার জন্য একটি Claude Pro সাবস্ক্রিপশন প্রয়োজন এবং শুধুমাত্র Anthropic এর মডেলগুলির সাথে কাজ করে, WebBrain সম্পূর্ণ বিনামূল্যে, ওপেন সোর্স (GPL-3.0-or-later লাইসেন্স) এবং স্থানীয় মডেলগুলি সহ একাধিক LLM প্রদানকারীকে সমর্থন করে যা সম্পূর্ণরূপে আপনার মেশিনে চলে৷
WebBrain কিভাবে OpenClaw, ব্রাউজার-ব্যবহার এবং অন্যান্য AI এজেন্ট ফ্রেমওয়ার্কের সাথে তুলনা করে?
এগুলি বিভিন্ন ধরণের সরঞ্জাম। WebBrain হল একটি ব্রাউজার এক্সটেনশন — আপনি এটিকে Chrome বা Firefox-এ ইনস্টল করুন এবং পাশের প্যানেলে এটির সাথে চ্যাট করুন, কোন কোডিংয়ের প্রয়োজন নেই৷ OpenClaw এবং Browser-Use-এর মত ফ্রেমওয়ার্ক হল Python-এ স্বয়ংক্রিয় ব্রাউজার পাইপলাইন তৈরির জন্য ডেভেলপার SDK, সাধারণত হেডলেস ব্রাউজার এবং CDP ব্যবহার করে। এইভাবে চিন্তা করুন: WebBrain একটি AI সহকারীর সাথে প্রতিদিন ব্রাউজ করার জন্য; এজেন্ট ফ্রেমওয়ার্ক স্ক্র্যাপিং বট এবং পরীক্ষা অটোমেশন নির্মাণের জন্য। আপনি উভয়ই ব্যবহার করতে পারেন - তারা একে অপরের পরিপূরক।
WebBrain কি Firefox এ কাজ করে?
হ্যাঁ। WebBrain উভয় একটি Chrome সংস্করণ (ম্যানিফেস্ট V3, সাইডপ্যানেল API ব্যবহার করে) এবং একটি Firefox সংস্করণ (সাইডবার_অ্যাকশন ব্যবহার করে ম্যানিফেস্ট V2) উভয়ের সাথেই পাঠানো হয়। উভয় সংস্করণ অভিন্ন বৈশিষ্ট্য আছে. Firefox সংস্করণটি বিকাশের জন্য একটি অস্থায়ী অ্যাড-অন হিসাবে লোড করা যেতে পারে, বা স্থায়ী ইনস্টলেশনের জন্য addons.mozilla.org-এ প্রকাশ করা যেতে পারে।
ওয়েব স্ক্র্যাপিং এবং ডেটা নিষ্কাশনের জন্য আমি কীভাবে WebBrain ব্যবহার করব?
সহজভাবে যেকোন ওয়েব পৃষ্ঠা খুলুন, WebBrain সাইড প্যানেল খুলুন এবং স্বাভাবিক ভাষায় জিজ্ঞাসা করুন: "এই পৃষ্ঠা থেকে সমস্ত পণ্যের নাম এবং দামগুলি বের করুন", "এই পৃষ্ঠায় সমস্ত ইমেল ঠিকানা পান", বা "বুলেট পয়েন্টগুলিতে এই নিবন্ধটি সংক্ষিপ্ত করুন"। এআই এজেন্ট পৃষ্ঠার বিষয়বস্তু পড়ে, গঠন বুঝতে পারে এবং নিষ্কাশন করা ডেটা ফেরত দেয়। আরও জটিল স্ক্র্যাপিংয়ের জন্য, অ্যাক্ট মোডে স্যুইচ করুন এবং এজেন্ট পৃষ্ঠাগুলির মধ্যে নেভিগেট করতে পারে, পৃষ্ঠা সংখ্যা বোতামে ক্লিক করতে পারে এবং একাধিক পৃষ্ঠা জুড়ে ডেটা একত্রিত করতে পারে।
WebBrain কি ড্রাই-রান মোড সমর্থন করে?
হিসাবে 7.0.0, এখনো না ড্রাই-রান মোড পরিকল্পিত এবং ইতিমধ্যেই রোডম্যাপে রয়েছে৷
আমি কি WebBrain তে অবদান রাখতে পারি?
একেবারেই! WebBrain হল GPL-3.0-or-later- লাইসেন্সপ্রাপ্ত এবং অবদানকে স্বাগত জানায়। চেক আউট GitHub সংগ্রহস্থল সমস্যা, বৈশিষ্ট্য অনুরোধ, এবং অবদান নির্দেশিকা জন্য.
ক্লাউড ও বিলিং
4একটি WebBrain ক্লাউড সাবস্ক্রিপশন কত?
WebBrain ক্লাউড বর্তমানে ডিভাইস প্রোফাইল প্রতি $5/মাস, আপাতত Claude Pro থেকে অনেক সস্তা। ন্যায্য ব্যবহার নীতির অধীনে ব্যবহার বর্তমানে সীমাহীন: স্বাভাবিক ব্যক্তিগত ব্যবহার জরিমানা, কিন্তু অপমানজনক, স্বয়ংক্রিয়, পুনরায় বিক্রয়, বা অস্বাভাবিকভাবে উচ্চ-ভলিউম ব্যবহার অনুমোদিত নয়।
সাবস্ক্রিপশনটি সেই ব্রাউজার + OS GUID-এর এক্সটেনশন দ্বারা তৈরি ডিভাইস শনাক্তকারীর সাথে লিঙ্ক করা হয়েছে, ব্যবহারকারীর অ্যাকাউন্টে নয়। যদি সেই শনাক্তকারী হারিয়ে যায় কারণ আপনি এক্সটেনশন স্টোরেজ রিসেট করেন, ব্রাউজার প্রোফাইল মুছুন, ব্রাউজার পুনরায় ইনস্টল করেন, ব্রাউজার/OS পরিবর্তন করেন বা ডিভাইসটি হারান, আমরা এটি পুনরুদ্ধার বা স্থানান্তর করতে পারি না এবং সেই ক্ষতির জন্য আমরা ফেরত প্রদান করি না।
আমি কীভাবে আমার সাবস্ক্রিপশন পরিচালনা বা বাতিল করব?
api.webbrain.one/account-এ বিলিং পরিচালনা করুন এবং আপনার ইমেল দিয়ে লগ ইন করুন।
এনক্রিপ্ট করা ক্লাউড সিঙ্ক কিভাবে কাজ করে?
ক্লাউড সিঙ্ক সক্রিয় WebBrain ক্লাউড গ্রাহকদের জন্য একটি ঐচ্ছিক বৈশিষ্ট্য। এটি আপনার WebBrain স্মৃতি, প্রোফাইল অটো-ফিল টেক্সট এবং API কী সহ সমর্থিত প্রদানকারী কনফিগারেশন সিঙ্ক করে। এটা করে না চ্যাট ইতিহাস, ব্রাউজার ইতিহাস, পৃষ্ঠার স্ক্রিনশট বা লিগ্যাসি OAuth অ্যাক্সেস এবং রিফ্রেশ টোকেন সিঙ্ক করুন।
আপনার বেছে নেওয়া পাসওয়ার্ড দিয়ে আপলোড করার আগে আপনার ব্রাউজার সিঙ্ক ভল্ট এনক্রিপ্ট করে। WebBrain ক্লাউড শুধুমাত্র এনক্রিপ্ট করা ভল্ট সঞ্চয় করে; এটি আপনার স্মৃতি, প্রোফাইল পাঠ্য, প্রদানকারী সেটিংস, বা API কীগুলি পড়তে পারে না এবং এটি আপনার জন্য সিঙ্ক পাসওয়ার্ড পুনরুদ্ধার করতে পারে না৷
ইমেল ক্ষেত্রটি WebBrain ক্লাউড ম্যাজিক-লিঙ্ক বিলিং/সাবস্ক্রিপশন প্রমাণীকরণের জন্য। এটি একটি অ্যাকাউন্ট পাসওয়ার্ড নয়. যদি UI বলে ক্লাউড সিঙ্কে পাসওয়ার্ড পরিবর্তন করুন, এর অর্থ হল সিঙ্ক এনক্রিপশন পাসওয়ার্ড, একটি WebBrain অ্যাকাউন্ট পাসওয়ার্ড নয়৷
আপনি সিঙ্ক পাসওয়ার্ড ভুলে গেলে, পুরানো এনক্রিপ্ট করা ক্লাউড ভল্ট ডিক্রিপ্ট করা যাবে না। আপনি ক্লাউড ভল্ট রিসেট করতে পারেন এবং এমন একটি ডিভাইস থেকে একটি নতুন এনক্রিপ্ট করা কপি আপলোড করতে পারেন যেখানে এখনও স্থানীয়ভাবে ডেটা রয়েছে৷
কিভাবে WebBrain ক্লাউড এলএলএম বিল নিয়ন্ত্রণে রাখে?
তিনটি স্বাধীন স্তর:
টোকেন-সচেতন স্ক্রিনশট। কোনো ছবি আপনার মেশিন ছেড়ে যাওয়ার আগে, WebBrain এটির আকার পরিবর্তন করে (সংক্ষিপ্ত সাইড ক্যাপড, অ্যাসপেক্ট রেশিও সংরক্ষণ করে) এবং পুনরাবৃত্তিমূলকভাবে JPEG-সংকুচিত করে যতক্ষণ না এটি প্রতি-টার্ন ইমেজ-টোকেন বাজেটে ফিট করে। একটি 2000×1200 স্ক্রিনশট যেটির জন্য আপনার GPT-4o তে ~1,500 ইনপুট টোকেন খরচ হবে ~300-500 টোকেনে কম্প্রেস হয়ে পৃষ্ঠা-পড়ার কাজগুলির জন্য কোনও ব্যবহারিক ক্ষতি ছাড়াই। তে বাস্তবায়িত হয় _fitImageDimensions বাজেট গণিত জন্য ইউনিট পরীক্ষার সঙ্গে.
স্মার্ট প্রসঙ্গ ছাঁটাই। কথোপকথনের ইতিহাস, টুল আউটপুট, এবং ইনলাইন DOM ডাম্পগুলি প্রতি টার্নে আবদ্ধ থাকে এবং সক্রিয় মডেলের প্রসঙ্গ উইন্ডোটি পূর্ণ হওয়ার সময় সবচেয়ে পুরনো-প্রথম ছাঁটাই করা হয়। আপনি 10k টোকেন থেকে 100k পর্যন্ত নীরবে বেলুন চালাতে দেখতে পাবেন না কারণ একটি read_page একটি উপন্যাস-দৈর্ঘ্য নিবন্ধ ফিরে.
ডেডিকেটেড ভিশন মডেল। শুধুমাত্র স্ক্রিনশটগুলির জন্য একটি পৃথক দৃষ্টি-সক্ষম মডেলের (যেমন GPT-4o) সাথে পরিকল্পনা এবং টুল কলের জন্য একটি সস্তা টেক্সট মডেল (যেমন GPT-4o-mini) যুক্ত করুন, তাই আপনি প্রতিটি একক মোড়তে মাল্টিমোডাল-মডেল মূল্য পরিশোধ করবেন না৷ অধীনে কনফিগার করুন সেটিংস → দৃষ্টি.
নেট ফলাফল: ক্লাউড প্রদানকারীদের সাথে দীর্ঘ সেশন অনুমানযোগ্য থাকে। সম্পূর্ণ নিয়ন্ত্রণের জন্য, স্থানীয়ভাবে llama.cpp ব্যবহার করুন — টোকেন প্রতি শূন্য খরচ।
মডেল ও স্থানীয় সেটআপ
8আমি কি পুরোপুরি অফলাইনে WebBrain ব্যবহার করতে পারি?
হ্যাঁ। WebBrain এর ডিফল্ট প্রদানকারী হল llama.cpp, যেটি আপনার কম্পিউটারে একটি স্থানীয় AI মডেল চালায়। কোনো API কী প্রয়োজন নেই, AI-এর জন্য কোনো ইন্টারনেটের প্রয়োজন নেই এবং কোনো ডেটা কখনোই আপনার মেশিন ছেড়ে যায় না। শুধু একটি GGUF মডেল ডাউনলোড করুন, llama-server শুরু করুন এবং আপনার কাছে একটি সম্পূর্ণ ব্যক্তিগত AI ব্রাউজার এজেন্ট আছে৷ আপনি Ollama এর OpenAI- সামঞ্জস্যপূর্ণ এন্ডপয়েন্ট সহ ব্যবহার করতে পারেন।
What is the Emergency Box, and how does offline RAG work?
The Emergency Box is a curated collection of ~570 public-domain field-reference documents (medical, survival, education, communication) that WebBrain can download and index locally. Once installed, you can ask factual questions offline and get answers sourced from those documents — no internet connection required.
Under the hood, WebBrain uses SQLite FTS5 for fast keyword search across both the Emergency Box and any installed Wikipedia archives, plus an optional semantic search layer using a locally downloaded multilingual E5 model (~140 MB). Results from both methods are combined and diversified, and every answer cites the exact source passage. Citations open in a local reader that verifies document integrity before displaying — they never navigate to a live web page.
You can also install Wikipedia archives through Apocalypse Mode for a broader offline knowledge base. Source and language filters let you control which collections are searched.
কোন AI মডেল WebBrain সমর্থন করে?
WebBrain চারটি প্রদানকারীর প্রকারকে সমর্থন করে: llama.cpp (যে কোনো স্থানীয় GGUF মডেল), OpenAI (GPT-4o, GPT-4, ইত্যাদি), Claude (Claude Opus, Sonnet, Haiku এর মাধ্যমে স্থানীয় API), এবং OpenRouter (বিভিন্ন প্রদানকারীর থেকে 100+ মডেলে অ্যাক্সেস)। যেকোনো OpenAI- সামঞ্জস্যপূর্ণ API এন্ডপয়েন্ট কাজ করে, তাই আপনি Together AI, Groq, Mistral বা OpenAI- সামঞ্জস্যপূর্ণ ইন্টারফেসের সাথে যেকোনো স্থানীয় সার্ভারের মতো পরিষেবাগুলিও ব্যবহার করতে পারেন।
সবচেয়ে প্রস্তাবিত মডেল কি?
হিসাবে এপ্রিল 21, 2026, শীর্ষ সুপারিশ হয় Qwen 3.6 35B. কেন: আমাদের ভিশন বেঞ্চমার্কে (দৃষ্টি-মডেল-শুটআউট), এটি স্থানীয় অনুমানের জন্য ব্যবহারিক থাকাকালীন স্ক্রিনশট বোঝার ক্ষেত্রে Gemma 4-কে ছাড়িয়ে গেছে।
ভোক্তা GPU গুলির জন্য, RTX 5090 আদর্শ, এবং RTX 4090 প্রায়শই INT4 অটোরাউন্ড কোয়ান্টাইজেশনের মাধ্যমে কার্যকর হয় Intel/Qwen3.6-35B-A3B-int4-অটোরাউন্ড.
সর্বাধিক গতির জন্য, আমরা পরিবেশন করার পরামর্শ দিই ভিএলএলএম. নমুনা আদেশ:
python -u -m vllm.entrypoints.openai.api_server --model Intel/Qwen3.6-35B-A3B-int4-AutoRound --served-model-name qwen3.6-35b --quantization auto --dtype bfloat16 --max-model-len 65536 --max-num-batched-tokens 32768 --max-num-seqs 4 --host 0.0.0.0 --port 8000 --gpu-memory-utilization 0.92 --enable-prefix-caching --enable-chunked-prefill --limit-mm-per-prompt '{"image": 4, "video": 1}' --mm-processor-cache-type shm --reasoning-parser qwen3 --enable-auto-tool-choice --tool-call-parser qwen3_coder --trust-remote-code --allowed-origins '["*"]' --speculative-config '{"method": "dflash", "model": "z-lab/Qwen3.6-35B-A3B-DFlash", "num_speculative_tokens": 15}' --attention-backend flash_attn
DFlash অনুমানমূলক ডিকোডিং ঐচ্ছিক।
WebGPU কেন শুধু Apocalypse Mode-এ পাওয়া যায়?
কারণ আমরা এখনও ব্রাউজারের ভেতরের WebGPU টেক্সট ইনফারেন্সকে অধিকাংশ ব্যবহারকারীর জন্য যথেষ্ট ভালো মনে করি না, এবং আমরা চাই না আপনাকে খারাপ অভিজ্ঞতা সহ্য করতে হোক। একই LFM2.5 2.6B মডেল স্থানীয়ভাবে ব্যবহার করতে চাইলে নিজের মেশিনে llama.cpp বা Ollama দিয়ে ইনফারেন্স চালান এবং WebGPU-র ওপর নির্ভর না করে WebBrain-কে সেই স্থানীয় এন্ডপয়েন্টে সংযুক্ত করুন।
WebGPU ভিশন ফলব্যাকটি চালু আছে, কারণ এর মডেল অনেক ছোট এবং ফলব্যাকটি কেবল মাঝেমধ্যে ব্যবহার হয়।
আমার নেটওয়ার্কে স্থানীয় LLM সার্ভারে (vLLM, Ollama, llama.cpp) সংযোগ করার সময় আমি "আনয়নে ব্যর্থ" পাচ্ছি
যদি আপনার LLM সার্ভারটি আপনার স্থানীয় নেটওয়ার্কে একটি ভিন্ন মেশিনে থাকে (যেমন http://192.168.1.x:8000), Chrome অনুরোধ ব্লক করে যদি না সার্ভার পাঠায় CORS হেডার. ফিক্স আপনার সার্ভারের উপর নির্ভর করে:
ভিএলএলএম: দিয়ে শুরু করুন --allowed-origins '["*"]' (মান অবশ্যই একটি JSON তালিকা হতে হবে)।
Ollama: পরিবেশ পরিবর্তনশীল সেট করুন OLLAMA_ORIGINS=* শুরু করার আগে।
llama.cpp: CORS ডিফল্টরূপে সক্রিয় আছে — কোনো পরিবর্তনের প্রয়োজন নেই।
যদি আপনার সার্ভার চালু হয় localhost (ব্রাউজার হিসাবে একই মেশিন), CORS সাধারণত প্রয়োজন হয় না। সমস্যাটি শুধুমাত্র স্থানীয় নেটওয়ার্কে ক্রস-মেশিন সংযোগগুলিকে প্রভাবিত করে৷ নিশ্চিত করুন যে WebBrain সেটিংসে আপনার বেস URL এর সাথে শেষ হয়েছে৷ /v1 (যেমন http://192.168.1.47:8000/v1) ব্যতিক্রম: একটি ব্রাউজার এক্সটেনশন থেকে ব্যবহৃত Ollama এখনও প্রয়োজন হতে পারে OLLAMA_ORIGINS; নীচের Ollama FAQ দেখুন৷
কেন Ollama localhost-এ WebBrain এক্সটেনশন থেকে 403 ফেরত দেয়?
সাম্প্রতিক Ollama সংস্করণগুলি ব্রাউজার-এক্সটেনশন উত্স থেকে অনুরোধ প্রত্যাখ্যান করতে পারে এমনকি যখন Ollama একই মেশিনে চলছে৷ এক্সটেনশন একটি পাঠায় Origin যেমন chrome-extension://... বা moz-extension://..., এবং Ollama 403 এর উত্তর দিতে পারে যদি না সেই উত্সগুলি অনুমোদিত হয়৷
যেকোনও Ollama ডেস্কটপ অ্যাপ থেকে প্রস্থান করুন যা ইতিমধ্যেই পোর্ট ধরে রেখেছে 11434, তারপর এই কমান্ডগুলির একটি দিয়ে Ollama শুরু করুন:
OLLAMA_ORIGINS="*" ollama serveOLLAMA_ORIGINS="chrome-extension://*,moz-extension://*" ollama serve
WebBrain এর Ollama বেস ইউআরএল সেট রাখুন http://localhost:11434/v1. টার্মিনাল curl চেকগুলি এখনও এই সেটিং ছাড়াই কাজ করতে পারে কারণ তারা ব্রাউজার-এক্সটেনশন মূল পাঠায় না৷
আমি কি এটি LM Studio তেও ব্যবহার করতে পারি?
হ্যাঁ। WebBrain-এর শুধুমাত্র পঠনযোগ্য নেটওয়ার্ক টুলস — fetch_url এবং research_url - এছাড়াও একটি স্বতন্ত্র হিসাবে জাহাজ LM Studio এ প্লাগইন করুন ওয়েবব্রেন/ওয়েব-টুল. দিয়ে ইনস্টল করুন lms clone webbrain/web-tools এবং যেকোনো LM Studio চ্যাটে এটিকে টগল করুন — যেকোনো টুল-সক্ষম মডেল আপনি ব্রাউজার এক্সটেনশন ইনস্টল না করেই সেই দুটি টুলকে কল করতে পারেন। বিশুদ্ধ নোড, কোন হেডলেস ব্রাউজার। সূত্র: lmstudio-প্লাগইন/.
ব্রাউজার ও দৈনন্দিন ব্যবহার
5আমি কি Firefox সাইডবারকে Chrome এর সাইড প্যানেলের মতো বাম থেকে ডানে সরাতে পারি?
হ্যাঁ — Firefox এর সাইডবার বাম দিকে ডিফল্ট, কিন্তু আপনি এটি উল্টাতে পারেন। সাইডবার হেডারের যেকোনো জায়গায় ডান-ক্লিক করুন এবং নির্বাচন করুন সাইডবার ডানে সরান (বা ব্যবহার করুন দেখুন → সাইডবার → সাইডবার ডানদিকে সরান মেনু বার থেকে)। পুনঃসূচনা জুড়ে অবস্থান অব্যাহত থাকে। Chrome এর সাইডপ্যানেল ডানদিকে ডিফল্ট এবং প্যানেল থেকেই ব্যবহারকারী-চলবে না।
Vivaldi এর ওয়েব প্যানেলে WebBrain ব্যবহার করার সময় কোন সীমাবদ্ধতা আছে?
হ্যাঁ। Vivaldi ওয়েব প্যানেল নেটিভ জাভাস্ক্রিপ্ট ডায়ালগগুলিকে দমন করে যেমন confirm(), alert(), এবং prompt(). WebBrain এর আস্ক, অ্যাক্ট, এবং ডেভ মোড সুইচ আর সেই ডায়ালগের উপর নির্ভর করে না, কিন্তু কিছু গৌণ ক্রিয়া এখনও করে।
রেকর্ডিং: ব্যবহার করবেন না /record আপাতত ভিভাল্ডিতে। রেকর্ডিং ব্যর্থ হলে, Vivaldi ত্রুটি সতর্কতা আড়াল করতে পারেন এবং কোন দৃশ্যমান ব্যাখ্যা ছেড়ে যেতে পারে.
সেটিংস, ইতিহাস, ট্রেস, এবং Ollama হ্যান্ডঅফ: এগুলিতে নেটিভ ডায়ালগগুলিও রয়েছে, তবে WebBrain সাধারণত সেগুলিকে নিয়মিত ট্যাব হিসাবে খোলে, যেখানে তারা কাজ করে৷ আপনি যদি ম্যানুয়ালি একটি ওয়েব প্যানেলে রাখেন, ডায়ালগ-নির্ভর ক্রিয়াগুলি ব্যবহার করার আগে এটি একটি সাধারণ ট্যাবে খুলুন।
WebBrain আমার ট্যাবে কাজ করার সময় আমি কি উপরে বা নিচে স্ক্রল করতে পারি?
বেশির ভাগ সময়ই পারেন — বিশেষ করে “এই পৃষ্ঠাটি সংক্ষেপে বলো” ধরনের শুধু-পঠন অনুরোধে Ask মোডে। WebBrain কাজ করার সময় আপনি স্ক্রল করা চালিয়ে যেতে পারেন।
কখন এটি এড়িয়ে চলা উচিত? স্বয়ংক্রিয় স্ক্রিনশট ট্যাবের বর্তমান ভিউপোর্ট দেখায়। WebBrain যখন Act বা Dev মোডে দৃশ্যমান বিষয়বস্তু সক্রিয়ভাবে পরীক্ষা করে বা তার সঙ্গে ইন্টারঅ্যাক্ট করে, তখন স্ক্রল করলে লক্ষ্য সরে যেতে পারে বা মডেল যা দেখছে তা বদলে যেতে পারে। স্ক্রল করার আগে ওই ধাপটি শেষ হতে দিন; এই সময়গুলো ছাড়া আপনি পৃষ্ঠাটি ব্যবহার করা চালিয়ে যেতে পারেন।
WebBrain একটি পৃষ্ঠায় কাজ করার সময় আমি কি অন্য ট্যাবে স্যুইচ করতে পারি?
হ্যাঁ। 27.0.0 সংস্করণ থেকে, সামনের ট্যাবে প্রবেশ একান্ত প্রয়োজন না হলে WebBrain Chromium-ভিত্তিক ব্রাউজার ও Firefox—কোনোটিতেই ফোকাস কেড়ে নেয় না। রানটি যে ট্যাবে শুরু হয়েছিল তার সঙ্গেই যুক্ত থাকে, তাই আপনি নিরাপদে অন্য ট্যাবে কাজ করতে পারেন।
কোনো বিরল ধাপে মূল ট্যাবটি সামনে আনার প্রয়োজন হলে WebBrain অল্প সময়ের জন্য সেটিতে ফোকাস করতে পারে। WebBrain একই ট্যাবে সক্রিয়ভাবে কাজ করার সময় সেখানে ক্লিক বা টাইপ করা এড়িয়ে চলুন।
WebBrain কুকি ব্যানার এবং পেওয়ালের সাথে কি করে?
কুকি ব্যানার: WebBrain সাধারণ ফ্রেমওয়ার্ক (OneTrust, Cookiebot, Didomi, Quantcast, Google Funding Choices, TrustArc) থেকে সম্মতি ব্যানারগুলিকে স্বীকৃতি দেয় এবং পৃষ্ঠা সম্পর্কে যুক্তি দেওয়ার আগে সেগুলিকে খারিজ করে দেয়। অগ্রাধিকার হল "সমস্ত প্রত্যাখ্যান করুন" / "অপ্রয়োজনীয় প্রত্যাখ্যান করুন" / "শুধুমাত্র প্রয়োজনীয়" যখন স্পষ্টভাবে দৃশ্যমান হয়; এটি "অভিরুচি পরিচালনা করুন" গোলকধাঁধায় অদৃশ্য হয়ে যাওয়ার পরিবর্তে "সব স্বীকার করুন" এ ফিরে আসে।
পেওয়াল: WebBrain সততার সাথে পেওয়ালের রিপোর্ট করে এবং আপনাকে বলে যে এটি আসলে কী দেখতে পারে (শিরোনাম, ডেক, প্রথম অনুচ্ছেদ)। এটা করে না পেওয়াল বাইপাস করার চেষ্টা করুন — কোনো archive.today, 12ft.io, কুকি ক্লিয়ারিং, JS অক্ষম করা বা রিডার-মোড কৌশল নেই। আপনি যদি সম্পূর্ণ নিবন্ধটি চান, একটি সদস্যতার সাথে লগ ইন করুন বা একই গল্পের বিনামূল্যে কভারেজ দেখতে WebBrain কে জিজ্ঞাসা করুন৷
নিরাপত্তা ও গোপনীয়তা
8WebBrain ব্যবহার করা কি নিরাপদ? এটা ওয়েব পেজ পরিবর্তন করতে পারেন?
WebBrain তিনটি মোড আছে। আস্ক মোড (ডিফল্ট) শুধুমাত্র পঠনযোগ্য এবং পৃষ্ঠায় কিছু পরিবর্তন করতে পারে না। অ্যাক্ট মোড ব্রাউজার অ্যাকশনগুলিকে সক্ষম করে যেমন ক্লিক করা, টাইপ করা এবং নেভিগেট করা, যখন ডেভ মোড পৃষ্ঠা-ডিবাগিং টুল যোগ করে। পরিণতিমূলক ক্রিয়াগুলির জন্য ডিফল্টরূপে অনুমোদনের প্রয়োজন হয়; যদি সেই অনুমতি গেটটি বন্ধ থাকে, WebBrain একটি দৃশ্যমান সতর্কতা ব্যানার প্রদর্শন করে৷ আপনি স্টপ বোতাম দিয়ে যে কোনো সময় এজেন্টকে থামাতে পারেন। এক্সটেনশনের সোর্স কোড GitHub-এ নিরীক্ষার জন্য সম্পূর্ণ উন্মুক্ত।
"WebBrain এই ব্রাউজারটি ডিবাগ করা শুরু করেছে" ব্যানার কি? কেন WebBrain CDP ব্যবহার করে?
একটি পৃষ্ঠায় নির্ভরযোগ্যভাবে কাজ করতে, WebBrain স্ট্যান্ডার্ডের মাধ্যমে Chrome DevTools প্রোটোকল (CDP) ব্যবহার করে chrome.debugger এক্সটেনশন API — এটিই Chrome এর "WebBrain এই ব্রাউজারটিকে ডিবাগ করা শুরু করেছে" ব্যানারটিকে ট্রিগার করে৷ CDP যা এজেন্টকে ক্লিক করতে এবং টাইপ করতে দেয় বিশ্বস্ত ইনপুট ইভেন্ট যে আধুনিক সাইট আসলে সম্মান; একটি বিষয়বস্তু স্ক্রিপ্ট থেকে বহিষ্কৃত সিন্থেটিক ইভেন্টগুলি অনেক সাইট, ওয়েব উপাদান এবং ফ্রেমওয়ার্ক-নিয়ন্ত্রিত ইনপুট দ্বারা প্রত্যাখ্যাত হয়। এটিও যেভাবে WebBrain ভিশন ফলব্যাকের জন্য পিক্সেল-সঠিক স্ক্রিনশট ক্যাপচার করে এবং এতে পৌঁছায় ক্রস-অরিজিন iframes এবং ছায়া DOM যে বিষয়বস্তু স্ক্রিপ্ট দেখতে পারে না.
শুধুমাত্র পঠনযোগ্য আস্ক মোডের সিডিপির প্রয়োজন নেই — পৃষ্ঠা এবং অ্যাক্সেসিবিলিটি-ট্রি রিডগুলি সাধারণ কন্টেন্ট স্ক্রিপ্টের মধ্য দিয়ে যায়। এটা অ্যাক্ট মোড নির্ভরযোগ্যতা এবং ক্রস-অরিজিন কাজ যার জন্য এটি প্রয়োজন, এবং একটি ম্যানিফেস্ট V3 এক্সটেনশনে বিশ্বস্ত ইনপুটের জন্য কোনও নন-ডিবাগার API নেই। WebBrain ডিবাগার সংযুক্ত করে শুধুমাত্র যখন একটি কর্মের প্রয়োজন হয়, প্রতি ট্যাব, এবং পুরো এক্সটেনশনটি ওপেন-সোর্স যাতে আপনি সেশনটি ঠিক কী করে তা নিরীক্ষণ করতে পারেন। CDP শক্তিশালী, তাই আমরা এর পদচিহ্নকে ধারণ করার মতো কিছু হিসাবে বিবেচনা করি — চাহিদা অনুযায়ী সংযুক্ত করুন, এটিকে পড়া বন্ধ রাখুন — এবং এটি আরও কঠোর করা আমাদের নিরাপত্তা রোডম্যাপে রয়েছে।
এটা আমাকে অনেক প্রশ্ন জিজ্ঞাসা করছে. আমি কি অক্ষম করতে পারি?
এই অনুমোদনের অনুরোধগুলি আপনার নিরাপত্তার জন্য। এমনকি আপনি বিশ্বাস করেন এমন সাইটগুলিতেও, দূষিত অভিনেতারা LLM নির্দেশাবলী অনুকরণ করতে পারে বা এমন বিষয়বস্তু ইনজেকশন করতে পারে যা এজেন্টকে আপনার পক্ষে এমন কিছু করার চেষ্টা করে যা আপনি অনুমোদন করবেন না। এই কারণেই WebBrain ফলাফলমূলক কর্মের আগে জিজ্ঞাসা করে। আপনি যদি এখনও সেই প্রম্পটগুলির মধ্য দিয়ে যেতে না চান তবে টাইপ করুন /dangerously-skip-permissions সাইড প্যানেলে, বা সাইড প্লাগইন খুলুন, হেডারে হুইল আইকনে ক্লিক করুন, যান অনুমতি ট্যাব ইন settings.html, এবং সুইচ অফ ফলাফলমূলক কর্মের আগে জিজ্ঞাসা করুন.
WebBrain কি সরাসরি API-কে কল করে, নাকি সবসময় UI এর মাধ্যমে ক্লিক করে?
ডিফল্টরূপে, WebBrain সর্বদা দৃশ্যমান UI এর মাধ্যমে যায় যেকোন ক্রিয়াকলাপের জন্য যা তৈরি করে, সংশোধন করে, মুছে দেয়, পাঠায়, জমা দেয়, পোস্ট করে বা কিছু কিনে। এটি পৃষ্ঠায় নেভিগেট করবে, ফর্মটি পূরণ করবে এবং বোতামে ক্লিক করবে — ঠিক যেভাবে আপনি চান৷ এটি ব্যাকগ্রাউন্ডের মাধ্যমে সরাসরি REST/GraphQL এন্ডপয়েন্ট কল করতে অস্বীকার করে fetch() মিউটেশনের জন্য। এটি ইচ্ছাকৃত: API অ্যাকশনগুলি অদৃশ্য (আপনি কী পাঠানো হচ্ছে তা দেখতে পাচ্ছেন না), প্রায়শই আলাদা প্রমাণীকরণ টোকেন প্রয়োজন যা আপনি কনফিগার নাও করতে পারেন এবং দৃশ্যমান ভুল-ক্লিকের চেয়ে অনেক বড় ব্লাস্ট ব্যাসার্ধ রয়েছে৷ UI- প্রথম মানে সবকিছু স্ক্রিনে, আপনার সাধারণ ব্রাউজার সেশনে এবং থামানো যায়।
জন্য পড়া ডেটা — একটি README আনা, একটি সমস্যা খোঁজা, সাইট জুড়ে দামের তুলনা করা, একটি স্থিতি পৃষ্ঠা পরীক্ষা করা — WebBrain অবাধে এর মাধ্যমে ব্যাকগ্রাউন্ড HTTP অনুরোধগুলি ব্যবহার করে fetch_url এবং research_url টুলস পড়া অভিনয়ের মতো নয়; এটি একটি দূরবর্তী পরিষেবাতে কিছু পরিবর্তন করে না, তাই নিরাপত্তা উদ্বেগ প্রযোজ্য নয়।
আপনি যদি বিশেষভাবে একটি নির্দিষ্ট কাজের জন্য API মিউটেশনের অনুমতি দিতে চান তবে টাইপ করুন /allow-api আপনার বার্তার শুরুতে (ঐচ্ছিকভাবে একটি ছোট টাস্ক বর্ণনা দ্বারা অনুসরণ করা)। এই প্রতি-কথোপকথন ওভাররাইড WebBrain এপিআই এন্ডপয়েন্টে ফিরে যেতে দেয় যখন UI সত্যিকারের ব্যর্থ বা অকার্যকর হয়, যখন UI কাজ করে তখনও UI পছন্দ করে। ওভাররাইড সক্রিয় থাকাকালীন একটি স্টিকি ব্যাজ ইনপুট এলাকার উপরে দৃশ্যমান থাকে এবং আপনি কথোপকথন রিসেট করলে এটি পরিষ্কার হয়।
প্রোফাইল স্বয়ংক্রিয়ভাবে পূরণ কিভাবে কাজ করে, এবং এটি নিরাপদ?
প্রোফাইল অটো-ফিল হল একটি ঐচ্ছিক বৈশিষ্ট্য সেটিংস → প্রোফাইল. আপনি একটি সংক্ষিপ্ত জীবনী লিখুন — নাম, কাজের ইমেল, কোম্পানি, এবং ক নিক্ষেপ কম-স্টেকের সাইনআপের জন্য পাসওয়ার্ড — এবং এটিকে টগল করুন। সক্রিয় করা হলে, WebBrain সেই পাঠ্যটিকে এজেন্টের সিস্টেম প্রম্পটে যুক্ত করে যাতে এটি প্রতিবার জিজ্ঞাসা না করে সাইনআপ ফর্মগুলি পূরণ করতে পারে৷
টেক্সট সংরক্ষণ করা হয় প্লেইনটেক্সট আপনার ব্রাউজারের স্থানীয় স্টোরেজে। এটা না WebBrain প্রকল্পে প্রেরণ করা হয়েছে, কিন্তু এটি হয় সিস্টেম প্রম্পটের অংশ হিসাবে প্রতিটি মোড়ে আপনি যে LLM প্রদানকারীকে কনফিগার করেছেন তার কাছে পাঠানো হয়েছে। ডিফল্টরূপে বন্ধ।
গুরুত্বপূর্ণ অ্যাকাউন্টের জন্য পাসওয়ার্ড রাখবেন না (Google, Apple, iCloud, banking, work SSO, প্রাথমিক ইমেল) এখানে। এই অ্যাকাউন্টগুলি 2FA ব্যবহার করা উচিত এবং যাইহোক কোনও এজেন্টের কাছে হস্তান্তর করা উচিত নয়। নিউজলেটার সাইনআপ এবং বিনামূল্যে ট্রায়ালের জন্য আপনি যে পাসওয়ার্ডটি পুনঃব্যবহার করেন তা হল উদ্দেশ্যমূলক ব্যবহারের ক্ষেত্রে৷
স্ক্রিনশট রিডাকশন সেটিং কি গ্যারান্টি দেয় যে আমার ব্যক্তিগত ডেটা কখনই ক্লাউড ভিশন মডেলে পৌঁছাবে না?
না - এটি এক্সপোজার হ্রাস করে, এটি একটি গ্যারান্টি নয়। যখন সক্রিয় (সেটিংস → মাল্টিমোডাল → স্ক্রিনশট রিডাকশন, ডিফল্টরূপে বন্ধ), WebBrain পিক্সেলেট ক্ষেত্র এবং পাঠ্য গঠন করে যা প্রতিটি স্ক্রিনশটে একটি ইমেল ঠিকানা বা ফোন নম্বরের মতো দেখায় আগে এটি একটি দৃষ্টি মডেল পাঠানো হয়. DOM হিউরিস্টিকস ব্যবহার করে সনাক্তকরণ সম্পূর্ণরূপে আপনার ডিভাইসে চলে; অতিরিক্ত কিছুই প্রেরণ করা হয় না।
এটি সর্বোত্তম-প্রচেষ্টা এবং ব্যর্থ-খোলা। যদি ডিটেক্টর একটি পৃষ্ঠায় চলতে না পারে - উদাহরণস্বরূপ একটি নেভিগেশনের পরপরই, পিডিএফ ভিউয়ারে বা সীমাবদ্ধ ব্রাউজার পৃষ্ঠাগুলিতে - স্ক্রিনশট এখনও পাঠানো হয় unredacted আপনার কাজ বাতিল করার পরিবর্তে। DOM হিউরিস্টিকস যে বিষয়বস্তু দেখতে পারে না (ক্যানভাসে আঁকা পাঠ্য, চিত্রের ভিতরে PII, অস্বাভাবিক উইজেট) এছাড়াও স্লিপ হতে পারে। এবং সেটিং শুধুমাত্র স্ক্রিনশট কভার করে: পৃষ্ঠা পাঠ্য মডেল পাঠানো এটি দ্বারা সংশোধন করা হয় না.
সম্পূর্ণ দৃষ্টি গোপনীয়তার জন্য, একটি স্থানীয় মডেল ব্যবহার করুন. অফলাইন প্রদানকারীর সাথে যেমন llama.cpp বা Ollama, স্ক্রিনশট এবং পৃষ্ঠার পাঠ্য কখনই আপনার মেশিন থেকে যায় না, তাই প্রথম স্থানে সংশোধন করার কিছু নেই — এটিই একমাত্র কনফিগারেশন যেখানে গোপনীয়তা নিশ্চিত করা হয়৷ দেখুন "আমি কি পুরোপুরি অফলাইনে WebBrain ব্যবহার করতে পারি?" উপরে
এমন একটি মেশিন নেই যা একটি দৃষ্টি-সক্ষম স্থানীয় মডেল চালাতে পারে? একটি ভাল মিডল গ্রাউন্ড হল পরিকল্পনা এবং টুল কলের জন্য একটি ছোট স্থানীয় মডেল (একটি পরিমিত CPU/GPU-এর জন্য যথেষ্ট দ্রুত এবং হালকা) যা ভিশন সাব-কলের জন্য একটি ক্লাউড প্রদানকারীর সাথে যুক্ত, স্ক্রিনশট রিডাকশন চালু আছে। আপনি এখনও ডিভাইসে আপনার কথোপকথন এবং পৃষ্ঠার পাঠ্য রাখেন এবং ক্লাউড ভিশনের জন্য ছেড়ে যাওয়া প্রতিটি স্ক্রিনশটের ফর্ম ক্ষেত্র রয়েছে এবং সনাক্ত করা ইমেল/ফোনগুলি প্রথমে ঝাপসা করা হয়েছে — সম্পূর্ণ স্থানীয় দৃষ্টি মডেলের জন্য হার্ডওয়্যারের প্রয়োজন ছাড়াই ক্লাউড এক্সপোজার হ্রাস করা হয়েছে। অধীনে দৃষ্টি বিভক্ত কনফিগার করুন সেটিংস → দৃষ্টি (উপরে দেখুন "কিভাবে WebBrain ক্লাউড LLM বিল নিয়ন্ত্রণে রাখে?"
WebBrain কি পুরো DOM এআই মডেলে পাঠায়?
না। WebBrain ডিফল্টভাবে কাঁচা HTML বা কাঁচা DOM ডাম্প পাঠায় না। এটি পৃষ্ঠার URL ও শিরোনাম, প্রাসঙ্গিক সাইট নির্দেশনা এবং ভিশন চালু থাকলে ঐচ্ছিক ভিউপোর্ট স্ক্রিনশট দিয়ে শুরু করে।
কোনো কাজে পৃষ্ঠার বিষয়বস্তু দরকার হলে WebBrain চাহিদামতো একটি সংক্ষিপ্ত সেমান্টিক অ্যাক্সেসিবিলিটি ট্রি বা নিষ্কাশিত লেখা পড়ে। প্রয়োজন অনুযায়ী দৃশ্যমানতা ফিল্টার করা হয়, অক্ষরসীমা প্রয়োগ করা হয় এবং বড় ফলাফল পৃষ্ঠায় ভাগ করা হয়। কাঁচা পৃষ্ঠা-উৎস কেবল Dev মোডে পাওয়া যায়।
Why is WebBrain 33.0.0 and later GPL-licensed?
WebBrain 33.0.0 and later is distributed under GPL-3.0-or-later because the browser extension bundles and integrates the GPL-licensed Xapian/libzim WebAssembly runtime for full-text Wikipedia ZIM search.
The extension packages include the applicable GPL notices, and complete corresponding source for the bundled runtime is published alongside each release. Releases before 33.0.0 remain MIT-licensed, and independently published subprojects and third-party components retain their stated licenses. See the licensing decision record for details.
