سوالات متداول

سوالات متداول

پاسخ‌های سریع درباره راه‌اندازی، مدل‌ها، صورت‌حساب، امنیت و نحوه کار WebBrain در مرورگر شما.

درباره WebBrain

6
آیا WebBrain یک جایگزین رایگان برای پلاگین مرورگر کلود است؟

بله. WebBrain قابلیت‌های عامل مرورگر هوش مصنوعی مشابهی را ارائه می‌کند - خواندن صفحات، استخراج داده‌ها، کلیک کردن روی دکمه‌ها، پر کردن فرم‌ها و خودکار کردن گردش‌های کاری چند مرحله‌ای. برخلاف پلاگین مرورگر اختصاصی Claude که به اشتراک Claude Pro نیاز دارد و فقط با مدل‌های Anthropic کار می‌کند، WebBrain کاملاً رایگان، منبع باز (مجوز MIT) است و از چندین ارائه‌دهنده LLM از جمله مدل‌های محلی که کاملاً روی دستگاه شما اجرا می‌شوند، پشتیبانی می‌کند.

چگونه WebBrain با OpenClaw، Browser-Use و سایر چارچوب‌های عامل هوش مصنوعی مقایسه می‌شود؟

آنها دسته های مختلفی از ابزارها هستند. WebBrain یک افزونه مرورگر است — شما آن را در Chrome یا Firefox نصب می‌کنید و با آن در پانل کناری چت می‌کنید، بدون نیاز به کدنویسی. چارچوب هایی مانند OpenClaw و Browser-Use SDK های توسعه دهنده ای برای ایجاد خطوط لوله مرورگر خودکار در پایتون هستند که معمولاً از مرورگرهای بدون سر و CDP استفاده می کنند. به این فکر کنید: WebBrain برای مرور روزانه با دستیار هوش مصنوعی است. چارچوب های عامل برای ساخت ربات های خراش دهنده و اتوماسیون تست هستند. می توانید از هر دو استفاده کنید - آنها مکمل یکدیگر هستند.

آیا WebBrain روی Firefox کار می کند؟

بله. WebBrain با نسخه Chrome (مانیفست V3، با استفاده از SidePanel API) و نسخه Firefox (مانیفست V2، با استفاده از sidebar_action) عرضه می‌شود. هر دو نسخه دارای ویژگی های یکسان هستند. نسخه Firefox را می توان به عنوان یک افزونه موقت برای توسعه بارگیری کرد یا برای نصب دائمی در addons.mozilla.org منتشر کرد.

چگونه از WebBrain برای خراش دادن وب و استخراج داده ها استفاده کنم؟

به سادگی هر صفحه وب را باز کنید، پانل جانبی WebBrain را باز کنید و به زبان طبیعی بپرسید: "همه نام های محصول و قیمت ها را از این صفحه استخراج کنید"، "همه آدرس های ایمیل را در این صفحه دریافت کنید"، یا "این مقاله را در نقاط گلوله خلاصه کنید". عامل هوش مصنوعی محتوای صفحه را می خواند، ساختار را درک می کند و داده های استخراج شده را برمی گرداند. برای خراش دادن پیچیده تر، به حالت Act بروید و عامل می تواند بین صفحات پیمایش کند، دکمه های صفحه بندی را کلیک کند و داده ها را در چندین صفحه جمع آوری کند.

آیا WebBrain از حالت اجرای خشک پشتیبانی می کند؟

از 7.0.0، هنوز نه حالت Dry-run برنامه ریزی شده است و در حال حاضر در نقشه راه قرار دارد.

آیا می توانم به WebBrain کمک کنم؟

قطعا! WebBrain دارای مجوز MIT است و از مشارکت ها استقبال می کند. بررسی کنید مخزن GitHub برای مسائل، درخواست‌های ویژگی، و دستورالعمل‌های مشارکت.

فضای ابری و صورت‌حساب

4
اشتراک WebBrain Cloud چقدر است؟

WebBrain Cloud در حال حاضر است 5 دلار در ماه برای هر نمایه دستگاه، در حال حاضر بسیار ارزان تر از کلود پرو است. استفاده در حال حاضر تحت خط مشی استفاده منصفانه نامحدود است: استفاده شخصی معمولی خوب است، اما استفاده توهین آمیز، خودکار، فروش مجدد یا استفاده غیرمعمول با حجم بالا مجاز نیست.

اشتراک به شناسه دستگاه ایجاد شده توسط برنامه افزودنی برای آن مرورگر + OS GUID مرتبط است، نه به یک حساب کاربری. اگر به دلیل بازنشانی فضای ذخیره سازی افزونه، حذف نمایه مرورگر، نصب مجدد مرورگر، تغییر مرورگر/سیستم عامل یا گم شدن دستگاه، آن شناسه گم شده باشد، نمی توانیم آن را بازیابی یا انتقال دهیم و برای آن ضرر بازپرداختی صادر نمی کنیم.

چگونه اشتراک خود را مدیریت یا لغو کنم؟

صورت‌حساب را در api.webbrain.one/account مدیریت کنید و با ایمیل خود وارد شوید.

Cloud Sync رمزگذاری شده چگونه کار می کند؟

Cloud Sync یک ویژگی اختیاری برای مشترکین فعال WebBrain Cloud است. این حافظه‌های WebBrain، متن تکمیل خودکار نمایه و پیکربندی ارائه‌دهنده پشتیبانی‌شده، از جمله کلیدهای API را همگام‌سازی می‌کند. این کار را انجام می دهد نه سابقه چت، سابقه مرورگر، اسکرین شات های صفحه، یا توکن های OAuth قدیمی را همگام کنید و آن ها را به روز کنید.

مرورگر شما مخزن همگام‌سازی را قبل از آپلود با رمز عبوری که انتخاب می‌کنید رمزگذاری می‌کند. WebBrain Cloud فقط مخزن رمزگذاری شده را ذخیره می کند. نمی تواند خاطرات، متن نمایه، تنظیمات ارائه دهنده یا کلیدهای API شما را بخواند و نمی تواند رمز عبور همگام سازی را برای شما بازیابی کند.

فیلد ایمیل برای احراز هویت صورتحساب/اشتراک با پیوند جادویی ابری WebBrain است. رمز عبور حساب کاربری نیست. اگر رابط کاربری بگوید رمز عبور را در Cloud Sync تغییر دهید، به این معنی است رمز عبور رمزگذاری را همگام سازی کنید، رمز عبور حساب WebBrain نیست.

اگر رمز عبور همگام‌سازی را فراموش کردید، طاق ابر رمزگذاری شده قدیمی قابل رمزگشایی نیست. می‌توانید صندوق ابری را بازنشانی کنید و یک نسخه رمزگذاری‌شده جدید را از دستگاهی که هنوز داده‌ها را به صورت محلی دارد، آپلود کنید.

چگونه WebBrain صورتحساب های ابر LLM را تحت کنترل نگه می دارد؟

سه لایه مستقل:

اسکرین شات های آگاه به نشانه. قبل از اینکه هر تصویری از دستگاه شما خارج شود، WebBrain اندازه آن را تغییر می‌دهد (ضلع کوتاه‌تر، حفظ نسبت تصویر) و به طور مکرر JPEG آن را فشرده می‌کند تا زمانی که با بودجه نماد تصویر در هر نوبت مطابقت داشته باشد. یک اسکرین شات 2000×1200 که برای شما حدود 1500 توکن ورودی در GPT-4o هزینه دارد، به 300 تا 500 توکن فشرده می‌شود، بدون اینکه عملاً برای کارهای خواندن صفحه از دست بدهید. اجرا شده در _fitImageDimensions با آزمون های واحد برای ریاضی بودجه.

پیرایش بافت هوشمند تاریخچه مکالمه، خروجی‌های ابزار، و تخلیه‌های DOM درون خطی در هر نوبت محدود می‌شوند و زمانی که پنجره زمینه مدل فعال به پر شدن نزدیک می‌شود، در اولین قدم کوتاه می‌شوند. شما یک بالون بدون صدا از 10 هزار توکن تا 100 هزار را مشاهده نخواهید کرد زیرا read_page یک مقاله طولانی را برگرداند.

مدل دید اختصاصی. یک مدل نوشتاری ارزان (مثلاً GPT-4o-mini) را برای برنامه‌ریزی و تماس‌های ابزاری با یک مدل جداگانه با قابلیت دید (مانند GPT-4o) فقط برای عکس‌های صفحه‌نمایش جفت کنید، بنابراین قیمت‌های مدل چندوجهی را در هر نوبت پرداخت نکنید. در زیر پیکربندی کنید تنظیمات → چشم انداز.

نتیجه خالص: جلسات طولانی با ارائه دهندگان ابر قابل پیش بینی باقی می مانند. برای کنترل کامل، از llama.cpp به صورت محلی استفاده کنید - هزینه هر توکن صفر است.

مدل‌ها و راه‌اندازی محلی

7
آیا می توانم از WebBrain کاملا آفلاین استفاده کنم؟

بله. ارائه‌دهنده پیش‌فرض WebBrain llama.cpp است که یک مدل هوش مصنوعی محلی را روی رایانه شما اجرا می‌کند. بدون نیاز به کلید API، بدون نیاز به اینترنت برای هوش مصنوعی، و هیچ داده ای هرگز از دستگاه شما خارج نمی شود. فقط یک مدل GGUF را دانلود کنید، سرور لاما را راه اندازی کنید و یک عامل مرورگر هوش مصنوعی کاملا خصوصی دارید. همچنین می‌توانید از Ollama با نقطه پایانی سازگار با OpenAI استفاده کنید.

WebBrain کدام مدل های هوش مصنوعی را پشتیبانی می کند؟

WebBrain از چهار نوع ارائه دهنده پشتیبانی می کند: llama.cpp (هر مدل GGUF محلی)، OpenAI (GPT-4o، GPT-4، و غیره)، Claude (Claude Opus، Sonnet، Haiku از طریق API اصلی) و OpenRouter (دسترسی به بیش از 100 مدل از ارائه دهندگان مختلف). هر نقطه پایانی API سازگار با OpenAI کار می کند، بنابراین می توانید از خدماتی مانند Together AI، Groq، Mistral یا هر سرور محلی با رابط سازگار با OpenAI استفاده کنید.

چرا WebGPU فقط در حالت Apocalypse در دسترس است؟

زیرا هنوز استنتاج متن مبتنی بر WebGPU درون مرورگر را برای بیشتر کاربران به اندازه کافی خوب نمی‌دانیم و نمی‌خواهیم تجربه ضعیفی را تحمل کنید. اگر می‌خواهید همان مدل LFM2.5 2.6B را به‌صورت محلی استفاده کنید، استنتاج را روی دستگاه خود با llama.cpp یا Ollama اجرا کنید و به‌جای اتکا به WebGPU، WebBrain را به آن نقطه پایانی محلی متصل کنید.

راهکار پشتیبان بینایی WebGPU همچنان در دسترس است، چون مدل آن بسیار کوچک‌تر است و فقط گاهی استفاده می‌شود.

هنگام اتصال به یک سرور LLM محلی (vLLM, Ollama, llama.cpp) در شبکه خود "وااکشی ناموفق" دریافت می کنم

اگر سرور LLM شما روی دستگاه دیگری در شبکه محلی شما قرار دارد (به عنوان مثال http://192.168.1.x:8000، Chrome درخواست را مسدود می کند مگر اینکه سرور ارسال کند سرصفحه های CORS. رفع بستگی به سرور شما دارد:

vLLM: شروع کنید با --allowed-origins '["*"]' (مقدار باید یک لیست JSON باشد).
Ollama: متغیر محیط را تنظیم کنید OLLAMA_ORIGINS=* قبل از شروع
llama.cpp: CORS به طور پیش فرض فعال است - نیازی به تغییر نیست.

اگر سرور شما روشن است localhost (همان دستگاه مرورگر)، CORS معمولاً مورد نیاز نیست. این مشکل فقط بر اتصالات بین ماشینی در شبکه محلی تأثیر می گذارد. مطمئن شوید که URL پایه شما در تنظیمات WebBrain به پایان می رسد /v1 (به عنوان مثال http://192.168.1.47:8000/v1). استثنا: Ollama استفاده شده از یک برنامه افزودنی مرورگر ممکن است هنوز نیاز داشته باشد OLLAMA_ORIGINS; سوالات متداول Ollama را در زیر ببینید.

چرا Ollama در localhost 403 را از پسوند WebBrain برمی گرداند؟

نسخه‌های اخیر Ollama می‌توانند درخواست‌های مبدا برنامه‌های افزودنی مرورگر را رد کنند، حتی زمانی که Ollama روی یک دستگاه اجرا می‌شود. برنامه افزودنی یک را می فرستد Origin مانند chrome-extension://... یا moz-extension://...، و Ollama ممکن است به 403 پاسخ دهد مگر اینکه این مبدا مجاز باشد.

از هر برنامه دسکتاپ Ollama که در حال حاضر پورت را نگه داشته است، خارج شوید 11434، سپس Ollama را با یکی از این دستورات شروع کنید:

OLLAMA_ORIGINS="*" ollama serve
OLLAMA_ORIGINS="chrome-extension://*,moz-extension://*" ollama serve

URL پایه WebBrain Ollama را روی تنظیم نگه دارید http://localhost:11434/v1. ترمینال curl چک‌ها همچنان می‌توانند بدون این تنظیم کار کنند، زیرا آنها منبع برنامه افزودنی مرورگر را ارسال نمی‌کنند.

آیا می توانم از آن در LM Studio نیز استفاده کنم؟

بله. ابزارهای شبکه فقط خواندنی WebBrain — fetch_url و research_url - همچنین به صورت مستقل ارسال شود LM Studio پلاگین در webbrain/web-tools. نصب با lms clone webbrain/web-tools و آن را در هر چت LM Studio روشن کنید – هر مدلی که دارای ابزار باشد می تواند بدون نصب افزونه مرورگر آن دو ابزار را فراخوانی کند. Node خالص، بدون مرورگر بدون سر. منبع: پلاگین lmstudio/.

مرورگرها و استفاده روزمره

5
آیا می توانم نوار کناری Firefox را مانند پانل کناری Chrome از چپ به راست حرکت دهم؟

بله - نوار کناری Firefox به طور پیش فرض به سمت چپ است، اما می توانید آن را برگردانید. در هر نقطه از هدر نوار کناری کلیک راست کرده و انتخاب کنید نوار کناری را به راست منتقل کنید (یا استفاده کنید مشاهده → نوار کناری → انتقال نوار کناری به راست از نوار منو). موقعیت در طول راه اندازی مجدد باقی می ماند. پنل جانبی Chrome به طور پیش فرض در سمت راست قرار دارد و از طریق خود پنل قابل جابجایی توسط کاربر نیست.

آیا هنگام استفاده از WebBrain در پنل وب ویوالدی محدودیتی وجود دارد؟

بله. پنل های وب ویوالدی دیالوگ های بومی جاوا اسکریپت مانند confirm()، alert()، و prompt(). سوئیچ حالت Ask، Act و Dev WebBrain دیگر به آن دیالوگ ها بستگی ندارد، اما چند عمل ثانویه همچنان به آن بستگی دارند.

ضبط: استفاده نکنید /record در حال حاضر در ویوالدی اگر ضبط ناموفق باشد، ویوالدی می‌تواند هشدار خطا را پنهان کند و هیچ توضیح قابل مشاهده‌ای باقی نگذارد.

تنظیمات، تاریخچه، ردیابی و انتقال Ollama: اینها همچنین حاوی دیالوگ های بومی هستند، اما WebBrain معمولاً آنها را به عنوان برگه های معمولی، جایی که کار می کنند، باز می کند. اگر به صورت دستی یکی را در یک پنل وب قرار می دهید، قبل از استفاده از اقدامات وابسته به گفتگو، آن را در یک برگه معمولی باز کنید.

آیا هنگام کار WebBrain در برگه‌ام می‌توانم به بالا یا پایین پیمایش کنم؟

بیشتر مواقع بله — به‌ویژه در حالت Ask برای درخواست‌های فقط‌خواندنی مانند «این صفحه را خلاصه کن». هنگام کار WebBrain می‌توانید به پیمایش ادامه دهید.

چه زمانی بهتر است این کار را نکنم؟ اسکرین‌شات‌های خودکار نمای فعلی برگه را نشان می‌دهند. وقتی WebBrain در حالت Act یا Dev به‌طور فعال محتوای قابل‌مشاهده را بررسی می‌کند یا با آن تعامل دارد، پیمایش ممکن است هدف را جابه‌جا کند یا آنچه مدل می‌بیند را تغییر دهد. پیش از پیمایش بگذارید آن مرحله تمام شود؛ خارج از این لحظه‌ها می‌توانید به استفاده از صفحه ادامه دهید.

آیا می‌توانم زمانی که WebBrain روی یک صفحه کار می‌کند، به برگه دیگری بروم؟

بله. از نسخه 27.0.0 به بعد، WebBrain در مرورگرهای مبتنی بر Chromium و Firefox فوکوس را نمی‌گیرد، مگر اینکه دسترسی در پیش‌زمینه کاملاً ضروری باشد. اجرا به همان برگه‌ای که در آن آغاز شده متصل می‌ماند، بنابراین می‌توانید با خیال راحت در برگه دیگری کار کنید.

اگر مرحله‌ای نادر به نمایش برگه اصلی در پیش‌زمینه نیاز داشته باشد، WebBrain ممکن است برای مدت کوتاهی آن برگه را در فوکوس قرار دهد. وقتی WebBrain به‌طور فعال در همان برگه کار می‌کند، از کلیک یا تایپ کردن در آن خودداری کنید.

WebBrain با بنرهای کوکی و دیوارهای پرداخت چه می کند؟

بنرهای کوکی: WebBrain آگهی‌های رضایت را از چارچوب‌های رایج (OneTrust، Cookiebot، Didomi، Quantcast، Google Funding Choices، TrustArc) تشخیص می‌دهد و قبل از استدلال درباره صفحه، آن‌ها را رد می‌کند. اولویت "رد همه" / "رد غیر ضروری" / "فقط ضروری" زمانی که به وضوح قابل مشاهده است. به جای ناپدید شدن در پیچ و خم «مدیریت تنظیمات برگزیده» به «پذیرفتن همه» برمی گردد.

Paywalls: WebBrain paywall را صادقانه گزارش می‌کند و به شما می‌گوید که واقعاً چه چیزی را می‌تواند ببیند (تیتر، دک، پاراگراف‌های اول). این کار را انجام می دهد نه تلاش برای دور زدن دیوارهای پرداخت - بدون archive.today، 12ft.io، پاک کردن کوکی، غیرفعال کردن JS یا ترفندهای حالت خواننده. اگر مقاله کامل را می‌خواهید، با اشتراک وارد شوید یا از WebBrain بخواهید تا به دنبال پوشش رایگان همان داستان باشد.

امنیت و حریم خصوصی

7
آیا استفاده از WebBrain ایمن است؟ آیا می تواند صفحات وب را تغییر دهد؟

WebBrain دارای سه حالت است. حالت درخواست (پیش‌فرض) فقط خواندنی است و نمی‌تواند چیزی را در صفحه تغییر دهد. حالت Act عملکردهای مرورگر مانند کلیک کردن، تایپ کردن و پیمایش را فعال می کند، در حالی که حالت Dev ابزارهای اشکال زدایی صفحه را اضافه می کند. اقدامات بعدی به طور پیش فرض نیاز به تأیید دارند. اگر آن دروازه مجوز خاموش باشد، WebBrain یک بنر هشدار قابل مشاهده را نمایش می دهد. با دکمه Stop می توانید در هر زمان عامل را متوقف کنید. کد منبع برنامه افزودنی برای بازرسی در GitHub کاملاً باز است.

بنر "WebBrain شروع به رفع اشکال این مرورگر کرد" چیست؟ چرا WebBrain از CDP استفاده می کند؟

WebBrain برای عملکرد قابل اعتماد روی یک صفحه، از پروتکل Chrome DevTools Protocol (CDP) از طریق استاندارد استفاده می کند. chrome.debugger افزونه API — این همان چیزی است که بنر "WebBrain شروع به اشکال زدایی این مرورگر" Chrome کرد. CDP چیزی است که به عامل اجازه می دهد کلیک کند و با آن تایپ کند رویدادهای ورودی قابل اعتماد که سایت های مدرن در واقع به آن احترام می گذارند. رویدادهای مصنوعی ایجاد شده از یک اسکریپت محتوا توسط بسیاری از سایت‌ها، مؤلفه‌های وب و ورودی‌های کنترل‌شده با چارچوب رد می‌شوند. همچنین این است که چگونه WebBrain اسکرین شات های دقیق پیکسلی را برای بازگشت بینایی می گیرد و به iframe های متقاطع و سایه DOM که اسکریپت های محتوا نمی توانند آن را ببینند.

فقط خواندنی حالت درخواست نیازی به CDP ندارد - خواندن صفحه و درخت دسترسی از طریق اسکریپت های محتوای معمولی انجام می شود. این است حالت عمل قابلیت اطمینان و منبع متقابلی که به آن نیاز دارد، و در یک برنامه افزودنی Manifest V3 هیچ API بدون اشکال‌زدایی برای ورودی قابل اعتماد وجود ندارد. WebBrain دیباگر را متصل می کند فقط زمانی که یک عمل به آن نیاز دارد، در هر برگه، و کل برنامه افزودنی منبع باز است، بنابراین می توانید دقیقاً آنچه را که جلسه انجام می دهد بررسی کنید. CDP قدرتمند است، بنابراین ما ردپای آن را به‌عنوان چیزی برای مهار در نظر می‌گیریم - در صورت تقاضا، آن را ضمیمه می‌کنیم، خواندن آن را ادامه می‌دهیم - و سخت‌تر کردن آن بیشتر در نقشه راه امنیتی ما است.

خیلی از من سوال میپرسه آیا می توانم آن را غیرفعال کنم؟

این درخواست های تایید برای ایمنی شما هستند. حتی در سایت‌هایی که به آنها اعتماد دارید، بازیگران مخرب می‌توانند دستورالعمل‌های LLM را تقلید کنند یا محتوایی را تزریق کنند که سعی می‌کند عامل را وادار کند کارهایی را از طرف شما انجام دهد که شما آنها را تأیید نمی‌کنید. به همین دلیل است که WebBrain قبل از اقدامات بعدی درخواست می کند. اگر هنوز نمی‌خواهید از طریق آن دستورات عبور کنید، تایپ کنید /dangerously-skip-permissions در پانل کناری، یا افزونه جانبی را باز کنید، روی نماد چرخ در هدر کلیک کنید، به آن بروید مجوزها برگه در settings.html، و خاموش کنید قبل از اقدامات بعدی بپرسید.

آیا WebBrain مستقیماً APIها را فراخوانی می‌کند یا همیشه از طریق UI کلیک می‌کند؟

به طور پیش فرض، WebBrain همیشه از طریق رابط کاربری قابل مشاهده می گذرد برای هر اقدامی که باعث ایجاد، تغییر، حذف، ارسال، ارسال، پست یا خرید هر چیزی شود. به صفحه هدایت می شود، فرم را پر می کند و روی دکمه کلیک می کند - دقیقاً همانطور که شما انجام می دهید. از تماس مستقیم نقاط پایانی REST/GraphQL از طریق پس زمینه خودداری می کند fetch() برای جهش این عمدی است: اقدامات API نامرئی هستند (شما آنچه را که ارسال می‌شود نمی‌بینید)، اغلب به نشانه‌های احراز هویت جداگانه نیاز دارند که ممکن است پیکربندی نکرده باشید، و شعاع انفجار بسیار بزرگ‌تری نسبت به یک کلیک اشتباه قابل مشاهده دارند. UI-first به این معنی است که همه چیز روی صفحه نمایش است، در جلسه معمولی مرورگر شما، و قابل توقف است.

برای خواندن داده ها - واکشی README، جستجوی یک مشکل، مقایسه قیمت ها در بین سایت ها، بررسی صفحه وضعیت - WebBrain آزادانه از درخواست های HTTP پس زمینه از طریق fetch_url و research_url ابزار. خواندن با بازیگری یکی نیست. هیچ چیز را در یک سرویس از راه دور تغییر نمی دهد، بنابراین نگرانی های ایمنی اعمال نمی شود.

اگر به طور خاص می خواهید جهش های API را برای یک کار خاص مجاز کنید، تایپ کنید /allow-api در ابتدای پیام شما (به صورت اختیاری با یک شرح کار کوتاه همراه است). این نادیده گرفتن در هر مکالمه به WebBrain اجازه می‌دهد تا زمانی که رابط کاربری واقعاً از کار افتاده یا غیرقابل اجرا است، به نقاط پایانی API برگردد، در حالی که همچنان وقتی رابط کاربری کار می‌کند، UI را ترجیح می‌دهد. زمانی که لغو فعال است، یک نشان چسبنده در بالای ناحیه ورودی قابل مشاهده می‌ماند و وقتی مکالمه را بازنشانی می‌کنید پاک می‌شود.

پر کردن خودکار نمایه چگونه کار می کند و آیا ایمن است؟

تکمیل خودکار نمایه یک ویژگی اختیاری است تنظیمات → نمایه. شما یک بیوگرافی کوتاه را وارد می کنید - نام، ایمیل کاری، شرکت، و یک دور ریختنی رمز عبور برای ثبت نام های کم هزینه - و آن را روشن کنید. وقتی فعال باشد، WebBrain آن متن را به اعلان سیستم عامل اضافه می‌کند تا بتواند بدون درخواست هر بار فرم‌های ثبت نام را پر کند.

متن ذخیره می شود در متن ساده در حافظه محلی مرورگر شما. هست نه به پروژه WebBrain منتقل شد، اما آن را است به عنوان بخشی از اعلان سیستم به هر ارائه دهنده LLM که در هر نوبت پیکربندی کرده اید ارسال می شود. به طور پیش فرض خاموش است.

برای حساب های مهم رمز عبور قرار ندهید (Google، Apple، iCloud، بانکداری، SSO کار، ایمیل اصلی) در اینجا. این حساب ها باید از 2FA استفاده کنند و به هر حال نباید به یک نماینده تحویل داده شوند. یک رمز عبور دور ریختنی که مجدداً برای ثبت‌نام در خبرنامه و آزمایش‌های رایگان استفاده می‌کنید، مورد استفاده مورد نظر است.

آیا تنظیم ویرایش عکس صفحه تضمین می‌کند که داده‌های خصوصی من هرگز به یک مدل دید ابری نمی‌رسند؟

نه - نوردهی را کاهش می دهد، تضمینی نیست. وقتی فعال شد (تنظیمات → چند وجهی → ویرایش عکس صفحه، به طور پیش فرض خاموش است)، WebBrain فیلدها و متنی را که مانند آدرس ایمیل یا شماره تلفن در هر اسکرین شات به نظر می رسد، پیکسل می کند. قبل از به یک مدل بینایی فرستاده می شود. تشخیص به طور کامل بر روی دستگاه شما با استفاده از اکتشافی DOM اجرا می شود. هیچ چیز اضافی منتقل نمی شود

این بهترین تلاش و شکست باز است. اگر آشکارساز نمی تواند در یک صفحه اجرا شود - به عنوان مثال بلافاصله پس از پیمایش، در بینندگان PDF یا در صفحات مرورگر محدود شده - تصویر صفحه همچنان ارسال می شود. ویرایش نشده به جای اینکه وظیفه خود را لغو کنید محتوایی که اکتشافی DOM نمی تواند ببیند (متن ترسیم شده روی بوم، PII درون تصاویر، ویجت های غیر معمول) نیز ممکن است از بین برود. و این تنظیمات فقط تصاویر صفحه را پوشش می دهد: صفحه متن ارسال شده به مدل توسط آن ویرایش نشده است.

برای حفظ حریم خصوصی دید کامل، از یک مدل محلی استفاده کنید. با ارائه‌دهنده آفلاینی مانند llama.cpp یا Ollama، عکس‌های صفحه و متن صفحه هرگز از دستگاه شما خارج نمی‌شوند، بنابراین در وهله اول چیزی برای ویرایش وجود ندارد - این تنها پیکربندی است که در آن حریم خصوصی تضمین می‌شود. به "آیا می توانم از WebBrain کاملا آفلاین استفاده کنم؟" بالا

آیا ماشینی ندارید که بتواند یک مدل محلی با قابلیت بینایی را اجرا کند؟ یک میانه خوب، یک مدل محلی کوچک برای برنامه‌ریزی و تماس‌های ابزاری (سریع و سبک به اندازه کافی برای یک CPU/GPU متوسط) است که با یک ارائه‌دهنده ابری برای تماس‌های فرعی ویژن جفت می‌شود، و ویرایش عکس صفحه‌نمایش روشن است. شما همچنان مکالمه و متن صفحه خود را در دستگاه نگه می دارید، و هر اسکرین شات که برای Cloud Vision باقی می ماند، فیلدهای فرم و ایمیل ها/تلفن های شناسایی شده را در ابتدا تار می کند - بدون نیاز به سخت افزار برای یک مدل دید محلی کامل، نوردهی ابر را کاهش می دهد. تقسیم بینایی را در زیر پیکربندی کنید تنظیمات → چشم انداز (به "چگونه WebBrain صورتحساب های Cloud LLM را تحت کنترل نگه می دارد؟" در بالا مراجعه کنید).

آیا WebBrain کل DOM را به مدل هوش مصنوعی می‌فرستد؟

خیر. WebBrain به‌طور پیش‌فرض HTML خام یا یک خروجی خام از DOM را ارسال نمی‌کند. ابتدا URL و عنوان صفحه، راهنمای مرتبط با سایت و در صورت فعال بودن قابلیت بینایی، یک تصویر اختیاری از بخش قابل‌مشاهده را در اختیار مدل می‌گذارد.

وقتی کاری به محتوای صفحه نیاز دارد، WebBrain آن را در صورت نیاز به شکل یک درخت دسترس‌پذیری معنایی فشرده یا متن استخراج‌شده می‌خواند. خواندن‌ها در جای مناسب بر اساس قابل‌مشاهده بودن فیلتر می‌شوند، محدودیت نویسه دارند و صفحه‌بندی می‌شوند. دسترسی به منبع خام صفحه فقط در حالت Dev در دسترس است.