本地模型,可见审批

在 Ollama 中选择模型,在 WebBrain 中使用。

WebBrain 目前可以使用 Ollama 的本地 OpenAI 兼容端点。通过官方 Ollama 版本在设置中配置,或尝试预览版启动交接,将模型、端点和上下文窗口发送到 WebBrain 进行一键审批。

启动命令仍处于预览阶段

ollama launch webbrain 尚未包含在上游 Ollama 构建中。常规设置路径适用于官方版本;单命令交接目前需要使用链接的预览分支。

两种安装路径

选择与你的 Ollama 版本匹配的路径

路径适用场景操作步骤
手动配置提供商安装了官方 Ollama 版本。启动 Ollama 并允许扩展来源,然后在 WebBrain 设置中输入本地端点和模型。
启动交接编译了当前预览分支,希望最简安装。运行 ollama launch webbrain --model <model>,查看浏览器提示并批准提供商更改。
WebBrain 和 Ollama 的图标通过一颗心连接
Ollama 在本地提供模型;WebBrain 为该模型赋予浏览器代理工具。
适用于上游 Ollama

手动配置官方 Ollama 版本

  1. 安装 Ollama 并拉取合适的模型。选择能够可靠执行工具调用的模型。代理运行至少需要 16k 令牌上下文窗口。
  2. 允许浏览器扩展来源。如果另一个 Ollama 桌面进程已占用端口 11434,先退出该进程,然后使用下面的来源白名单从终端启动服务器。
  3. 打开 WebBrain 设置。进入提供商与模型,找到 Ollama (Local) 并打开卡片。
  4. 输入端点和模型。使用 http://localhost:11434/v1,然后选择你拉取的模型。
  5. 保存并测试连接。使用加载模型让 WebBrain 读取可用的模型 ID 并检测实时上下文窗口。
  6. 设为活跃。先使用 Mid 提示层级。仅在模型上下文受限时使用 Compact。
ollama pull <model>
OLLAMA_ORIGINS="chrome-extension://*,moz-extension://*" ollama serve
终端请求可能成功但 WebBrain 收到 403

curl 不会发送浏览器扩展来源。如果 Ollama 在终端中正常工作但在 WebBrain 中失败,请使用 OLLAMA_ORIGINS 重启 Ollama 服务器,而不是更改提供商 URL。

预览版 · 更少设置

尝试 Ollama 启动交接

预览命令会打开一个 WebBrain 启动 URL,其中包含选定的模型、本地回环 /v1 端点和检测到的上下文窗口。扩展会在更改前显示这些值的确认对话框。

git clone https://github.com/esokullu/ollama.git
cd ollama
git switch codex/ollama-webbrain-launch-handoff
cmake -S . -B build -G Ninja -DOLLAMA_MLX_BACKENDS=
cmake --build build --parallel 8

OLLAMA_ORIGINS="chrome-extension://*,moz-extension://*" ./ollama serve

保持服务器运行。在另一个终端中,将示例模型替换为你本地 Ollama 安装中可用的模型:

./ollama launch webbrain --model qwen3.5:9b
  1. 让命令打开 webbrain.one。扩展仅在 WebBrain Ollama 启动页面上接受此交接。
  2. 查看确认信息。检查模型、本地回环提供商 URL 和上下文窗口。
  3. 批准更改。WebBrain 更新本地 Ollama 提供商并将其设为活跃。
  4. 打开侧边栏。活跃提供商应显示为 Ollama (Local)
WebBrain 确认对话框,显示 Ollama 模型、提供商 URL 和上下文窗口
交接始终是用户决定:在你批准浏览器提示之前,不会保存任何内容。
交接保持本地化

WebBrain 仅接受本地回环 Ollama 主机、不含嵌入凭据的 HTTP(S) URL,以及 OpenAI 兼容的 /v1 端点。模型名称和上下文窗口在保存提供商之前会被标准化。

选择能驱动代理的模型和上下文

  • 从 16k 上下文或更高开始。这是系统提示、浏览器工具、页面内容和有用对话历史的实际最低要求。
  • 工具使用训练很重要。一个正常聊天回答良好的模型仍可能产生格式错误或缺失的工具调用。
  • 先使用 Mid。它暴露常用浏览器工具集,提示成本更低。Compact 可在 8k 左右帮助;4k 太小,无法可靠运行。
  • 视觉功能因模型而异。仅在你提供的 Ollama 模型接受图像时才启用视觉功能。
  • 测试实时模型。测试连接加载模型可以读取 Ollama 的运行时信息并刷新检测到的上下文窗口。

按症状排查

症状可能原因解决方法
WebBrain 报告 403Ollama 拒绝了扩展来源。使用 OLLAMA_ORIGINS="chrome-extension://*,moz-extension://*" 重启服务器。
连接被拒绝Ollama 已停止,或 WebBrain 使用了错误的端口。运行 ollama serve 并将基础 URL 保持在 http://localhost:11434/v1
找不到模型保存的模型 ID 与 Ollama 目录不完全匹配。运行 ollama list 或使用加载模型,然后复制完整的模型名称(包括标签)。
模型只聊天而不使用浏览器工具模型在工具使用方面较弱,或上下文/提示层级太受限。尝试经过工具训练的模型,增加上下文,或从 Compact 切换到 Mid。
ollama launch 未知命令正在运行上游 Ollama 构建。使用手动提供商设置,或编译链接的预览分支。
启动页面打开但没有任何提示WebBrain 扩展缺失、已禁用或已过时。webbrain.one 上启用当前扩展,重新加载启动页面,然后再次运行命令。

有关发布公告、截图和当前预览版设计理由,请阅读 WebBrain 现已支持 Ollama 启动交接