
Page Assist 是 n4ze3m 主导的开源浏览器扩展,MIT 许可。它把 Ollama 等本地 AI 模型(以及 Chrome AI / 任意 OpenAI 兼容端点)的能力,无缝嵌入浏览器——通过侧边栏(任意网页 Ctrl+Shift+Y 唤出)与独立 Web UI(Ctrl+Shift+L 打开)两种形态 ,让用户在任何网页上都能直接调起本地 LLM 进行对话、网页内容问答、PDF/文档聊天、联网搜索。官方明确定位:”Use your locally running AI models to assist you in your web browsing” 。它是”交互前端”分类中唯一的”浏览器扩展形态”代表——与 Open WebUI(自托管 Web UI)、AnythingLLM(全栈私有 AI 应用)、NextChat(轻量跨平台客户端)、Chatbot UI(全栈自托管)、Astral Web UI(极简本地优先+分支对话树)、ChatALL(多模型并发对比桌面客户端)、LibreChat/LobeChat/Cherry Studio(已移至通用工作台)形成清晰的差异化:Page Assist 的核心价值在”把本地 LLM 常驻浏览器,在网页浏览流中零切换调用 AI“。
产品概述
Page Assist 由 Muhammed Nazeem(n4ze3m)开发,是一款开源浏览器扩展,官方仓库描述:”Page Assist is an open-source browser extension that provides a sidebar and web UI for your local AI model. It allows you to interact with your model from any webpage” 。
核心定位哲学:
Page Assist 要解决的核心痛点是——Ollama 等本地 LLM 默认只有命令行界面,用户在浏览网页时需要 AI 辅助(总结、翻译、问答、提取),就必须在终端和浏览器之间反复切换 。Page Assist 通过浏览器扩展形态,把本地 LLM 的能力”常驻”在浏览器中:
- 侧边栏:在任意网页上按
Ctrl+Shift+Y唤出,与当前页面并排显示 - Web UI:按
Ctrl+Shift+L打开独立标签页,ChatGPT 风格的完整聊天界面
它做什么 / 不做什么(关键归类):
- ✅ 做:作为浏览器扩展运行 → 接收用户输入 → 通过 Ollama 或 OpenAI 兼容端点调用本地/远程模型 → 在侧边栏/Web UI 中展示响应 → 在此之上提供与网页对话、与 PDF/文档聊天、联网搜索、视觉模型支持、MCP 客户端(beta)、记忆(beta)
- ❌ 不做:不持有模型算力、不做统一 API 端点(非 API 中间件)、不做多用户协作、不具备 Agent 编排/MCP 市场/工作流(与 LibreChat/LobeChat 的本质区别)
- 本质是浏览器扩展形态的交互前端:它是”交互前端”分类中唯一的浏览器扩展——填补了”桌面客户端(LM Studio/Jan/GPT4All/ChatALL)”和”Web UI(Open WebUI/NextChat 等)”之外的第三类形态:浏览器原生集成。
技术架构 :
- 扩展框架:WXT(Web Extension Tools),实现跨浏览器兼容
- 前端:React + TypeScript
- 状态管理:Zustand
- 本地存储:Dexie(IndexedDB 封装),用于聊天历史、模型配置、知识库向量数据
- 文档处理:支持 PDF/CSV/TXT/MD/DOCX 解析
- AI 集成层:统一接口适配 Ollama、Chrome AI(Gemini Nano)、OpenAI 兼容端点
- 通信机制:基于 WebSocket 与 Ollama 实时通信,支持流式响应
- 构建产物:Chrome/Edge/Brave/Vivaldi 的 MV3 扩展,Firefox 的 MV2 扩展
支持的 AI 提供商 :
- Ollama:本地运行的开源模型(默认主提供商)
- Chrome AI(Gemini Nano):浏览器内置的轻量模型(Beta)
- OpenAI 兼容 API:LM Studio、Llamafile、vLLM、LLaMA.cpp 等任意兼容端点(Beta)
浏览器兼容矩阵 :
| 浏览器 | 侧边栏 | 与网页对话 | Web UI |
|---|---|---|---|
| Chrome | ✅ | ✅ | ✅ |
| Brave | ✅ | ✅ | ✅ |
| Edge | ✅ | ✅ | ✅ |
| Vivaldi | ✅ | ✅ | ✅ |
| LibreWolf | ✅ | ✅ | ✅ |
| Zen Browser | ✅ | ✅ | ✅ |
| Firefox | ✅ | ✅ | ✅ |
| Opera | ❌ | ❌ | ✅ |
| Arc | ❌ | ❌ | ✅ |
许可策略:MIT 许可证 ,允许商用、修改、分发,是”最干净许可”阵营中最宽松的。
隐私承诺:官方明确声明”Page Assist does not collect any personal data“——所有数据存储在浏览器本地,唯一与服务器的通信发生在用户主动使用分享功能时(且可在设置中禁用) 。
💡 与其他交互前端的差异化定位:
- vs Open WebUI / AnythingLLM / NextChat / Chatbot UI / Astral Web UI:这些都是独立的 Web 应用/服务端,用户需要打开新标签页或访问独立 URL;Page Assist 是浏览器扩展,常驻浏览器,在用户当前浏览流中零切换调用 AI
- vs LM Studio / Jan / GPT4All:这些是桌面客户端,独立于浏览器运行;Page Assist 深度集成浏览器,可直接”与网页对话”
- vs ChatALL:ChatALL 是桌面客户端做多模型并发对比;Page Assist 是浏览器扩展做单模型网页集成
- vs LibreChat / LobeChat / Cherry Studio(通用工作台):Page Assist 不具备 Agent 编排、MCP 市场、工作流,是纯交互前端
核心能力
-浏览器原生集成(核心差异化)
- 侧边栏:任意网页
Ctrl+Shift+Y唤出,与当前页面并排显示 - Web UI:
Ctrl+Shift+L打开独立标签页,ChatGPT 风格完整聊天界面 - 右键菜单集成:通过上下文菜单快速唤起
- 跨浏览器兼容:Chrome/Brave/Edge/Vivaldi/LibreWolf/Zen/Firefox 全支持侧边栏+网页对话
-与网页/文档对话
- Chat with Webpage:对当前页面内容提问,页面内容作为上下文
- Chat with PDF:在侧边栏直接与 PDF 对话
- Chat with Documents:支持 PDF/CSV/TXT/MD/DOCX 格式文档聊天(RAG 查询)
- 视觉模型支持:支持上传图片的视觉模型(如 Gemma3:4B),图片内容识别与 OCR
-联网与扩展
- Internet Search:内置联网搜索功能
- MCP Client 支持(Beta):连接 MCP 服务器扩展工具能力
- Memory 支持(Beta):跨对话记忆能力
-多模型提供商
- Ollama:本地运行的开源模型(默认)
- Chrome AI(Gemini Nano):浏览器内置轻量模型(Beta)
- OpenAI 兼容端点:LM Studio、Llamafile、vLLM、LLaMA.cpp 等任意兼容服务(Beta)
- 模型切换:界面下拉切换已安装/配置的模型
-交互体验
- 视觉模型:支持图片输入与 OCR
- 语音交互:语音输入与实时语音输出(TTS/STT),多语言支持
- 快捷键体系:
Ctrl+Shift+Y(侧边栏)、Ctrl+Shift+L(Web UI)、Ctrl+Shift+O(新对话)、Ctrl+B(切换历史侧边栏)、Shift+Esc(聚焦输入框)、Ctrl+E(切换聊天模式) - 暗色模式:界面主题切换
- 14 种语言界面:Deutsch, English, dansk, español, français, italiano, norsk, svenska, русский, فارسی, മലയാളം, 中文(中国), 中文(台灣), 日本語
- 可配置系统提示:自定义系统提示与查询提示,可切换是否启用思考流程标注
-隐私与本地优先
- 零数据收集:官方声明不收集个人数据
- 本地存储:所有聊天历史、模型配置、文档向量存浏览器本地(Dexie/IndexedDB)
- 分享功能可禁用:唯一与服务器通信的场景是用户主动分享,且可在设置中关闭
- 本地推理优先:默认连接 Ollama 本地模型,数据不出本机
优势亮点
- MIT 最干净许可:商用、修改、分发无任何限制,与 NextChat/Astral Web UI/Chatbot UI 并列最干净许可阵营
- 浏览器扩展形态独有价值:常驻浏览器,在网页浏览流中零切换调用本地 LLM——这是其他交互前端都不具备的形态
- 300,000+ Chrome 用户 / 83,000+ Edge 用户:安装量在开源浏览器 AI 扩展中名列前茅
- 与网页对话:直接对当前页面内容提问,是”网页阅读辅助”场景的最佳工具
- 本地优先隐私:Ollama 本地模型 + 浏览器本地存储,数据不出本机
- 多提供商支持:Ollama + Chrome AI + OpenAI 兼容端点(LM Studio/vLLM/Llamafile 等)
- 文档 RAG 聊天:PDF/CSV/TXT/MD/DOCX 直接聊天,内置本地向量库(Dexie)
- 视觉模型与语音:支持图片输入/OCR、语音输入输出,多模态能力完整
- MCP 客户端 Beta:可连接 MCP 服务器扩展工具能力,向”工作台”方向演进
- 14 种语言界面:国际化用户友好
- 跨浏览器兼容:Chrome/Brave/Edge/Vivaldi/Firefox/Zen/LibreWolf 全支持侧边栏
- 快捷键体系完善:6 个核心快捷键覆盖所有操作
局限
- 自己不执行推理:Page Assist 是浏览器扩展,所有推理由 Ollama(本地)或 OpenAI 兼容端点(远程)执行
- Opera/Arc 功能受限:Opera 和 Arc 浏览器仅支持 Web UI,不支持侧边栏和与网页对话
- Firefox 版本功能:最新版 Firefox 已支持侧边栏与网页对话(早期版本不支持,旧文档可能过时)
- MCP/Memory 仍为 Beta:MCP 客户端与记忆功能在 v1.5.77 中标记为 Beta
- 无统一 API 端点:不像 LiteLLM/OmniRoute 那样提供 OpenAI 兼容
/v1端点供程序调用,是纯人机交互扩展 - 无多用户/团队协作:纯单机浏览器扩展,不适合团队场景
- 无 Agent 编排/工作流:不具备 LibreChat/LobeChat/Cherry Studio 的 Agent Builder、MCP 市场、工作流编排
- 依赖浏览器运行时:功能受浏览器扩展 API 限制(如 MV3 的限制)
- 文档 RAG 能力轻量:内置 Dexie 向量库支持基础文档聊天,但不具备 AnythingLLM/Open WebUI 那样的企业级 RAG 管道
- Chrome AI 仅 Beta:Gemini Nano 浏览器内置模型支持仍在 Beta
适用人群
- 网页重度阅读者:需要经常总结、翻译、提取网页内容的用户
- 学术研究/论文阅读:需要与 PDF 论文对话、提取核心观点的研究者
- 隐私敏感用户:希望 AI 辅助完全本地化、数据不出本机的用户
- Ollama 本地模型用户:已在使用 Ollama,需要友好的浏览器 GUI 封装
- 多模态需求用户:需要视觉模型(图片 OCR)、语音交互的用户
- 浏览器原生集成偏好者:不愿打开独立应用/标签页,希望 AI 常驻浏览器侧边栏
- 跨浏览器用户:需要在 Chrome/Brave/Edge/Firefox 等多浏览器间保持一致体验
- 轻量 RAG 需求:需要与 PDF/文档聊天但不想部署 AnythingLLM/Open WebUI 的用户
安装与部署
1. 商店一键安装(推荐)
# Chrome / Brave / Edge / Vivaldi / Arc # 访问 Chrome Web Store 搜索 "Page Assist" 或访问: # https://chromewebstore.google.com/detail/page-assist-a-web-ui-for/jfgfiigpkhlkbnfnbobbkinehhfdhndo # Firefox / LibreWolf / Zen Browser # 访问 Firefox Add-ons 搜索 "Page Assist" 或访问: # https://addons.mozilla.org/en-CA/firefox/addon/page-assist # Edge # 访问 Edge Add-ons 搜索 "Page Assist"
2. 前置依赖:安装 Ollama(如使用本地模型)
# macOS / Linux curl -fsSL https://ollama.ai/install.sh | sh # 拉取并运行一个模型 ollama pull llama3.2 ollama run llama3.2
3. 源码构建安装(开发者)
# 克隆仓库 git clone https://github.com/n4ze3m/page-assist.git cd page-assist # 安装依赖(Bun 推荐,npm 备选) bun install # 或 npm install # 构建扩展(默认 Chrome/Edge/Firefox) bun run build # 加载到浏览器 # Chrome: 打开 chrome://extensions → 启用开发者模式 → 加载已解压的扩展程序 → 选择 build 目录 # Firefox: 打开 about:addons → 扩展 → 加载临时附加组件 → 选择 build 目录的 manifest.json
4. 使用流程
# 1. 确保 Ollama 正在运行(如使用本地模型) ollama serve # 2. 在浏览器中点击 Page Assist 图标打开 Web UI(Ctrl+Shift+L) # 或在任意网页上按 Ctrl+Shift+Y 唤出侧边栏 # 3. 首次使用时在设置中选择模型(如 llama3.2:latest) # 4. 开始对话 # - 普通聊天:直接在输入框输入 # - 与网页对话:在侧边栏点击"Chat with Webpage" # - 与 PDF 聊天:在侧边栏上传 PDF 文件 # - 文档聊天:上传 pdf/csv/txt/md/docx 文件 # 5. 快捷键 # Ctrl+Shift+Y : 打开/关闭侧边栏 # Ctrl+Shift+L : 打开 Web UI # Ctrl+Shift+O : 新对话 # Ctrl+B : 切换历史侧边栏 # Shift+Esc : 聚焦输入框 # Ctrl+E : 切换聊天模式(普通/与当前页面)
5. 配置 OpenAI 兼容端点(如使用 LM Studio/vLLM)
# 在 Page Assist 设置 → AI Providers 中添加: # Provider Type: OpenAI Compatible # Base URL: http://localhost:1234/v1 (LM Studio 默认端口) # API Key: 任意非空值(LM Studio 可不验证) # Model: 选择 LM Studio 中已加载的模型 # 或使用 vLLM # Base URL: http://localhost:8000/v1
6. 部署前必检清单
- 确认仓库位于
github.com/n4ze3m/page-assist(官方) - 许可:MIT ,商用无限制
- 严格属于”交互前端”子类,浏览器扩展形态
- 官方定位:”Use your locally running AI models to assist you in your web browsing”
- 最新版本:v1.5.77(2026 年 8 月 3 日)
- 技术栈:WXT 框架 + React + TypeScript + Dexie + Zustand
- 支持提供商:Ollama(主)、Chrome AI/Gemini Nano(Beta)、OpenAI 兼容端点(LM Studio/vLLM/Llamafile 等,Beta)
- 功能:侧边栏、Web UI、与网页对话、与 PDF/文档聊天、联网搜索、视觉模型、MCP 客户端(Beta)、记忆(Beta)
- 浏览器兼容:Chrome/Brave/Edge/Vivaldi/Firefox/Zen/LibreWolf 全功能 ;Opera/Arc 仅 Web UI
- 快捷键:
Ctrl+Shift+Y(侧边栏)、Ctrl+Shift+L(Web UI) - 隐私:不收集个人数据,所有数据存浏览器本地,分享功能可禁用
- 社区规模:~7.9K-8.2K GitHub Stars ,Chrome Web Store 300,000+ 用户 ,Edge 83,000+ 用户
- 无统一 API 端点、无多用户、无 Agent 编排——纯交互前端定位
- 文档 RAG 能力轻量(基于 Dexie 本地向量库),企业级 RAG 场景建议用 AnythingLLM/Open WebUI
相关导航


ChatALL

Chatbot UI

Open WebUI
Astral Web UI

Cherry Studio
NextChat

