Page Assist翻译站点

1天前更新 13 0 0

MIT 许可的开源浏览器扩展,为本地 AI 模型提供侧边栏与 Web UI,可在任意网页上调起本地 LLM。

语言:
英文
收录时间:
2026-08-23
Page AssistPage Assist

Page Assist 是 n4ze3m 主导的开源浏览器扩展,MIT 许可。它把 Ollama 等本地 AI 模型(以及 Chrome AI / 任意 OpenAI 兼容端点)的能力,无缝嵌入浏览器——通过侧边栏(任意网页 Ctrl+Shift+Y 唤出)与独立 Web UI(Ctrl+Shift+L 打开)两种形态 ,让用户在任何网页上都能直接调起本地 LLM 进行对话、网页内容问答、PDF/文档聊天、联网搜索。官方明确定位:”Use your locally running AI models to assist you in your web browsing” 。它是”交互前端”分类中唯一的”浏览器扩展形态”代表——与 Open WebUI(自托管 Web UI)、AnythingLLM(全栈私有 AI 应用)、NextChat(轻量跨平台客户端)、Chatbot UI(全栈自托管)、Astral Web UI(极简本地优先+分支对话树)、ChatALL(多模型并发对比桌面客户端)、LibreChat/LobeChat/Cherry Studio(已移至通用工作台)形成清晰的差异化:Page Assist 的核心价值在”把本地 LLM 常驻浏览器,在网页浏览流中零切换调用 AI“。

 

产品概述

Page Assist 由 Muhammed Nazeem(n4ze3m)开发,是一款开源浏览器扩展,官方仓库描述:”Page Assist is an open-source browser extension that provides a sidebar and web UI for your local AI model. It allows you to interact with your model from any webpage” 。

 

核心定位哲学

Page Assist 要解决的核心痛点是——Ollama 等本地 LLM 默认只有命令行界面,用户在浏览网页时需要 AI 辅助(总结、翻译、问答、提取),就必须在终端和浏览器之间反复切换 。Page Assist 通过浏览器扩展形态,把本地 LLM 的能力”常驻”在浏览器中:

  • 侧边栏:在任意网页上按 Ctrl+Shift+Y 唤出,与当前页面并排显示
  • Web UI:按 Ctrl+Shift+L 打开独立标签页,ChatGPT 风格的完整聊天界面

 

它做什么 / 不做什么(关键归类):

  • :作为浏览器扩展运行 → 接收用户输入 → 通过 Ollama 或 OpenAI 兼容端点调用本地/远程模型 → 在侧边栏/Web UI 中展示响应 → 在此之上提供与网页对话、与 PDF/文档聊天、联网搜索、视觉模型支持、MCP 客户端(beta)、记忆(beta)
  • 不做:不持有模型算力、不做统一 API 端点(非 API 中间件)、不做多用户协作、不具备 Agent 编排/MCP 市场/工作流(与 LibreChat/LobeChat 的本质区别)
  • 本质是浏览器扩展形态的交互前端:它是”交互前端”分类中唯一的浏览器扩展——填补了”桌面客户端(LM Studio/Jan/GPT4All/ChatALL)”和”Web UI(Open WebUI/NextChat 等)”之外的第三类形态:浏览器原生集成

 

技术架构​ :

  • 扩展框架:WXT(Web Extension Tools),实现跨浏览器兼容
  • 前端:React + TypeScript
  • 状态管理:Zustand
  • 本地存储:Dexie(IndexedDB 封装),用于聊天历史、模型配置、知识库向量数据
  • 文档处理:支持 PDF/CSV/TXT/MD/DOCX 解析
  • AI 集成层:统一接口适配 Ollama、Chrome AI(Gemini Nano)、OpenAI 兼容端点
  • 通信机制:基于 WebSocket 与 Ollama 实时通信,支持流式响应
  • 构建产物:Chrome/Edge/Brave/Vivaldi 的 MV3 扩展,Firefox 的 MV2 扩展

 

支持的 AI 提供商​ :

  • Ollama:本地运行的开源模型(默认主提供商)
  • Chrome AI(Gemini Nano):浏览器内置的轻量模型(Beta)
  • OpenAI 兼容 API:LM Studio、Llamafile、vLLM、LLaMA.cpp 等任意兼容端点(Beta)

 

浏览器兼容矩阵​ :

浏览器 侧边栏 与网页对话 Web UI
Chrome
Brave
Edge
Vivaldi
LibreWolf
Zen Browser
Firefox
Opera
Arc

 

许可策略:MIT 许可证 ,允许商用、修改、分发,是”最干净许可”阵营中最宽松的。

 

隐私承诺:官方明确声明”Page Assist does not collect any personal data“——所有数据存储在浏览器本地,唯一与服务器的通信发生在用户主动使用分享功能时(且可在设置中禁用) 。

💡 与其他交互前端的差异化定位

  • vs Open WebUI / AnythingLLM / NextChat / Chatbot UI / Astral Web UI:这些都是独立的 Web 应用/服务端,用户需要打开新标签页或访问独立 URL;Page Assist 是浏览器扩展,常驻浏览器,在用户当前浏览流中零切换调用 AI
  • vs LM Studio / Jan / GPT4All:这些是桌面客户端,独立于浏览器运行;Page Assist 深度集成浏览器,可直接”与网页对话”
  • vs ChatALL:ChatALL 是桌面客户端做多模型并发对比;Page Assist 是浏览器扩展做单模型网页集成
  • vs LibreChat / LobeChat / Cherry Studio(通用工作台):Page Assist 不具备 Agent 编排、MCP 市场、工作流,是纯交互前端

 

核心能力

 

-浏览器原生集成(核心差异化)

  • 侧边栏:任意网页 Ctrl+Shift+Y 唤出,与当前页面并排显示
  • Web UICtrl+Shift+L 打开独立标签页,ChatGPT 风格完整聊天界面
  • 右键菜单集成:通过上下文菜单快速唤起
  • 跨浏览器兼容:Chrome/Brave/Edge/Vivaldi/LibreWolf/Zen/Firefox 全支持侧边栏+网页对话

 

-与网页/文档对话

  • Chat with Webpage:对当前页面内容提问,页面内容作为上下文
  • Chat with PDF:在侧边栏直接与 PDF 对话
  • Chat with Documents:支持 PDF/CSV/TXT/MD/DOCX 格式文档聊天(RAG 查询)
  • 视觉模型支持:支持上传图片的视觉模型(如 Gemma3:4B),图片内容识别与 OCR

 

-联网与扩展

  • Internet Search:内置联网搜索功能
  • MCP Client 支持(Beta):连接 MCP 服务器扩展工具能力
  • Memory 支持(Beta):跨对话记忆能力

 

-多模型提供商

  • Ollama:本地运行的开源模型(默认)
  • Chrome AI(Gemini Nano):浏览器内置轻量模型(Beta)
  • OpenAI 兼容端点:LM Studio、Llamafile、vLLM、LLaMA.cpp 等任意兼容服务(Beta)
  • 模型切换:界面下拉切换已安装/配置的模型

 

-交互体验

  • 视觉模型:支持图片输入与 OCR
  • 语音交互:语音输入与实时语音输出(TTS/STT),多语言支持
  • 快捷键体系Ctrl+Shift+Y(侧边栏)、Ctrl+Shift+L(Web UI)、Ctrl+Shift+O(新对话)、Ctrl+B(切换历史侧边栏)、Shift+Esc(聚焦输入框)、Ctrl+E(切换聊天模式)
  • 暗色模式:界面主题切换
  • 14 种语言界面:Deutsch, English, dansk, español, français, italiano, norsk, svenska, русский, فارسی, മലയാളം, 中文(中国), 中文(台灣), 日本語
  • 可配置系统提示:自定义系统提示与查询提示,可切换是否启用思考流程标注

 

-隐私与本地优先

  • 零数据收集:官方声明不收集个人数据
  • 本地存储:所有聊天历史、模型配置、文档向量存浏览器本地(Dexie/IndexedDB)
  • 分享功能可禁用:唯一与服务器通信的场景是用户主动分享,且可在设置中关闭
  • 本地推理优先:默认连接 Ollama 本地模型,数据不出本机

 

优势亮点

  • MIT 最干净许可:商用、修改、分发无任何限制,与 NextChat/Astral Web UI/Chatbot UI 并列最干净许可阵营
  • 浏览器扩展形态独有价值:常驻浏览器,在网页浏览流中零切换调用本地 LLM——这是其他交互前端都不具备的形态
  • 300,000+ Chrome 用户 / 83,000+ Edge 用户:安装量在开源浏览器 AI 扩展中名列前茅
  • 与网页对话:直接对当前页面内容提问,是”网页阅读辅助”场景的最佳工具
  • 本地优先隐私:Ollama 本地模型 + 浏览器本地存储,数据不出本机
  • 多提供商支持:Ollama + Chrome AI + OpenAI 兼容端点(LM Studio/vLLM/Llamafile 等)
  • 文档 RAG 聊天:PDF/CSV/TXT/MD/DOCX 直接聊天,内置本地向量库(Dexie)
  • 视觉模型与语音:支持图片输入/OCR、语音输入输出,多模态能力完整
  • MCP 客户端 Beta:可连接 MCP 服务器扩展工具能力,向”工作台”方向演进
  • 14 种语言界面:国际化用户友好
  • 跨浏览器兼容:Chrome/Brave/Edge/Vivaldi/Firefox/Zen/LibreWolf 全支持侧边栏
  • 快捷键体系完善:6 个核心快捷键覆盖所有操作

 

局限

  • 自己不执行推理:Page Assist 是浏览器扩展,所有推理由 Ollama(本地)或 OpenAI 兼容端点(远程)执行
  • Opera/Arc 功能受限:Opera 和 Arc 浏览器仅支持 Web UI,不支持侧边栏和与网页对话
  • Firefox 版本功能:最新版 Firefox 已支持侧边栏与网页对话(早期版本不支持,旧文档可能过时)
  • MCP/Memory 仍为 Beta:MCP 客户端与记忆功能在 v1.5.77 中标记为 Beta
  • 无统一 API 端点:不像 LiteLLM/OmniRoute 那样提供 OpenAI 兼容 /v1 端点供程序调用,是纯人机交互扩展
  • 无多用户/团队协作:纯单机浏览器扩展,不适合团队场景
  • 无 Agent 编排/工作流:不具备 LibreChat/LobeChat/Cherry Studio 的 Agent Builder、MCP 市场、工作流编排
  • 依赖浏览器运行时:功能受浏览器扩展 API 限制(如 MV3 的限制)
  • 文档 RAG 能力轻量:内置 Dexie 向量库支持基础文档聊天,但不具备 AnythingLLM/Open WebUI 那样的企业级 RAG 管道
  • Chrome AI 仅 Beta:Gemini Nano 浏览器内置模型支持仍在 Beta

 

适用人群

  • 网页重度阅读者:需要经常总结、翻译、提取网页内容的用户
  • 学术研究/论文阅读:需要与 PDF 论文对话、提取核心观点的研究者
  • 隐私敏感用户:希望 AI 辅助完全本地化、数据不出本机的用户
  • Ollama 本地模型用户:已在使用 Ollama,需要友好的浏览器 GUI 封装
  • 多模态需求用户:需要视觉模型(图片 OCR)、语音交互的用户
  • 浏览器原生集成偏好者:不愿打开独立应用/标签页,希望 AI 常驻浏览器侧边栏
  • 跨浏览器用户:需要在 Chrome/Brave/Edge/Firefox 等多浏览器间保持一致体验
  • 轻量 RAG 需求:需要与 PDF/文档聊天但不想部署 AnythingLLM/Open WebUI 的用户

 

安装与部署

 

1. 商店一键安装(推荐)

# Chrome / Brave / Edge / Vivaldi / Arc
# 访问 Chrome Web Store 搜索 "Page Assist" 或访问:
# https://chromewebstore.google.com/detail/page-assist-a-web-ui-for/jfgfiigpkhlkbnfnbobbkinehhfdhndo

# Firefox / LibreWolf / Zen Browser
# 访问 Firefox Add-ons 搜索 "Page Assist" 或访问:
# https://addons.mozilla.org/en-CA/firefox/addon/page-assist

# Edge
# 访问 Edge Add-ons 搜索 "Page Assist"

 

2. 前置依赖:安装 Ollama(如使用本地模型)

# macOS / Linux
curl -fsSL https://ollama.ai/install.sh | sh

# 拉取并运行一个模型
ollama pull llama3.2
ollama run llama3.2

 

3. 源码构建安装(开发者)

# 克隆仓库
git clone https://github.com/n4ze3m/page-assist.git
cd page-assist

# 安装依赖(Bun 推荐,npm 备选)
bun install
# 或
npm install

# 构建扩展(默认 Chrome/Edge/Firefox)
bun run build

# 加载到浏览器
# Chrome: 打开 chrome://extensions → 启用开发者模式 → 加载已解压的扩展程序 → 选择 build 目录
# Firefox: 打开 about:addons → 扩展 → 加载临时附加组件 → 选择 build 目录的 manifest.json

 

4. 使用流程

# 1. 确保 Ollama 正在运行(如使用本地模型)
ollama serve

# 2. 在浏览器中点击 Page Assist 图标打开 Web UI(Ctrl+Shift+L)
#    或在任意网页上按 Ctrl+Shift+Y 唤出侧边栏

# 3. 首次使用时在设置中选择模型(如 llama3.2:latest)

# 4. 开始对话
#    - 普通聊天:直接在输入框输入
#    - 与网页对话:在侧边栏点击"Chat with Webpage"
#    - 与 PDF 聊天:在侧边栏上传 PDF 文件
#    - 文档聊天:上传 pdf/csv/txt/md/docx 文件

# 5. 快捷键
#    Ctrl+Shift+Y : 打开/关闭侧边栏
#    Ctrl+Shift+L : 打开 Web UI
#    Ctrl+Shift+O : 新对话
#    Ctrl+B      : 切换历史侧边栏
#    Shift+Esc   : 聚焦输入框
#    Ctrl+E      : 切换聊天模式(普通/与当前页面)

 

5. 配置 OpenAI 兼容端点(如使用 LM Studio/vLLM)

# 在 Page Assist 设置 → AI Providers 中添加:
# Provider Type: OpenAI Compatible
# Base URL: http://localhost:1234/v1  (LM Studio 默认端口)
# API Key: 任意非空值(LM Studio 可不验证)
# Model: 选择 LM Studio 中已加载的模型

# 或使用 vLLM
# Base URL: http://localhost:8000/v1

 

6. 部署前必检清单

  • 确认仓库位于 github.com/n4ze3m/page-assist(官方)
  • 许可:MIT ,商用无限制
  • 严格属于”交互前端”子类,浏览器扩展形态
  • 官方定位:”Use your locally running AI models to assist you in your web browsing”
  • 最新版本:v1.5.77(2026 年 8 月 3 日)
  • 技术栈:WXT 框架 + React + TypeScript + Dexie + Zustand
  • 支持提供商:Ollama(主)、Chrome AI/Gemini Nano(Beta)、OpenAI 兼容端点(LM Studio/vLLM/Llamafile 等,Beta)
  • 功能:侧边栏、Web UI、与网页对话、与 PDF/文档聊天、联网搜索、视觉模型、MCP 客户端(Beta)、记忆(Beta)
  • 浏览器兼容:Chrome/Brave/Edge/Vivaldi/Firefox/Zen/LibreWolf 全功能 ;Opera/Arc 仅 Web UI
  • 快捷键:Ctrl+Shift+Y(侧边栏)、Ctrl+Shift+L(Web UI)
  • 隐私:不收集个人数据,所有数据存浏览器本地,分享功能可禁用
  • 社区规模:~7.9K-8.2K GitHub Stars ,Chrome Web Store 300,000+ 用户 ,Edge 83,000+ 用户
  • 无统一 API 端点、无多用户、无 Agent 编排——纯交互前端定位
  • 文档 RAG 能力轻量(基于 Dexie 本地向量库),企业级 RAG 场景建议用 AnythingLLM/Open WebUI

相关导航