browsa浏览器侧边栏 AI

读取页面

「读」是 browsa 的根基:点一下 📎,你正在看的页面就进入了对话。 这一页讲清楚它读什么、怎么读,以及 📎 之外的几种入口。

📎 一键附加当前页面

点击输入框旁的 📎,当前标签页的内容被附加进对话。默认使用 Auto 模式,它按级联自动选择读法:先尝试提取干净的正文(Readability),不够详细再退到保留结构的 DOM 树,最后退到全文。你不需要选,附加后输入框上方会写明这次用了哪种读法。

附加一次,一直有效:之后每一轮提问都会带着这份页面内容,直到你清空历史或换页面重新附加。

📷 截图模式

把当前标签页的可见画面作为图片发给多模态模型——适合「这张图里哪条曲线涨了」这类文字读不出来的问题。按 Ctrl+/ 在 Auto 和截图之间切换,也可以在 📎 的模式菜单里选。

划选文字:就地解释 / 翻译

在页面上划选文字,松开鼠标会出现 浮动工具栏:提问 · 解释 · → 中文 · 总结。

  • 解释→ 中文就地作答:答案以流式卡片展开在选区旁——单词给音标、词性和例句,不用打开侧栏,读完即走;
  • 提问总结把选区自动送进侧边栏——它们是对话的开始;
  • 右键 → browsa › 提问 / 解释 / 翻译 / 总结,四项均走侧栏。
划词后点「解释」,答案以流式浮层就地展开
划词点「解释」:答案就地在选区旁流式展开,页脚带复制 / 重试 / 在侧栏追问。

以上都不用先点 📎。

图片

把图片拖入输入框,或直接 Ctrl+V 粘贴截图(需要多模态模型,如 GPT-4o、Claude 或其他视觉模型)。

PDF:本机解析,图表也发给模型

附加一个 PDF——或者打开一个其实是 PDF 的页面——无需选模式,自动处理:

  • 解析完全在你的浏览器里完成(WASM + pdf.js),文件字节不出设备
  • 表格、标题、多栏版式会被重建,模型读到的是结构而不是乱序文字;
  • 插图区域自动裁剪出来、配着图注一起作为图片发给视觉模型——模型能真正「看见」Figure 1。
browsa 在 arXiv 论文页旁讲解 Figure 1
论文场景:插图裁剪后与图注配对发给视觉模型,回答直接指着图讲。

GitHub 文件页

github.com 上打开某个文件时,browsa 直接抓取 raw.githubusercontent.com 的原始源码——Markdown 和代码保持原有结构,而不是页面上渲染后的样子。

站点深度提取

对下面这些站点,browsa 会观察浏览器自己发出的请求,直接读取页面已加载的结构化数据——字幕、评论、笔记正文——而不是靠猜。不需要重新登录,也没有任何数据流向第三方。

YouTube字幕/章节 Bilibili字幕/ASR/统计 小红书笔记/评论 飞书文档/表格 掘金文章源码 知乎文章/回答 X / Twitter推文/回复 Reddit帖子/评论 雪球行情/帖子 小宇宙播客 得到文章 极客时间文章
browsa 从小红书笔记中提取决策要点
小红书笔记:直接读页面数据,评论、正文一条不落。

不在此列的网页同样可用——走 Auto 级联,只是没这么「深」。

页面太长?超过阈值(默认 100,000 字符)的页面与字幕会自动分块总结、后台合并,后续轮次只发压缩版——附加立即返回,不用等。阈值与开关见设置与隐私