内置浏览器
Scholardo 内置了一个浏览器。它存在的理由不是「省得切窗口」,而是让网页变成可以被收进文库、被 agent 看到的一等公民。
什么时候会用到它
内置浏览器在这些情况下自动打开:
- 点击预览窗(PDF / 网页 / EPUB / 笔记)里的外部链接
- 点击 agent 回复里的网页链接
- 打开
.webloc书签文件 - 在 Feeds 里选择「Open URL in browser」
它是中间栏的一个标签页,和别的预览窗并列。
工具栏
| 按钮 | 作用 |
|---|---|
| Save page to Sources / Docs | 抽取正文,存成 Markdown 进 Docs |
| Save bookmark to Sources / Docs | 只存链接,存成 .webloc |
| Share this page with AI | 把当前页面内容共享给 agent |
| Open in default browser | 转交系统浏览器 |
前进 / 后退 / 刷新 / 停止 是常规的。
保存网页
Save page 不是保存一份网页快照,而是抽取正文——去掉导航栏、广告、侧边推荐,只留文章本体,转成 Markdown 存进 Docs。
这样存下来的东西可以被索引、被语义检索、被 agent 读取,和你的 PDF 文献处于同一个池子里。
提取失败时会降级
遇到结构特殊的页面,正文提取可能失败。这时 Scholardo 会降级为抓取页面纯文本,并明确标记为降级结果。降级结果不会被静默存进 Docs——Scholardo 会告诉你这次提取质量不佳,由你决定要不要存。
与 AI 共享当前页面
Share this page with AI 打开后,agent 能通过 MCP 读到你正在看的页面内容(工具 web_page_context,资源 scholardo://active/web-page-context)。
这让「这页讲的方法和我库里那篇有什么区别」这类问题成为可能——agent 同时看得到你的屏幕内容和你的文库。
再点一次关闭共享。共享是显式的、你控制的,不是默认一直开着。
网页标注
内置浏览器打开的页面可以像 PDF 一样划线加旁注,标注汇总进 Highlights。锚点基于文本选择器,页面改版后可能失效,见 标注。
交互模式
本地 HTML 文件预览默认关闭脚本执行——页面是静态的。需要页面里的交互组件(可交互图表、演示)时,用工具栏的 Toggle interactive mode 打开。
默认关闭是安全考虑:你从网上下载的 HTML 文件可能带任意脚本。
商业文献库的限制
内置浏览器过不了强反爬
Elsevier、Wiley 等一部分商业数据库部署了 DataDome / Akamai 之类的机器人检测。内置浏览器(WKWebView)在这些站点上会被拦住——这是结构性限制,不是可以修的 bug。
可行的工作流是:
- 在 Safari / Chrome 里登录你的机构账号
- 找到目标文献,拿到 PDF 直链
- 回到 Scholardo,用 Docs 的「From Web…」导入
或者干脆在系统浏览器里下载 PDF,再拖进 Docs。
预印本服务器(arXiv、bioRxiv)、开放获取期刊、大多数实验室主页和博客都没有这个问题。
弹窗与外部协议
页面试图打开 mailto: 之类的外部协议时,Scholardo 会先问你,不会直接调起外部应用。
相关
- Docs 文献与文档——保存下来的网页在哪
- 预览窗通则——浏览器标签页与其他预览窗的关系

