AI 提取(Beta)上线
FlowFerry 一直用经典方式提取文章:基于规则的解析器(我们用的是 Defuddle,也就是 Obsidian 剪藏器背后的引擎)分析页面结构,找出「看起来像正文」的部分。它很快,完全在你的设备上运行,对于结构规整的文章页效果很好。
但如今的网页越来越不像「文章」了。小红书笔记的图片放在离正文很远的轮播组件里;X 上的一条讨论串是一堆层层嵌套的 div;再加上懒加载图片、无限滚动的评论区、那些本质上是 App 的页面:靠结构规则只能猜,而猜是会猜错的。
AI 提取就是我们的回答,以可选 Beta 功能的形式上线。开启后,FlowFerry 会让大语言模型像人一样阅读页面,留下真正重要的内容。
它是怎么工作的
- App 在一个隐藏的浏览器里加载页面,滚动它,等懒加载的图片显形,让模型看到的和你看到的一致。
- 如果我们认识这个网站,会先把页面裁剪到它的正文容器。进去的噪音更少,出来的文章更干净。
- 裁剪后的页面发送到我们的 API,由它通过 Vercel AI Gateway 调用模型。提取出的正文边生成边流式返回,你会看到文章在预览里逐渐浮现,而不是对着转圈的加载图标发呆。
- 一旦出现任何问题(没有网络、额度用完、模型状态不佳),FlowFerry 会静默回退到本地提取器。保存这件事永远不会失败。
最终得到的是一篇普通的 FlowFerry 文章:存在你的设备上,可以离线阅读,可以导出,也可以像其他文章一样发送到 Notion 或 Obsidian。
隐私呢?
这是我们最在意的部分,因为「本地优先」正是 FlowFerry 存在的意义。
AI 处理按零数据保留(Zero Data Retention)运行。页面内容只在内存中处理,不会存储在我们的服务器上;我们、Vercel 和模型提供方都不会记录它,也不会用它训练模型。我们唯一记录的,是你的账户在某个时间用掉了一次提取额度,以便执行下面的用量限制。我们不知道你保存了什么,而且我们喜欢这样。细节见隐私政策。
限制与价格
每一次提取对我们来说都是真金白银的推理成本,所以这个 Beta 带着诚实的额度上线:
- 免费账户有 10 次一次性试用额度。
- Pro 账户每天可用 20 次。
FlowFerry 的其他定价一切照旧。
怎么体验
更新到最新版本,打开首页标签,点击输入框旁边的加号按钮,打开「AI 提取(Beta)」开关。需要登录账号。然后去保存一个「难缠」的页面吧,比如图片很多的社交帖子,或者你常用剪藏工具啃不动的网页,看着它变成一篇可读的文章。
这是 Beta 版本:输出由机器生成,偶尔会不完美;简单的页面走本地提取仍然更快。遇到问题欢迎写信到 hi@flowferry.app,祝阅读愉快。
FlowFerry