AI抽出(ベータ)を公開しました
FlowFerryはこれまで、古典的な方法で記事を抽出してきました。ルールベースのパーサー(Obsidianのクリッパーにも使われているDefuddle)がページ構造を解析し、「本文らしい部分」を取り出す方式です。高速で、すべてデバイス上で動き、記事らしい構造のページにはとても有効です。
しかし今のウェブは、どんどん「記事らしくない」形になっています。小紅書(RED)のノートは写真が本文から離れたカルーセルの中にあり、Xのスレッドは入れ子のdivの山。遅延読み込みの画像や無限に続くコメント欄、実質アプリのようなページが増えるほど、構造ルールは推測に頼るしかなく、推測は外れることがあります。
AI抽出は、それに対する私たちの答えです。オプトインのベータ機能として、オンにするとFlowFerryは言語モデルにページを「人のように」読ませ、大事な部分だけを残します。
仕組み
- アプリは非表示のブラウザでページを読み込み、スクロールして遅延画像が現れるのを待ちます。モデルはあなたが見るのと同じ画面を見ます。
- 既知のサイトなら、まず本文コンテナだけに切り詰めます。入るノイズが少ないほど、出てくる記事はきれいになります。
- 切り詰めたページは私たちのAPIに送られ、Vercel AI Gateway経由でモデルを呼び出します。抽出された本文は生成されるそばからストリーミングで返り、プレビューに少しずつ現れます。
- 何か問題があれば(オフライン、上限到達、モデルの不調)、FlowFerryは静かにローカル抽出へフォールバックします。保存が失敗することはありません。
出来上がるのは普通のFlowFerryの記事です。デバイスに保存され、オフラインで読め、エクスポートもNotionやObsidianへの送信もこれまで通りです。
プライバシーは?
ここが一番大事な部分です。「ローカルファースト」こそFlowFerryの存在理由だからです。
AI処理はゼロデータ保持(Zero Data Retention)で実行されます。ページ内容はメモリ上でのみ処理され、私たちのサーバーには保存されません。私たちも、Vercelも、モデル提供者も、内容を記録せず、学習にも使いません。記録されるのは「あなたのアカウントがいつ1回抽出を使ったか」だけで、下記の利用上限の管理のためです。あなたが何を保存したか、私たちは知りません。そしてそれでいいと思っています。詳細はプライバシーポリシーをご覧ください。
上限と料金
抽出のたびに実際の推論コストがかかるため、ベータには正直な上限があります。
- 無料アカウント:お試し10回(1回限り)
- Proアカウント:毎日20回
FlowFerryのその他の料金は変わりません。
試すには
最新版に更新し、ホームタブで入力欄の横のプラスボタンをタップして「AI抽出(Beta)」をオンにしてください。サインインが必要です。あとは「手ごわい」ページ、写真だらけのSNS投稿や、いつものクリッパーが崩してしまうページを保存してみてください。読みやすい記事になって現れるはずです。
ベータ版のため、出力は機械生成で、ときどき不完全なことがあります。シンプルなページはローカル抽出のほうが速いままです。不具合があれば hi@flowferry.app までお知らせください。よい読書を。
FlowFerry