【記事レポート】無料でPDF・電子書籍・Word文書などからローカルAIを使って検索&要約ができる「DocuBrowser」、個人情報の認識も可能 - GIGAZINE

🔗 元記事:https://gigazine.net/news/20260905-docubrowser/
🔖 はてブ:https://b.hatena.ne.jp/ao41/20260906#bookmark-4792608781654847138
📅 ブックマーク日時:2026-09-06 05:18 (UTC) / 2026-09-06 14:18 (JST) 📰 掲載:2026-09-05 18:00
👥 はてブ数:127 users 🏷 タグ:あとで読む
🐙 GitHub:linuxrebel/DocuBrowser

DocuBrowserとは

PCに保存したPDF・Word文書・電子書籍などが増えすぎて、ファイル名や保存場所だけでは必要な情報を探せなくなった人のためのローカルAI搭載ドキュメント検索エンジンです。オープンソースで公開されており、無料で利用できます。手元の「文書の山」を検索可能な情報ストアに変えてくれるツール。

ローカルAIOllamaドキュメント検索オープンソース無料

主な機能

🔍 3つの検索モード
Keyword(キーワード)/Semantic(意味)/Both。Semantic検索は本文に同じ単語がなくても意味の近い文書を探せる。
🔗 Deep Links
検索結果カードの「Deep Links」から、PDF・電子書籍の中の該当ページ・行・セクションと文章の一部へ直接ジャンプできる。
🤖 AI要約
文書タイトルをクリックすると、Ollamaのdolphin3モデルが概要を自動生成。
🔒 個人情報の検出
再スキャン時にクレジットカード番号・銀行口座番号・生年月日・パスポート番号等を検出し、検索対象から除外するか選択できる。
⚠️ 注意: 個人情報検出はデータベースに保存された「文書の概要部分」のみがチェック対象のため、文書内のすべての個人情報を検出できる仕組みではありません。

対応ファイル形式

PDFDOCXXLSXPPTXTXTMarkdownHTMLEPUBMOBIAZW3ODTODSODPCSVEMLRTFVisiodraw.ioPlantUMLMermaid

構築方法(Windows 11 + NVIDIA GPU環境の例)

⚠️ 日本語への注意: DocuBrowserは現時点で日本語に正式対応しておらず、検索・タグ生成・要約などが英語向けに調整されているため、日本語の文書では期待通りの結果にならない場合があります。

コメント・所感

GIGAZINE実際に試したレビュー記事で、インストール手順のスクリーンショットも豊富。ローカル完結でプライバシーに配慮したAI文書管理を試してみたい人にうってつけ。ただし日本語ドキュメントの扱いには課題がある点と、個人情報検出が概要部分のみという限界は押さえておきたい。類似ツール(Hister・Reor・ripgrep-all等)への言及もあるので、ローカル検索ツール比較の入口としても良記事です。

📄 本レポートはGIGAZINE記事本文の全文取得に基づいて作成しています。