メモアプリ「Obsidian」に組み込んで、画像やPDFに含まれる文字を取り出せるようにする追加部品です。単体で使うより、検索を強化する Omnisearch と組み合わせて「画像の中の文字も検索できるようにする」使い方が中心です。ただし公開元が更新の終了を宣言しています。
#OCR#Obsidian
これは何?パソコンに入れて使うアプリ
できること
画像(png・jpg・webpなど)からの文字の取り出し/PDFからの文字の取り出し/他のプラグインとの連携
誰に効く?
Obsidianで画像やPDFの中身も検索したい人
用意するもの
先にObsidianが入っている必要があります。その上でプラグインとして追加します。
時間のめやす
10〜20分
使うとこうなる
- 1Obsidianに画像やPDFを入れる→対象ファイルを選べる
- 2抽出を実行する→画像や文書内の文字が取り出される
- 3キャッシュを同期する→別端末でも抽出済み文字を使える
作れるもの・できることの例
スクショ内文字の検索、PDF資料の文字抽出、Office文書の検索補助
使えるようになるまでの手順をひらく
- 下の「GitHubで見る」ボタンで公式ページを開く
- ページ内の「(リリース)」から自分のPC用(Windowsなど)のファイルをダウンロード
- ダウンロードしたファイルを開いてインストール
- アプリを起動すれば使えます(画面が英語のことも多いですが、操作はシンプルです)
⬇️ ダウンロードページでの操作(この3タップで完了)
- ページを下にスクロールして 「Assets」 という折りたたみを押して開く(ここがファイル一覧)
- Windowsの人 →「.exe」か「Setup」/Macの人 →「.dmg」と付くファイルを1回押す(ダウンロードが始まります)
- ダウンロードしたファイルを開く。Windowsが青い警告を出したら「詳細情報」→「実行」(有名な無料ソフトでもよく出る画面です)
※緑の「Code」ボタンは開発者用なので押さなくてOK。ファイルがたくさん並んでいたら、上の条件に合う1つだけ選べば大丈夫。
迷ったらこれ:いつも使っているAIチャット(ChatGPT・Claude・Geminiなど)にこのツールのGitHubリンクを貼って 「これを使いたい。私のPCでの始め方を一歩ずつ教えて」と頼むのが一番の近道です。
注意点
公開元が「これ以上時間を割けない。更新しない」と明記しています(2026年4月時点。改変や引き継ぎは歓迎とのこと)。今後Obsidian本体が大きく更新されると動かなくなる可能性があります。導入する場合はその前提で使ってください。Obsidian専用です。無料の公開ソフトです。
ひとことメモ
Obsidianの拡張。手元で動き、外部にデータを送らない。ただし今後の更新は期待できない。
obsidian-text-extractorについてよくある質問
- obsidian-text-extractorは無料で使えますか?
- 無料で使えます。自分のパソコンの中で動くタイプなので、使った量に応じた料金もかかりません。
- obsidian-text-extractorを使うのに、インストールや専門知識は必要ですか?
- パソコンにインストールして使います。コマンド入力(黒い画面)は必要ありません。
- obsidian-text-extractorはスマホでも使えますか?
- スマホには対応していません。パソコンが必要です。
- obsidian-text-extractorは仕事(商用)で使えますか?
- ライセンスは GPL-3.0 です。使うだけなら商用でも問題ありませんが、これを組み込んだものを配布する場合は、同じライセンスで公開する義務が生じることがあります。社内利用にとどめるか、配布前に確認してください。
RAG / PDF解析のほかのツール
obsidian-text-extractorが合わなかったときの、同じ用途の候補です。
obsidian-omnisearch
メモアプリObsidianの検索を、探しものが見つかる形に変える追加部品
準備がいる・黒い画面いらない
granite-docling-258m-demo
Docling文書解析デモ
準備がいる・黒い画面いらない
SmolDocling-256M-Demo
文書を読み取る
上級者向け・黒い画面いらない
DocScope-R1
書類画像を読み取る
準備がいる・黒い画面いらない
Dots-OCR
文書画像OCR
準備がいる・黒い画面いらない
LightOnOCR-2-1B-Demo
書類の画像から文字を読み取るOCRデモ
準備がいる・黒い画面いらない
