フランスのAI企業LightOn公式のOCRデモ。書類やPDFの画像から文字を読み取ってテキストにでき、手作業の書き写しが減る。
#OCR#書類のデータ化
※この説明はAIが公式READMEから自動生成したものです。内容は必ず公式ページでもご確認ください。
ミロンドが自分で確かめたこと
- 2026年8月29日お試しページを実際に開いて、動いていることを確認しました。
ミロンドは掲載しているすべての行き先を定期的に開いて、今も使えるかを確かめています。この道具の利用ルールは、まだ原文までは読めていません(公開元の表示にもとづく判定です)。
「RAG / PDF解析」63本の中での位置
- 黒い画面(ターミナル)を使わずに済むこの分野で20本
- APIキーの用意がいらないこの分野で32本
- スマホだけで使えるこの分野で14本
- 作ったものを仕事に使ってよいと確認できているこの分野で52本
- 入れた内容は公開元に送られますそうでないものが20本 →
上の条件をすべて満たすものは、63本中4本です。
この数字は、ミロンドが掲載している道具を1本ずつ同じ基準で調べた結果から数えています。
これは何?ブラウザで使えるサービス
できること
書類のスキャン画像やPDFのページをアップすると、レイアウトをくずさず文字が読み取られてテキストで出てくる。表を含む資料の文字データ化や、紙の資料を検索できる形に変える下ごしらえに使える。
誰に効く?
紙の書類やスキャンPDFを文字データにしたい人
用意するもの
読み取りたい書類の画像やPDFとブラウザだけ
時間のめやす
3分
使えるようになるまでの手順をひらく
- 下の「GitHubで見る」ボタンで公式ページを開く
- ページ内の公式サイトリンク(Website / Cloud など)へ進む
- アカウント登録(メールアドレスなど)をする
- そのままブラウザ上で使えます
迷ったらこれ:いつも使っているAIチャット(ChatGPT・Claude・Geminiなど)にこのツールのGitHubリンクを貼って 「これを使いたい。私のPCでの始め方を一歩ずつ教えて」と頼むのが一番の近道です。
注意点
欧文中心に学習されたモデルのため日本語の読み取り精度は未確認。重要な書類は必ず目で確認を。 ここに書いたは、このお試しページ自体のものです。作ったものを仕事に使えるかどうかは、中で使われているAIモデルの条件で決まります。使われているモデルは商用利用も認められています(apache-2.0 / apache-2.0 / apache-2.0)。ただし著作権表示など条件が付く場合があるので、配布物に含めるなら本文を確認してください。
ひとことメモ
公開元のサーバー上で動くお試しページです。アップロードした画像や文章はその環境に送られるので、社外に出せないものは入れないでください。混み合っていると順番待ちになることがあります。
このツールが活躍する場所
LightOnOCR-2-1B-Demoについてよくある質問
- LightOnOCR-2-1B-Demoを使うのに、インストールや専門知識は必要ですか?
- ブラウザで開くだけで使えます。インストールは不要です。
- LightOnOCR-2-1B-Demoはスマホでも使えますか?
- スマホでも使えます。
- LightOnOCR-2-1B-Demoは仕事(商用)で使えますか?
- 公開元がライセンスをはっきり書いていないため、商用で使ってよいかは判断できません。仕事で使う場合は、公式ページで確認するか、作者に問い合わせてください。
似ている道具との違い
同じ用途の道具と、使う前に効いてくる条件を並べました。
| 道具 | 黒い画面 | APIキー | 外部送信 | スマホ | 仕事に使える | 最終更新 |
|---|---|---|---|---|---|---|
| LightOnOCR-2-1B-Demo(このページ) | いらない | いらない | あり | 使える | 可 | 2026年2月 |
| obsidian-text-extractor | いらない | いらない | なし | むずかしい | 可 | 2026年4月 |
| granite-docling-258m-demo | いらない | いらない | なし | 使える | 可 | 2026年5月 |
| SmolDocling-256M-Demo | いらない | いらない | あり | 使える | 未確認 | 2025年6月 |
「外部送信あり」は、入力した内容がどこかのサーバーに送られることを指します。 社外に出せない資料を扱うときは「なし」を選んでください。
RAG / PDF解析のほかのツール
LightOnOCR-2-1B-Demoが合わなかったときの、同じ用途の候補です。
obsidian-text-extractor
【更新終了】Obsidianで画像やPDFの文字を取り出す追加部品
準備がいる・黒い画面(ターミナル)いらない
granite-docling-258m-demo
Docling文書解析デモ
準備がいる・黒い画面(ターミナル)いらない
SmolDocling-256M-Demo
文書を読み取る
上級者向け・黒い画面(ターミナル)いらない
DocScope-R1
書類画像を読み取る
準備がいる・黒い画面(ターミナル)いらない
Dots-OCR
文書画像OCR
準備がいる・黒い画面(ターミナル)いらない
Paperless-ngx
紙の書類をぜんぶ電子化して検索可能に
はじめやすい・黒い画面(ターミナル)が要る