SmolDoclingでPDFや画像文書の構造を解析し、テキスト化を試せるデモ。
#PDF解析#OCR
※この説明はAIが公式READMEから自動生成したものです。内容は必ず公式ページでもご確認ください。
これは何?ブラウザで使えるサービス
できること
文書画像やPDFから文字、表、レイアウト情報を抽出し、後から編集や検索に使いやすい形へ変換できる。
誰に効く?
PDF内容を取り出したい人
用意するもの
解析したい文書ファイル
時間のめやす
3分
使えるようになるまでの手順をひらく
- 下の「GitHubで見る」ボタンで公式ページを開く
- ページ内の公式サイトリンク(Website / Cloud など)へ進む
- アカウント登録(メールアドレスなど)をする
- そのままブラウザ上で使えます
迷ったらこれ:いつも使っているAIチャット(ChatGPT・Claude・Geminiなど)にこのツールのGitHubリンクを貼って 「これを使いたい。私のPCでの始め方を一歩ずつ教えて」と頼むのが一番の近道です。
注意点
複雑な表や低解像度画像は読み取り精度が落ちる。 ここに書いたは、このお試しページ自体のものです。作ったものを仕事に使えるかどうかは、中で使われているAIモデルの条件で決まります。使われているモデルの条件を確認できなかったので、仕事で使う前に公式で確かめてください。
ひとことメモ
公開元のサーバー上で動くお試しページです。アップロードした画像や文章はその環境に送られるので、社外に出せないものは入れないでください。混み合っていると順番待ちになることがあります。
SmolDocling-256M-Demoについてよくある質問
- SmolDocling-256M-Demoを使うのに、インストールや専門知識は必要ですか?
- ブラウザで開くだけで使えます。インストールは不要です。
- SmolDocling-256M-Demoはスマホでも使えますか?
- スマホでも使えます。
- SmolDocling-256M-Demoは仕事(商用)で使えますか?
- ライセンスは Apache-2.0 で、商用利用も認められています。ただし著作権表示を残すなどの条件が付くので、配布物に含める場合はライセンス本文を確認してください。
RAG / PDF解析のほかのツール
SmolDocling-256M-Demoが合わなかったときの、同じ用途の候補です。
granite-docling-258m-demo
Docling文書解析デモ
準備がいる・黒い画面いらない
opendataloader-pdf
PDFをAI向けに解析
はじめやすい・ターミナル操作あり
obsidian-text-extractor
【更新終了】Obsidianで画像やPDFの文字を取り出す追加部品
準備がいる・黒い画面いらない
DocScope-R1
書類画像を読み取る
準備がいる・黒い画面いらない
Dots-OCR
文書画像OCR
準備がいる・黒い画面いらない
LightOnOCR-2-1B-Demo
書類の画像から文字を読み取るOCRデモ
準備がいる・黒い画面いらない