Florence系モデルで画像内容を読み取り、確認や説明文作成を助けます。
#画像認識#キャプション
※この説明はAIが公式READMEから自動生成したものです。内容は必ず公式ページでもご確認ください。
ミロンドが自分で確かめたこと
- 2026年8月22日お試しページを実際に開いて、動いていることを確認しました。
ミロンドは掲載しているすべての行き先を定期的に開いて、今も使えるかを確かめています。 利用ルールは名前だけで判断せず、原文を読んで確認しています。
「AIモデル」47本の中での位置
- 黒い画面(ターミナル)を使わずに済むこの分野で47本
- APIキーの用意がいらないこの分野で45本
- 作ったものを仕事に使ってよいと確認できているこの分野で17本
- 入れた内容は公開元に送られますそうでないものが13本 →
上の条件をすべて満たすものは、47本中17本です。
この数字は、ミロンドが掲載している道具を1本ずつ同じ基準で調べた結果から数えています。
これは何?アプリに入れて使うAI本体(モデル)
できること
画像を入れて、写っている物の説明、検出、キャプション作成などの視覚AI機能を試せます。
誰に効く?
画像の中身を整理したい人
用意するもの
解析したい画像
時間のめやす
5〜15分(アプリ導入後)
使えるようになるまでの手順をひらく
- まず入れ物のアプリを用意する(Jan・GPT4All・Ollamaなど。「」カテゴリから選べます)
- アプリ内のモデル一覧でこの名前を探してダウンロード(Ollamaなら黒い画面で ollama run 名前)
- あとは普通にチャットするだけ。合わなければ消して別のモデルに替えればOK
こんな人には向かないかも
- 入れ物アプリ(Jan・Ollama等)をまだ入れていない人(先にそちらの準備を)
迷ったらこれ:いつも使っているAIチャット(ChatGPT・Claude・Geminiなど)にこのツールのGitHubリンクを貼って 「これを使いたい。私のPCでの始め方を一歩ずつ教えて」と頼むのが一番の近道です。
注意点
見落としや誤認識があるため重要判断には不向きです。 ここに書いたは、このお試しページ自体のものです。作ったものを仕事に使えるかどうかは、中で使われているAIモデルの条件で決まります。使われているモデルは商用利用も認められています(mit / mit / mit)。ただし著作権表示など条件が付く場合があるので、配布物に含めるなら本文を確認してください。
ひとことメモ
公開元のサーバー上で動くお試しページです。アップロードした画像や文章はその環境に送られるので、社外に出せないものは入れないでください。混み合っていると順番待ちになることがあります。
やりたいことから探す
better-florence-2についてよくある質問
- better-florence-2は無料で使えますか?
- 無料で使えます。自分のパソコンの中で動くタイプなので、使った量に応じた料金もかかりません。
- better-florence-2を使うのに、インストールや専門知識は必要ですか?
- これはAI本体のデータで、単体では動きません。Jan や Ollama のような「入れ物アプリ」に読み込ませて使います。
- better-florence-2はスマホでも使えますか?
- スマホには対応していません。パソコンが必要です。
- better-florence-2は仕事(商用)で使えますか?
- ライセンスは MIT で、商用利用も認められています。ただし著作権表示を残すなどの条件が付くので、配布物に含める場合はライセンス本文を確認してください。
似ている道具との違い
同じ用途の道具と、使う前に効いてくる条件を並べました。
| 道具 | 黒い画面 | APIキー | 外部送信 | スマホ | 仕事に使える | 最終更新 |
|---|---|---|---|---|---|---|
| better-florence-2(このページ) | いらない | いらない | あり | むずかしい | 可 | 2026年7月 |
| comparing-captioning-models | いらない | いらない | あり | むずかしい | 未確認 | 2024年4月 |
| live-vision | いらない | いらない | あり | むずかしい | 未確認 | 2024年6月 |
| smolvlm-realtime-webgpu | いらない | いらない | あり | むずかしい | 可 | 2025年5月 |
「外部送信あり」は、入力した内容がどこかのサーバーに送られることを指します。 社外に出せない資料を扱うときは「なし」を選んでください。
AIモデルのほかのツール
better-florence-2が合わなかったときの、同じ用途の候補です。
comparing-captioning-models
画像説明AIを比較
上級者向け・黒い画面(ターミナル)いらない
live-vision
ライブ映像をAI解析
上級者向け・黒い画面(ターミナル)いらない
smolvlm-realtime-webgpu
ブラウザで画像を認識
上級者向け・黒い画面(ターミナル)いらない
Llama 3.1 8B
ローカルAIの世界標準モデル
準備がいる・黒い画面(ターミナル)いらない
gpt-oss-20b
OpenAIが無料公開した本格モデル
準備がいる・黒い画面(ターミナル)いらない
Phi-4
小さいのに数学と論理に強いMicrosoft製
準備がいる・黒い画面(ターミナル)いらない