画像キャプション生成

写真に写っているシーン・人数構成・年齢構成を Gemini が言葉にする

画像一覧

左の一覧から画像を選択してください。

画面のどこへでも画像をドラッグ&ドロップすると追加できます。

設定

プロンプトを変えると出力の粒度と精度が変わります。変更すると、保存済みの要約は「プロンプト変更後 未再解析」として印が付きます。

各項目の読み方

要約

見出しは一覧に並べる短い文、概要は1〜2文、詳細は3〜5文です。 文の長さはプロンプトで指示しているだけなので、モデルによってはぶれます。

シーン

行事名は自由記述、区分・場所・時間帯は決められた値から選ばせています。 日本語を自由に返させると表記ゆれで絞り込みが効かなくなるため、値は英語の固定値で受け取り、 表示名だけをサーバー側で持っています。

人数・年齢構成

人数は「見えているものを数える」よう指示しています。後ろ姿や見切れも1人として数えます。 年齢は見た目からの推定で、園児の学年までは当てられません。

ブレ判定 Imagick

グレー化して edgeImage をかけた画像の標準偏差を見ます。値が閾値未満だとブレと判定します。 そだちえ本番と同じ実装(ImageBlurDetectionService)を移植したものです。

この指標は単独ではブレを十分に分離できないことが分かっています。 「ブレている可能性がある」という参考値として扱ってください。

環境
Gemini プロンプト 出力項目は API 側の responseSchema と対になっています。項目名(caption / summary / detail / scene / people など)は変えないでください。

※ Gemini モデルは画面上部のツールバーから切り替えます(切り替えは次の解析から反映)。

ログイン情報

パスワードの変更

ユーザー管理

招待した利用者は「一般」として追加され、画像の追加・解析・削除ができます。ユーザー管理だけが管理者専用です。 権限は一覧の選択欄からいつでも変更できます。オーナーは変更・無効化・削除できません。