科研費 24K22434

映像アノテーション協働目録プロトタイプ

映像に、信頼できる記述を。

無声のアマチュア映画に、AIが視覚記述の下書きを付け、人が確認・修正して IIIF の記述メタデータに仕上げ、その先で映像検索に使う。

作る

AIが下書き

ショットを抽出し、Claude vision がシーンの記述と看板・字幕カードの文字を読み取る。

確かめる

人が確認

AIの出力は下書き。人が地名・人名などローカルな知識を補い、確認して初めて目録データになる。

使う

検索して発見

記述・看板文字・タグから場面を検索し、動画の該当時刻へジャンプ。確認済みデータだけを対象にできる。

作る → 確かめる → 使う

映像AI記述+OCRIIIF注釈人が確認検索・利用

人が確認した信頼データ(reviewed = true)が、次の自動認識を育てる教師データになる。