DEMO
MODELS / MODEL RELEASE
視覚言語モデル『Lumen Vision Mini』、図表読解に特化した架空版を公開
複雑な図表を段階的に読み取り、根拠位置を示す小型モデルというデモ設定です。
架空のAI開発企業Helio Typeは、図表読解に特化した視覚言語モデル「Lumen Vision Mini」を公開した、という設定だ。グラフの軸、凡例、注記を段階的に抽出し、回答に使った領域を座標で返す。これはサイト表示確認用の架空デモ記事で、モデル、企業、性能比較はいずれも現実の発表ではない。
「読めなかった」を回答に含める
デモ版は低解像度の文字や省略された凡例を検知すると、推測で補わず不明箇所として返す設計だ。回答の根拠位置を表示することで、利用者が元画像をすぐ照合できるようにする。
- 軸の単位と期間を先に抽出
- 複数系列の色や線種を個別に追跡
- 注記と本文を区別して引用
- 判読不能な領域を信頼度とともに表示
実務データ特有の難しさ
資料には切れたスクリーンショットや手書きの追記、似た色の系列が混在する。架空の評価では、整った公開データに加えて、こうした崩れた入力を重点的に含めた。根拠表示があっても解釈が正しいとは限らないため、財務や医療など影響の大きな用途では、担当者が原資料を確認する流れを前提としている。