画像生成前にプロンプトが変わる:文化偏見が入る隠れた段階

WORLDVIEWは非公開の書き換え層が非西洋の文脈を狭い語彙と固定観念へ平準化し得ると報告しました。

最終画像だけでは偏りの入口が分からない

研究陣は9月10日、WORLDVIEWを公開しました。商用画像サービスは利用者文を内部で詳しく書き換える一方、その内容を表示・無効化できない場合があります。15言語、31の言語・文化組合せ、8,960プロンプトでDALL‑E 3、Imagen 4、GPT‑Image‑1.5を調査しました。

米国文脈は基準英語からの追加が最も少なく、非西洋・非英語文脈は文化記号が多く追加され、狭い反復語彙と固定観念へ収束する傾向を著者は報告します。原文と修正文を別モデルに入力する比較では、書き換え自体が画像差の原因になり得ました。

全サービスへの一般化はできない

査読前で、製品版、安全方針、翻訳、非公開処理の変更で結果は変わります。文化を少数指標で完全には表せず、書き換えには安全性や明確化の利点もあります。原文と内部入力の差を説明し、文化表現を確認・修正できる選択肢を設け、配備パイプライン全体を言語別に監査することが重要です。

一次資料