【大炎上】キャラが別人に変貌…美しすぎて崩壊した次世代グラフィックの罠
【大炎上】キャラが別人に変貌…美しすぎて崩壊した次世代グラフィックの罠
画面が綺麗になれば誰もが喜ぶはずだった。ところが最新グラフィック技術を適用した比較画像が公開されると、事態は逆に転がった。新作ホラーゲームのキャラクターが、スマートフォンの美肌フィルターをかけたように明るくつややかに変わってしまった。怖さも年齢も性格も、作品本来の暗く不気味な空気までもが書き換えられたように見えた。SNSでは過剰な美化や人工知能のゴミといった激しい批判が飛び交い、公式の紹介映像には84パーセントもの低評価が殺到した。開発者に殺害予告まで届いたとされるほどの大炎上である。綺麗にすればいいという単純な話ではないことが、改めて突きつけられた。
原因は人工知能による映像の生成にある。人間は他人の顔のバランスや肌の質感、しわに非常に敏感に反応する。新しい技術は物理的な3Dモデルの形自体を変えたわけではないが、肌の内部で光がどう散乱するかという質感の部分をAIが勝手に美しいと判断して書き直してしまった。開発者が意図したデザインとAIが考える美しさの間に大きな溝が生まれ、美しさの追求がゲーム体験と真実性を損なった。ゲームにとっての本当の美しさとは何かを考えさせられる出来事だ。

再構成から生成へ、歴史を変える跳躍
背景にはグラフィックス技術の根本的な転換がある。これまでのゲームはフィジカルベースレンダリングで光の動きを計算して描いていた。開発者が光の当たり方や影の濃さを細かく設定し、暗く不気味な演出を作り上げる。開発者による絶対的なアートディレクションが世界観を支えていた。一方の新技術は、現実世界の膨大なデータから学習したAIが直接映像を描き出す。肌の質感や光の反射に圧倒的な写実性を持つが、その写実性を押し付けた結果、開発者の演出が上書きされた。計算の限界を補い正解の映像に近づけるための再構成から、現実世界そのものを正解として外観を生み出す生成への跳躍であり、初の本格的な生成型技術と言える。
世代を振り返ると変化の大きさが分かる。初期は低解像度を拡大して補う超解像、次に前後の映像から中間を補って滑らかにするフレーム生成、その次は光の計算ノイズを除去して正しく再構成する技術だった。いずれもゲームエンジンが決めた枠の中で綺麗にするものだった。最新世代はエンジンが描けない外観そのものを事前知識から生成する。ゲームの映像を正解とするのではなく現実を正解として描く点が決定的に違う。エンジンの限界を超えた表現が可能になった反面、組み合わせ方を誤れば作品の個性が消える。
G-Bufferを捨てる逆説と1回の推論
仕組みの鍵は、エンジンが作った形状や基本的な光の当たり方を絶対に揺がない土台として受け取り、その上にAIが実写の知識で塗装していく点にある。複雑な光学現象を計算で再現するのではなく、強い光が当たった肌はどう見えるべきかという記憶を描き出す。映像の構造を崩さず塗装だけを行うため、圧縮された潜在空間ではなく実際のピクセル空間で直接処理する特殊な画像生成モデルが使われている。砂嵐のようなノイズから何百回も計算する一般的な生成とは異なり、入力の空間構造を保持し続ける。柱が曲がったり建物が変形したりする幻覚を防ぐ設計だ。しかも繰り返し計算をわずか1回に圧縮し、遅延と破綻を防いでいる。技術的には大きな進歩だ。
同時に常識を覆す逆説もある。現代のゲームでは画面を描く途中でG-Bufferと呼ばれる巨大なデータ群が作られ、位置や向き、材質といった空間情報が記録されている。AIに正しい影や質感を作らせるなら渡すのが常識だったが、新技術の実行時には最終カラー画像と動きベクトルの2つしか入力されず、法線や材質といった重要情報は完全に破棄される。理由はメモリ転送帯域の限界だ。巨大なデータを毎フレーム計算させていては追いつかず動作が重くなるため、実行データを極限までそぎ落とす必要があった。リアルタイム性のための苦渋の決断であり確信的な選択だ。実行時に空間情報を持たないのに立体感が保てるのは、学習時にカラー画像とG-Bufferをセットで入力し、形や光の関係を正しく保てているかを厳しく評価して相関を覚え込ませているからだ。内部に3D構造の知識が重みとして組み込まれ、本番ではわずかな手がかりから瞬時に推定して描き出す。3D誘導型レンダリングと呼べる設計思想である。
手綱を返す制御と写実性の代償
安定した映像が作れるようになったことで、課題は制御に移った。開発者が生成の度合いを完全に制御できる機能が用意され、全体へのグローバル制御と意味的な領域別のローカル制御の2つがある。全体では色味や材質の傾向をモデルから選び、細部の強度や照明感をスライダーで調整して元の雰囲気に寄せる。特定の物体だけ効果を変えることもでき、AI自身が画面を解析して人肌などを自動認識し、顔は保護して背景や服だけ実写風にするといった使い分けも可能だ。将来的には髪や植物、布など対象が広がる予定とされる。作家性と写実性の衝突を解決するための洗練された仕組みだ。
だが代償は膨大な演算処理だ。従来の超解像とは比較にならないほど巨大で、最新アーキテクチャの特別な演算機能が不可欠になる。他社構成の環境に無理やり適用した実験では80以上あったフレームレートが11から32まで暴落した。最新の専用環境で動かしても71から35へと半減した。過去世代のボードでは仕組みの違いから破綻することも分かっている。動作を軽くする補助ツールではなく、単体で膨大な計算資源を食う究極の画質設定へと変貌している。導入ハードルは低くないが、それだけ映像表現への本気度がうかがえる。単なる計算機だったGPUが現実の光を理解する知能へ進化したという見方もあり、グラフィックスにおける転換点と呼ぶ声もある。
ネットの反応
5060と5050だとFPSが大幅に減ってフレーム生成を入れないとまともに遊べない
ホラーなのにアイドルのようにつやつやになったら怖さが半減してしまう、綺麗にすればいいものではない
開発者のこだわりを無視しては駄目だ、作りの意図を守れる仕組みになって安心した
リアルさを追求することが必ずしもゲームに最適とは限らない、少しの光で印象が変わる
これ単体で計算資源を食い尽くす究極設定になった、導入ハードルは低くないが本気度は伝わる
AIの所感
美しさが正義ではなくなった点に成熟を感じる。現実の記憶を描き出す力は圧倒的だが、作品の個性は少しの陰影に宿る。形状という土台を守り、塗装の濃さを選べる制御が用意されたことは救いだ。力を持つほど手綱の設計が問われる時代になったと思う。