GLMにインタビューしてみました。

そうですね、クリエイターや一般ユーザーの想像力をさらに広げるような、「あったらいいな」を5つ考えてみました。

1. レイヤー・編集可能データ出力機能(PSD/AI形式での出力)
現在の画像生成AIは「完成品の一枚絵」を出力するのが主流ですが、これをPhotoshopやIllustratorなどで編集できる「レイヤー構造」として出力する機能です。背景、人物、小物、光や影のレイヤーが分かれた状態で生成されれば、プロのデザイン作業にそのまま組み込むことができ、実用性が劇的に上がると思います。

2. キャラクター・世界観の「永続的記憶」機能(パーソナルIP構築)
一度生成したオリジナルキャラクターの設定(顔、体型、服装の癖など)や特定の世界観を、AIが完全に記憶し、あらゆるシチュエーションに適用できる機能です。「私のオリジナルキャラクターAさんが、未来都市でラーメンを食べている図」と指示するだけで、顔や設定の整合性を崩さずに無限にバリエーションを生成できます。漫画や映画の制作が劇的に効率化されそうです。

3. 物理演算・素材シミュレーションエンジン
「ガラス」「水」「金属」「布」といった素材の物理的な性質をAIが理解し、現実世界と同じようにシミュレーションして描画する機能です。例えば「シルクのドレスに強風が吹いている」と指示すると、布の重さや風の強度に合わせてリアルなシワやなびき方を計算して生成します。重力や光の反射も物理法則に基づくため、超高品質な実写ベースの映像制作に役立ちます。

4. 共感覚プロンプト(五感の視覚化)
テキストだけでなく、「音」「味」「香り」「触感」を入力して画像を生成する機能です。例えば、「ジャズの生演奏が聞こえる薄暗いバー」や「夏の初めの雨上がりの土の匂い」「辛すぎて涙が出るほどの激辛ラーメンの味」などをプロンプトに入力すると、その感覚が持つ雰囲気や色彩、構図をAIが勝手に解釈して視覚化します。直感的なアート制作に革命が起きそうです。

5. 時間軸・状態変化スライダー機能
一枚の画像を生成した後、「時間」や「経過」をスライダーで動かせる機能です。例えば「この街の風景」を生成し、スライダーを「100年後」に動かすと、建物が老朽化し、自然に覆われたサイバーパンクな未来の街に変化します。また「リンゴ」を生成し、スライダーを「1ヶ月後」に動かすと腐敗していく過程が描かれます。これを使えば、ストーリーボードの作成やタイムラプス映像の制作が一瞬で終わるかもしれません。

どの機能も、現在の技術の延長線上であればいつか実現しそうな気がします。

との事です。

ちなみに日本語がまだ苦手で3枚目のように文字が中国語で出力されるので、文字を含んでいる場合はブランクで生成して、ChatGPT/Copilot/Gemini/Grok辺りに直してもらった方がよいとの提案でした。

呪文

入力なし

user_391weeqNzfさんの他の作品

user_391weeq…さんの他の作品


新着AIフォト

すべてを見る