Google DeepMindがGenie 3を発表:これは動画生成ではなく、「マトリックス」の原型です

Google DeepMindがGenie 3を発表:これは動画生成ではなく、「マトリックス」の原型です

Hannah Foster
85
Sofarbot

Google DeepMindが再び生成AIの限界を定義しました。Genie 3は「テキストから動画生成」を「テキストから世界生成」へと進化させました。24fpsで操作可能な3D環境を生成することができます。現在は720p解像度に限定され、連続記憶も60秒間のみですが、AIが物理法則を理解し、「観察者」から「創造者」へと進化し始めたことを示しています。

「観客」からの脱却、ユーザーに制御権を返還 Genie 3以前、RunwayであれSoraであれ、ユーザーは単なる観客でした。プロンプトを入力し、AIが動画を生成する。主人公の行動を変えることはできませんでした。Genie 3はこの壁を打ち破りました。インターネット上の膨大な動画を学習することで、「動作」と「環境」の関係を理解したのです。キーボードの「右矢印」を押すと、モデルはあらかじめ設定されたアニメーションを再生するのではなく、物理法則(重力、衝突判定など)に基づいてリアルタイムで計算し、キャラクターが右に走る映像を生成します。


主要スペック:速いが、鮮明さはまだ足りない DeepMind公式および初期テスターからのフィードバックによると、Genie 3の現在の性能指標は非常に明確です:

フレームレート: 24fpsで安定。これは操作感が初期の3Dゲームに近づき、明らかなカクつきがなくなったことを意味します。

解像度: 現在は720pに固定されています。4K画面でブラウザから見ると少しぼやけるかもしれませんが、これはリアルタイム生成の限界です。

記憶力(Memory): これが現在の弱点です。モデルは約60秒間の環境の一貫性を維持できます。これを超えると、さっき通った道が変形したり、後ろの家の色が突然変わったりする可能性があります。


「Promptable Events」:神視点からの即時変更 Genie 3は、極めてSF的な機能を導入しました——ゲームプレイ中に世界をリアルタイムで変更することです。この仮想世界を走っている最中に、いつでも「突然大雨が降る」や「重力がなくなる」といった指示を入力できます。モデルは次のフレームでシーンを再読み込みすることなく、この変化をシームレスに即座に反映します。これはゲーム開発者がプロトタイピングを行う際には、次元を超えた打撃となるでしょう。


なぜ重要なのか? これを単なる「AIゲームジェネレーター」と見なさないでください。Genie 3の本質は、AIが物理論理に適合する内部世界モデルを構築できることを検証した点にあります。もしAIが現実の世界をシミュレートできれば、そのシミュレーター内でロボットを訓練したり、自動運転をテストしたり、さらには科学実験をシミュレーションしたりでき、そのコストはほぼゼロになります。

体験方法 現在、Genie 3は実験的機能としてGoogle Labsに追加され、一部のAI Ultraサブスクリプションユーザーに開放されています。一般の開発者はWaitlistに申請することでAPIアクセス権を取得できます。

Google DeepMindGenie 3世界モデルAIゲーム開発インタラクティブAI3D生成バーチャルリアリティ

共有

コメント

0
0/500 文字

コメントはまだありません

最初のコメントを書きましょう

もっと見る

類似ツール

Viewra

Viewra

ViewraはAIインテリアデザインプラットフォームで、部屋の写真やテキスト説明をフォトリアルな3Dシーンに変換し、360°のインタラクティブウォークスルー、シェア可能なリンク、20以上のプリセットスタイルを提供します。

MeshGPT

MeshGPT

MeshGPT は、テキストプロンプトや画像から、すぐに使えるテクスチャ付きの3Dモデルを生成できるAI 3Dモデル生成器です。Blender、Unity、Unreal Engine、AR、3Dプリントに対応した形式での書き出しが可能で、毎日無料の生成枠と従量課金のAPIも提供されています。

InsideDCPulse

今回の審査時点では insidedcpulse.com にアクセスできず、サイトの位置づけとプロダクト形態を独自に確認できませんでした。ドメイン名の字面からすると、ワシントンD.C.またはデータセンターに関連する可能性がありますが、詳細は公式サイトをご確認ください。

3D Generator

3D Generator

3D Generator は、テキストプロンプトや2D画像を3Dメッシュに変換できるオンラインAI 3D生成サービスです。公式の説明では、シンプルなプロンプトなら10秒以内にモデルを生成可能で、全体の生成時間は複雑さに応じて5秒から180秒の範囲です。多視点入力をサポートし、モデルの背面形状を改善できます。出力形式はGLB、GLTF、FBX、OBJ/MTL、STLに対応し、主要なゲームエンジンや3Dコンテンツ制作、3Dプリントのパイプラインをカバーします。基盤となるアルゴリズムはHunyuan 3Dで、数百万の3Dモデルから学習しており、ポリゴン数を抑えるためのトポロジー最適化が自動的に行われます。料金プランは無料枠に加えて、Pro(月額9.90ドル)とMax(月額19.90ドル)の2つがあります。

Next3d

Next3d

Next3D はブラウザ上で動作する AI プラットフォームで、テキストプロンプトと画像を 10 ~ 30 秒で 3D モデルに変換できます。また、GLB、OBJ、FBX、STL などの 3D ファイルを表示・変換するためのオンラインツールボックスも内蔵しています。

CADAM

CADAM

CADAM 是一款开源 Text to CAD 平台, 定位类似 AI TinkerCAD。它支持用自然语言描述生成参数化 3D 模型, 并接受图像参考。官方站点抓取时未返回实质内容, 本文信息基于采集时的原始描述整理。