それは文生图(text-to-image)、图生图(image-to-image)、画像編集/スタイル転送、そして图生视频/文生视频など、さまざまなビジュアルクリエイティブ機能をサポートしています。
通義万相とは
通義万相は、阿里巴巴/阿里雲の「通義」システムに属するAIクリエイティブビジュアル生成プラットフォーム/モデルで、主に画像と動画の作成に使用されます。
それは文生图(text-to-image)、图生图(image-to-image)、画像編集/スタイル転送、そして图生视频/文生视频など、さまざまなビジュアルクリエイティブ機能をサポートしています。
技術的には、通義万相はマルチモーダル大規模モデル(ビジュアル/画像/動画方向)に分類され、プロンプトと入力画像などを条件としてコンテンツ生成を実現します。
通義万相プロジェクトは発展過程で、バージョンイテレーション(例:万相2.1、2.2、2.5など)を通じて、動画生成能力の強化、オーディオサポート、効果の改善などが行われてきました。
例えば、その图生视频モデルは、最初のフレーム画像+テキストプロンプトに基づいてショート動画(5〜10秒、指定解像度、オプションのナレーションなど)を生成する機能をサポートしています。
通義万相は、特定の段階では「無料クローズドベータ/招待制体験」の状態にあり、一般公開には制限がある可能性があります。











コメント
コメントはまだありません
最初のコメントを書きましょう