COYOTE スタジオ採用説明会 | クリエイターのための総合情報サイト CREATIVE VILLAGE

VoiceStudio | 音声クローンや動画吹き替えをローカル環境で実行!64...

Debpalash氏らが開発する音声クローン、音声生成、動画吹き替え、文字起こし、オーディオブック制作などをローカル環境で利用できるオープンソースのAI音声スタジオ「VoiceStudio(旧Omn…

続きを読む

AC9 Cloth Retopo v1.1 | CLOやMarvelous De...

牛山氏( @naoki_ushiyama )が、CLOやMarvelous Designerで作成した衣装メッシュを2D型紙ベースでリトポロジーできる無料Blenderアドオン「AC9 Cloth …

続きを読む

NeXus MPM Tech Preview | Cinema 4DとBlend...

INSYDIUMが、Cinema 4DとBlender向けGPUシミュレーションツール「NeXus」に導入予定の新しいMPM(Material Point Method)ソルバーのプレビュー動画公開…

続きを読む

Ragdoll for Web | 物理シミュレーションで人形のようにキャラクタ...

Ragdoll Dynamicsは、物理ベースのキャラクターアニメーションツール「Ragdoll」をWebブラウザ上から利用できる「Ragdoll for Web」を公開しました。R…

続きを読む

OVERGROWN Teaser | Blender Studioが手掛ける長編...

Blender Studioが現在制作中の短編映画『OVERGROWN』のティザートレーラーが公開!Blenderを使用し絵画的なNPRの探求した作品となっております。OVERGRO…

続きを読む

Make-A-Video - MetaのAI研究開発チームによるテキストからビデオを生成する技術が発表!

この記事は約2分5秒で読めます

Meta AIによる、テキストプロンプトから動画を生成する技術「Make-A-Video」が発表されました。

Make-A-Video

Make-A-Videoの研究は、テキストからビデオへの生成を可能にするために構築されたテキストから画像への生成技術における最近の進歩をベースにしています。このシステムは、説明文付きの画像を用いて、世界がどのように見えるか、また、どのように説明されることが多いかを学習します。また、ラベルのない動画を使って、世界の動きを学習します。このデータをもとに、Make-A-Videoは、わずかな文字や行のテキストで、気まぐれで世界にひとつだけの動画を生成し、あなたの想像力を膨らませます。

公式ページより

私たちは、Text-to-Image(T2I)生成における最近の驚異的な進歩を、Text-to-Video(T2V)に直接変換するアプローチであるMake-A-Videoを提案します。我々の直感は単純で、テキストと画像のペアデータから、世界がどのように見えるか、どのように記述されるかを学び
このように、Make-A-Videoは、テキストと画像のペアから世界の様子とその説明を学習し、教師なしビデオ映像から世界の動きを学習する。Make-A-Videoには、
(1)T2Vモデルの学習を高速化できる(視覚表現とマルチモーダル表現を一から学習する必要がない)
(2)教師なしビデオ映像から世界の動きを学習できテキストとビデオのペアデータを必要としない、
(3)生成されたビデオは今日の画像生成モデルの持つ広大さ(美的感覚の多様性、幻想的な描写など)を継承している
という三つの利点があります。
我々は、T2Iモデルに新規かつ効果的な空間-時間モジュールを構築するための、シンプルかつ効果的な方法を設計する。まず、完全な時間的U-Netと注意テンソルを分解し、空間と時間で近似する。次に、T2V以外の様々なアプリケーションを可能にするビデオデコーダ、補間モデル、2つの超解像モデルにより、高解像度かつフレームレートのビデオを生成する空間時間パイプラインを設計する。空間的・時間的解像度、テキストへの忠実性、品質、すべての側面において、Make-A-Videoは質的にも量的にも、テキストからビデオへの生成における新しい最先端を打ち立てたと言える。

論文より

これまた凄いのが出てきましたね。「Make-A-Video」は現在論文のみ公開済みです。
今後の動向が気になる方は、是非サイトをチェックしてみてください。

リンク

Screenshot of makeavideo.studio


PR

関連記事

  1. TRELLIS: Structured 3D Latents for Scalable and Versatile 3D Generation - マイクロソフトによるAI活用3Dアセット生成技術が登場!テキストや画像から3Dアセットを生成!

    2024-12-12

  2. RigNet - ディープラーニングを活用しモデルへのスキニングを自動で行う技術のソースコードが公開!

    2020-10-22

  3. Luma Dream Machine - Luma AIから突如高品質な動画生成AIが発表!無料でお試し可能!

    2024-06-13

  4. LL3M: Large Language 3D Modelers - AIでBlender内で3Dアセットを作成・編集するPythonコードを生成できるオープンソース技術!プロジェクトページが公開!

    2025-08-28

コメントをお待ちしています。

コメント

日本語が含まれない投稿は無視されます。-Posts that do not include the Japanese will be ignored-(スパム対策-anti Spam-)

3D人-3dnchu-

3D/2D/VR/GAME/AIなどのCGに関連する個人的に気になる情報をほぼ毎日紹介!XやYoutubeなども是非フォローよろしくお願いします!
※当サイトのリンクにはアフィリエイトを含みます

※当サイトの一部記事にはアフィリエイトが含まれております。

スポンサープロダクト


X-Ray Realtime Light and TexturingTool

CGElementaryに関する記事一覧


Character Creator - アニメーション、ゲーム、AR/VR のための 3D キャラメイクソフト

Reallusionに関する記事一覧


Paintstorm Studio

Paintstorm Studioに関する記事一覧


MarvelousDesigner

MarvelousDesignerに関する記事一覧


JangaFX - Real-Time VFX Software For Real-Time VFX Artists

JangaFXに関する記事一覧


パルミーの講座が見放題!月謝制お申し込み|お絵かき講座パルミー

Palmieに関する記事一覧


《ドラゴン》―複雑な生き物モデリングとマップ作成技術のコース【Japanese】

WINGFOXに関する記事一覧


アーカイブ

カテゴリ

おすすめ商品Pickup

注目の記事

PR


PR






Donate

   
USD
3D人のLINEアカウントを作りました!
友だち追加




おすすめ商品Pickup

おすすめ記事

ページ上部へ戻る