COYOTE スタジオ採用説明会 | クリエイターのための総合情報サイト CREATIVE VILLAGE

VoiceStudio | 音声クローンや動画吹き替えをローカル環境で実行!64...

Debpalash氏らが開発する音声クローン、音声生成、動画吹き替え、文字起こし、オーディオブック制作などをローカル環境で利用できるオープンソースのAI音声スタジオ「VoiceStudio(旧Omn…

続きを読む

AC9 Cloth Retopo v1.1 | CLOやMarvelous De...

牛山氏( @naoki_ushiyama )が、CLOやMarvelous Designerで作成した衣装メッシュを2D型紙ベースでリトポロジーできる無料Blenderアドオン「AC9 Cloth …

続きを読む

NeXus MPM Tech Preview | Cinema 4DとBlend...

INSYDIUMが、Cinema 4DとBlender向けGPUシミュレーションツール「NeXus」に導入予定の新しいMPM(Material Point Method)ソルバーのプレビュー動画公開…

続きを読む

Ragdoll for Web | 物理シミュレーションで人形のようにキャラクタ...

Ragdoll Dynamicsは、物理ベースのキャラクターアニメーションツール「Ragdoll」をWebブラウザ上から利用できる「Ragdoll for Web」を公開しました。R…

続きを読む

OVERGROWN Teaser | Blender Studioが手掛ける長編...

Blender Studioが現在制作中の短編映画『OVERGROWN』のティザートレーラーが公開!Blenderを使用し絵画的なNPRの探求した作品となっております。OVERGRO…

続きを読む

MDM: Human Motion Diffusion Model - テキストから人物モーションの生成や合成が可能な技術が登場!

この記事は約2分9秒で読めます

テキストから人物モーションの生成や合成が可能な技術「MDM: Human Motion Diffusion Model」が登場!

2022/10/07 – Githubにてコードが公開されたのでリンクを追加

MDM: Human Motion Diffusion Model

自然で表現力豊かな人間の動きを生成することは、コンピュータ・アニメーションの聖域である。しかし、動きには多様性があり、それに対する人間の知覚的な感度や、正確な描写の難しさから、難しい課題となっています。そのため、現在の生成ソリューションは、低品質であるか、表現力に限界がある。他の領域で既に顕著な生成能力を示している拡散モデルは、その多対多の性質から人間の運動に対する有望な候補であるが、リソースを消費し、制御が困難な傾向がある。本論文では、分類器を用いない拡散ベースの生成モデルを人体運動領域用に慎重に適応させたMotion Diffusion Model (MDM)を紹介する。MDMはモーション生成の文献からの洞察を組み合わせた変換器ベースである。注目すべきデザインチョイスは、各拡散ステップにおいて、ノイズではなく、サンプルを予測することである。これにより、足の接触損失など、運動の位置と速度に関する確立された幾何学的損失の利用が容易になる。我々が示すように、MDMは汎用的なアプローチであり、異なる条件付けのモードや、異なる生成タスクが可能である。我々は、我々のモデルが軽量なリソースで学習可能でありながら、テキストからモーション、アクションからモーションの主要なベンチマークにおいて最先端の結果を達成することを示す。

MDMフレームワークは、様々な条件付けを可能にする汎用的な設計になっている。本発表では、テキストからモーション、アクションからモーション、そして無条件生成の3つのタスクを紹介する。MDMは、多様性と忠実性をトレードオフにする分類器不要の方法で学習し、同じモデルから条件付きと無条件の両方をサンプリングすることが可能である。テキストからモーションへの変換では、HumanML3DおよびKITベンチマークにおいて最先端の結果を達成し、一貫性のあるモーションを生成することができた。また、ユーザ調査の結果、人間の評価者は42%の確率で、生成したモーションを実モーションよりも好むことがわかった。また、Action-to-Motionでは、HumanAct12とUESTCのベンチマークにおいて、MDMはこのタスクのために特別に設計されたにもかかわらず、最先端技術を上回る性能を示した。

論文のみ公開、ソースコードはComming Soonとなっております。2022年10月7日にGithubにてソースコードも公開されました。この技術がどう発展していくのか、とても楽しみです。今後レイアウトなどもテキストで指定出来るようになれば、テキストだけで3Dドラマみたいなものが作れるようになりそうですね。

リンク

Screenshot of guytevet.github.io


PR

関連記事

  1. ProlificDreamer: High-Fidelity and Diverse Text-to-3D Generation with Variational Score Distillation - テキストから高精度なテクスチャ付き3DメッシュやNeRFを生成可能な技術!

    2023-05-27

  2. Hunyuan3D-Part - テンセントから3Dメッシュのパーツ分解技術がオープンソース公開!P3-SAMとX-Part技術を採用!

    2025-09-27

  3. DreamCraft3D: Hierarchical 3D Generation with Bootstrapped Diffusion Prior - テキストから3Dモデルを生成する技術!既存技術よりも更に高精度に!

    2023-11-01

  4. AI Can Now Fix Your Grainy Photos - NVIDIAによるディープラーニングを用いたノイズ除去技術

    2018-07-12

コメントをお待ちしています。

コメント

日本語が含まれない投稿は無視されます。-Posts that do not include the Japanese will be ignored-(スパム対策-anti Spam-)

3D人-3dnchu-

3D/2D/VR/GAME/AIなどのCGに関連する個人的に気になる情報をほぼ毎日紹介!XやYoutubeなども是非フォローよろしくお願いします!
※当サイトのリンクにはアフィリエイトを含みます

※当サイトの一部記事にはアフィリエイトが含まれております。

スポンサープロダクト


X-Ray Realtime Light and TexturingTool

CGElementaryに関する記事一覧


Character Creator - アニメーション、ゲーム、AR/VR のための 3D キャラメイクソフト

Reallusionに関する記事一覧


Paintstorm Studio

Paintstorm Studioに関する記事一覧


MarvelousDesigner

MarvelousDesignerに関する記事一覧


JangaFX - Real-Time VFX Software For Real-Time VFX Artists

JangaFXに関する記事一覧


パルミーの講座が見放題!月謝制お申し込み|お絵かき講座パルミー

Palmieに関する記事一覧


AAA Character Creation: The Boxing Bunny

WINGFOXに関する記事一覧


アーカイブ

カテゴリ

おすすめ商品Pickup

注目の記事

PR


PR






Donate

   
USD
3D人のLINEアカウントを作りました!
友だち追加




おすすめ商品Pickup

おすすめ記事

ページ上部へ戻る