COYOTE スタジオ採用説明会 | クリエイターのための総合情報サイト CREATIVE VILLAGE

Full Control Lattice Generator v1.0 | 3D...

インダストリアルデザイナーのMehmet Kala氏が、閉じた形状内部に3Dプリント向けラティス構造を生成し、変形しやすい方向まで調整できるBlenderアドオン「Full Control Latt…

続きを読む

立体絵画教室, Blender & Deep Paintで描く3Dアート...

GAKU氏による6週間の短期間集中型のBlenderオンラインライブワークショップ『立体絵画教室, Blender & Deep Paintで描く3Dアート』が2026年10月に開催されます…

続きを読む

meshoptimizer 1.3 | 新しいVoxel Remesherでメッ...

Arseny Kapoulkine氏が、メッシュの最適化・簡略化・圧縮などに利用できるオープンソースライブラリ「meshoptimizer 1.3」をリリースしました。新たにVoxel Remesh…

続きを読む

math v0.1.0 | WebGL・WebGPU・Wasmなどで活用できる高...

Poimandres( @pmndrs )&Isaac Mason 氏( @isaac_mason_ )による、WebGLやWebGPU、Wasmなどを使ったWebコンテンツ向けに設計された高速&軽…

続きを読む

ProxyPose: 6-DoF Pose Tracking via Video...

University of TorontoとVector InstituteのRuihang Zhang氏らの研究チームが、単眼RGB動画と最初のフレーム上の1点から、対象の6DoFポーズを追跡でき…

続きを読む

MDM: Human Motion Diffusion Model - テキストから人物モーションの生成や合成が可能な技術が登場!

この記事は約2分9秒で読めます

テキストから人物モーションの生成や合成が可能な技術「MDM: Human Motion Diffusion Model」が登場!

2022/10/07 – Githubにてコードが公開されたのでリンクを追加

MDM: Human Motion Diffusion Model

自然で表現力豊かな人間の動きを生成することは、コンピュータ・アニメーションの聖域である。しかし、動きには多様性があり、それに対する人間の知覚的な感度や、正確な描写の難しさから、難しい課題となっています。そのため、現在の生成ソリューションは、低品質であるか、表現力に限界がある。他の領域で既に顕著な生成能力を示している拡散モデルは、その多対多の性質から人間の運動に対する有望な候補であるが、リソースを消費し、制御が困難な傾向がある。本論文では、分類器を用いない拡散ベースの生成モデルを人体運動領域用に慎重に適応させたMotion Diffusion Model (MDM)を紹介する。MDMはモーション生成の文献からの洞察を組み合わせた変換器ベースである。注目すべきデザインチョイスは、各拡散ステップにおいて、ノイズではなく、サンプルを予測することである。これにより、足の接触損失など、運動の位置と速度に関する確立された幾何学的損失の利用が容易になる。我々が示すように、MDMは汎用的なアプローチであり、異なる条件付けのモードや、異なる生成タスクが可能である。我々は、我々のモデルが軽量なリソースで学習可能でありながら、テキストからモーション、アクションからモーションの主要なベンチマークにおいて最先端の結果を達成することを示す。

MDMフレームワークは、様々な条件付けを可能にする汎用的な設計になっている。本発表では、テキストからモーション、アクションからモーション、そして無条件生成の3つのタスクを紹介する。MDMは、多様性と忠実性をトレードオフにする分類器不要の方法で学習し、同じモデルから条件付きと無条件の両方をサンプリングすることが可能である。テキストからモーションへの変換では、HumanML3DおよびKITベンチマークにおいて最先端の結果を達成し、一貫性のあるモーションを生成することができた。また、ユーザ調査の結果、人間の評価者は42%の確率で、生成したモーションを実モーションよりも好むことがわかった。また、Action-to-Motionでは、HumanAct12とUESTCのベンチマークにおいて、MDMはこのタスクのために特別に設計されたにもかかわらず、最先端技術を上回る性能を示した。

論文のみ公開、ソースコードはComming Soonとなっております。2022年10月7日にGithubにてソースコードも公開されました。この技術がどう発展していくのか、とても楽しみです。今後レイアウトなどもテキストで指定出来るようになれば、テキストだけで3Dドラマみたいなものが作れるようになりそうですね。

リンク

Screenshot of guytevet.github.io


PR

関連記事

  1. Runway Gen-3 Alpha - テキストから高品質な動画を生成出来るモデルの新バージョン「Gen-3 Alpha」をサブスクユーザー向けに公開!

    2024-07-02

  2. NormalmapLighting - とりにく氏による線画から法線マップを生成&ライティングが出来るAI活用アプリ!fanboxにてアーリアクセス開始!4月6日には一般公開予定!

    2024-04-04

  3. Runway Gen-1 - テキストで指定した通りに動画のスタイルを変更可能なAIモデルが一般公開!無料お試し可能!次期モデル「Gen-2」のトレーラーも公開中!

    2023-03-28

  4. RigNet - ディープラーニングを活用しモデルへのスキニングを自動で行う技術のソースコードが公開!

    2020-10-22

コメントをお待ちしています。

コメント

日本語が含まれない投稿は無視されます。-Posts that do not include the Japanese will be ignored-(スパム対策-anti Spam-)

3D人-3dnchu-

3D/2D/VR/GAME/AIなどのCGに関連する個人的に気になる情報をほぼ毎日紹介!XやYoutubeなども是非フォローよろしくお願いします!
※当サイトのリンクにはアフィリエイトを含みます

※当サイトの一部記事にはアフィリエイトが含まれております。

スポンサープロダクト


X-Ray Realtime Light and TexturingTool

CGElementaryに関する記事一覧


Character Creator - アニメーション、ゲーム、AR/VR のための 3D キャラメイクソフト

Reallusionに関する記事一覧


Paintstorm Studio

Paintstorm Studioに関する記事一覧


MarvelousDesigner

MarvelousDesignerに関する記事一覧


JangaFX - Real-Time VFX Software For Real-Time VFX Artists

JangaFXに関する記事一覧


パルミーの講座が見放題!月謝制お申し込み|お絵かき講座パルミー

Palmieに関する記事一覧


AAA Character Creation: The Boxing Bunny

WINGFOXに関する記事一覧


アーカイブ

カテゴリ

おすすめ商品Pickup

注目の記事

PR


PR






Donate

   
USD
3D人のLINEアカウントを作りました!
友だち追加




おすすめ商品Pickup

おすすめ記事

ページ上部へ戻る