COYOTE スタジオ採用説明会 | クリエイターのための総合情報サイト CREATIVE VILLAGE

VoiceStudio | 音声クローンや動画吹き替えをローカル環境で実行!64...

Debpalash氏らが開発する音声クローン、音声生成、動画吹き替え、文字起こし、オーディオブック制作などをローカル環境で利用できるオープンソースのAI音声スタジオ「VoiceStudio(旧Omn…

続きを読む

AC9 Cloth Retopo v1.1 | CLOやMarvelous De...

牛山氏( @naoki_ushiyama )が、CLOやMarvelous Designerで作成した衣装メッシュを2D型紙ベースでリトポロジーできる無料Blenderアドオン「AC9 Cloth …

続きを読む

NeXus MPM Tech Preview | Cinema 4DとBlend...

INSYDIUMが、Cinema 4DとBlender向けGPUシミュレーションツール「NeXus」に導入予定の新しいMPM(Material Point Method)ソルバーのプレビュー動画公開…

続きを読む

Ragdoll for Web | 物理シミュレーションで人形のようにキャラクタ...

Ragdoll Dynamicsは、物理ベースのキャラクターアニメーションツール「Ragdoll」をWebブラウザ上から利用できる「Ragdoll for Web」を公開しました。R…

続きを読む

OVERGROWN Teaser | Blender Studioが手掛ける長編...

Blender Studioが現在制作中の短編映画『OVERGROWN』のティザートレーラーが公開!Blenderを使用し絵画的なNPRの探求した作品となっております。OVERGRO…

続きを読む

CommonSim-1 - AIの力で画像やアクション、テキストなどから適切な3Dコンテンツを生成するニューラル・シミュレーション・エンジンが登場!

この記事は約3分25秒で読めます

CSM(Common Sense Machines)にゆよる、画像、行動、テキストで制御するニューラル・シミュレーション・エンジン「CommonSim-1」が登場!

CommonSim-1

Generative AIでは、多様な人間の経験や文化を大規模なモデルに圧縮する必要があります。実際、最近の大規模な生成モデル(Dall-E 2、StableDiffusion、Imagen、Make-A-Sceneなど)は、全く新しいイメージをゼロから作り出すという目覚ましい成果を上げている。このような流れの中で、AIシステムは、3Dモデル、長周期映像、効率的なアクションを生成することを学習する新しいクラスのシミュレータを作成することが自然な進化であると言えます。これらの技術は、ニューラルレンダリング、拡散モデル、および注意アーキテクチャの最近の進歩により、実現可能になりつつある。

Common Sense Machinesは、CommonSim-1と呼ばれるニューラル・シミュレーション・エンジンを構築しました。ユーザーやロボットは、コンテンツを作成したり、複雑なツールを操作するのに何週間も費やす代わりに、画像、アクション、テキストを通じてCommonSim-1と対話します。これらのインターフェースにより、写真を撮ったり、テキストで情景を描写したりするだけで、現実世界のデジタルレプリカを作成したり、新しい世界を想像したりすることができます。本日、これらのモデル機能をプレビューしています。開発者、クリエイター、研究者、その他の方々がどのような作品を作ることができるのか、今からとても楽しみです。

  • CommonSim-1: 経験から成長し適応するシミュレーター:新しいシミュレーション エンジンには、新しいインターフェイスが必要です。専用ツールの代わりに、、画像、言語、アクションで操作します。誰でもモデルにアクセスできるモバイルとウェブのインターフェース、ツールプラグインやREST API
  • 動画生成:わずか1フレームと一連の動作(カメラや体の動き)から高解像度の動画(512×512)を生成
    適切なデータがあれば、同じアーキテクチャをトレーニングして、多くの実施形態 (カメラ、ロボット、自動車など) にわたるタスクを解決できます。
  • 3Dコンテンツ生成:オブジェクトの動画をアップロードしクラウド上で処理。
    ユニバーサル3Dファイルフォーマット(obj, usdz, blend, glTFなど)やNeural Radiance Fields(NeRF)に簡単にエクスポート
  • これらの3Dアセットを既存の3Dエンジンにインポートして、シーンの合成やレンダリングが可能。ハイブリッド・レンダラー(現在Blenderに対応、今後対応予定)により、NeRFを従来の3Dアセットと合成

ニューラル言語は、像上の状況を記述するための強力な手段である。例えば、椅子の3Dモデルを持っていて、それを全く新しい環境でレンダリングしようとした場合、満足のいく結果を得るには、通常、数日から数週間かかるでしょう。テキスト・トゥ・イメージ・モデルは、このプロセスを自動化することができます。CommonSim-1で生成したメッシュやNeRFを使い、テキストプロンプトに自然言語で説明を入力すれば、新しいハイブリッドシーンを無制限に生成することができるのです。

これらのコンテンツ生成機構は、自動ラベル付けされた合成データを作成し、知覚システムを訓練するのに十分な精度と柔軟性を備えています。

ここでは、検出、セグメンテーション、6自由度ポーズトラッキングのためのエンドツーエンドのビジョンシステムの例を紹介します。このシステムは、人間が注釈を付けたデータや人間が作成したモデルを一切使わずにトレーニングされました。私たちはこれらのシステムを、食料品店、倉庫、工場、研究所、医療現場などの対象物でテストしました。

こういった3DCG制作の根本が変わってきそうだ…。
現在はアプリケーション、API、チェックポイント、コードへの早期アクセスのサインアップが可能とのこと。気になる方は是非チェックしてみてください。

リンク

Screenshot of csm.ai

PR

関連記事

  1. Imagen Video - Google ResearchによるテキストからHD 1280x768 24fpsの動画を生成する技術!サンプル動画と論文が公開!

    2022-10-06

  2. DuetGen - 音楽駆動による二人のペアダンスモーション生成システム!音楽とシナジーするインタラクティブなダンスを自動生成!

    2025-07-26

  3. DeepMotion Neuron - AIを使ったキャラクターモーション生成ツール!2018年第4四半期にリリース予定!

    2018-08-09

  4. MeshTailor: Cutting Seams via Generative Mesh Traversal | プロの制作したUVシーム設定データでトレーニングされたUVシーム設定のためのフレームワーク!

    2026-04-06

コメントをお待ちしています。

コメント

日本語が含まれない投稿は無視されます。-Posts that do not include the Japanese will be ignored-(スパム対策-anti Spam-)

3D人-3dnchu-

3D/2D/VR/GAME/AIなどのCGに関連する個人的に気になる情報をほぼ毎日紹介!XやYoutubeなども是非フォローよろしくお願いします!
※当サイトのリンクにはアフィリエイトを含みます

※当サイトの一部記事にはアフィリエイトが含まれております。

スポンサープロダクト


X-Ray Realtime Light and TexturingTool

CGElementaryに関する記事一覧


Character Creator - アニメーション、ゲーム、AR/VR のための 3D キャラメイクソフト

Reallusionに関する記事一覧


Paintstorm Studio

Paintstorm Studioに関する記事一覧


MarvelousDesigner

MarvelousDesignerに関する記事一覧


JangaFX - Real-Time VFX Software For Real-Time VFX Artists

JangaFXに関する記事一覧


パルミーの講座が見放題!月謝制お申し込み|お絵かき講座パルミー

Palmieに関する記事一覧


AAA Character Creation: The Boxing Bunny

WINGFOXに関する記事一覧


アーカイブ

カテゴリ

おすすめ商品Pickup

注目の記事

PR


PR






Donate

   
USD
3D人のLINEアカウントを作りました!
友だち追加




おすすめ商品Pickup

おすすめ記事

ページ上部へ戻る