メインコンテンツまでスキップ

「AI UGC」タグの記事が1件件あります

全てのタグを見る

AI UGC 3D速成?2秒でプロ級3Dモデルを生成、アリババとバイドゥがVASTに注力

· 約23分

この記事は「ゲームアーティスト Game Art」から転載許可を得ています。

新たな中国AI分野のスタートアップ企業が資金調達を実現。

3月5日、汎用人工知能(AGI)企業VASTは5000万ドルのシリーズA資金調達の完了を発表した。昨年6月に数千万ドルのpre-A+ラウンドを完了してから9ヵ月も経っていない。

今回の資金調達ラウンドは、アリババ(阿里)と恒旭キャピタル(恒旭资本)が共同リード投資家を務め、ユエンホー・プーファ(元禾璞华)、BVバイドゥベンチャーズ(BV百度风投)、東方嘉富(Dongfang Jiafu)などがフォローした。投資陣容はトップキャピタル、業界大手、有名な戦略的投資家をカバーしている。さらに、既存株主である春華ベンチャーズ(春华创投)と北京市AI産業投資基金(北京市人工智能产业投资基金)が追加出資を行った。

VASTの創業者兼CEOの宋亚宸(ソン・アーチェン)は、かつて商湯科技(ショウタン・テクノロジー)に在籍し、複数のAIプロジェクトの戦略分析と商業化を担当し、MiniMaxの創業にも参加した。2023年、宋亚宸はVASTを設立し、自社開発のAI 3Dおよび世界モデルを基盤に、大衆向けのインタラクティブコンテンツ制作能力を構築し、全民的な創造の平等をリードし、最終的にはインタラクティブな世界コンテンツプラットフォームを構築することを目指している。現在、VASTはグローバルなマルチモーダル分野において、基礎モデルの研究開発からアプリケーションエコシステムの構築に至るまでのフルスタックのトップ企業に成長している。

公式情報によると、自社開発の3D基盤大規模モデルは業界をリードし続けており、エコシステムの協力はアリババ、テンセント、バイトダンス、ネトイース、上海自動車(上汽)、拓竹(タクチク)、優必選(ユービーシェン)などのトップ企業と9万以上の開発者をカバーしている。傘下のTripo Studioプラットフォームには650万人以上のクリエイターが集まり、累計で1億近くの3Dモデルを生成している。

今回の投資について、恒旭キャピタルは次のように述べている。「当社はAI技術を評価する際、常に一つの核心的な問いを中心に考えています。それは、本当に実装され、価値を創造できるかどうかです。VASTの3D生成ソリューションが示す技術成熟度と製品完成度には感銘を受けました。効果が優れているだけでなく、より重要なのは「使える」ことです。」

BVバイドゥベンチャーズ側も次のように述べている。「3D生成は未来の仮想世界の重要な基盤であり、マルチモーダル生成と世界モデルの重要な方向性でもあります。動画生成と比較して、3Dは物理法則、空間関係、物体インタラクションの論理を自然に内包しており、AIが現実世界を理解しシミュレーションするための重要な経路です。これまで業界における3Dモダリティへの注目度は動画ほどではありませんでしたが、現在、3D生成は技術的ブレイクスルーと商業化において重要な質的変化を迎えており、まさに投資の黄金の機会です。」

資金調達情報の公式発表と同時に、VASTは新しいAI 3D大規模モデルファミリーを発表した。

改良されたTripo H3.1は、入力アライメント、構造精度、テクスチャ品質、生成速度などの各コア指標で業界トップを維持している。全く新しいアーキテクチャのTripo P1.0は、AI 3Dのアルゴリズムパラダイムを再定義し、2秒以内にプロのモデラーレベルの3Dアセットを出力でき、既存のソリューションと比較して速度が100倍以上向上している。

さらに、これまでに蓄積されたデータ、人材、システムレベルの研究開発およびエンジニアリング経験に基づき、VASTは2025年に世界モデルの研究開発を重点的に進めており、最初の世界モデルも近くリリースされる予定である。

関係者によると、今回の資金は世界モデルにおけるトップ人材の採用、コアアルゴリズムの継続的な反復、データ蓄積に重点的に投入されるとともに、UGCインタラクティブコンテンツプラットフォームの構築を強力に推進する。これにより、「すべての人がインタラクティブコンテンツを作成、体験、共有できるようにし、インタラクティブコンテンツをデジタル世界と物理世界を結ぶ新しい情報媒体とする」というビジョンをより良く実現する。

3D生成のUGC
より大衆的な段階へ

VASTを設立したとき、宋亚宸は、インタラクティブコンテンツの制作ハードルが十分に低くなれば、UGCインタラクティブコンテンツは新しい段階に入ると考えていた。

現在、この判断は検証され始めており、そのペースは予想よりも速い。

• 650万人以上のクリエイターがTripo Studioで作品を制作し、累計で1億近くの3Dモデルを生成している。 • 9万以上の企業向け開発者とパートナーがTripoの機能を自社の製品やワークフローに統合している。 • Blender、MayaからUnity、Unrealに至るまで、エコシステムプラグインは主要な3D制作ツールとコンテンツエンジンをカバーしている。 • スマート製造、インタラクティブエンターテインメント、仮想現実、具身智能(身体を持つ知能)などの分野で、Tripoは3Dコンテンツ生成のデフォルト機能になりつつある。

これらの数字の意義は、規模そのものではなく、行動構造の変化にある。

これまで3Dモデリングに触れたことのなかったユーザーが、高頻度で軽量な方法で3D生成ツールを使い始めている。モデル生成のプロセスは、日常的な表現習慣に近づきつつある——即時生成、即時表現、即時共有。3Dはもはやプロの制作フローに限定されず、大衆の創作コンテキストに入り始めている。

この変化をめぐり、VASTはクリエイターエコシステムの構築を続け、コミュニティとともにインタラクティブコンテンツの形態の境界を探求している。その内容は以下の通りである。

Tripo Ambassador Programは世界30カ国以上、50以上の大学をカバーしている。Game Hubコミュニティには10万人以上のアクティブな開発者が集まり、累計2000以上のAIインタラクティブコンテンツが生み出されている。AI 3DレンダリングコンテストS2のTop25作品は、ニューヨークのタイムズスクエアや世界中の複数の主要ランドマークに掲出された。初のTripo AI 3D Game Jamは開始早々、同種のグローバルコンテストで最多の作品応募を集め、最終選考作品はGDCで展示される。

過去1年間、VASTは3大陸、30以上の都市に分散する開発者、クリエイター、企業パートナーと、同じ問いを繰り返し議論してきた。それは、3D生成効率が臨界点を超えたとき、インタラクティブコンテンツはどのように進化するかということだ。

同時に、Tripoはより広範なAIプロダクションシステムに組み込まれている。初期段階では、VASTが先駆けてComfyUIとのノードレベル統合を実現し、3D機能をマルチモーダル生成パイプラインに組み込んだ。その後、MCPなどのモデルコンテキストプロトコルを初めてサポートし、3D生成の呼び出しとオーケストレーションを可能にした。現在、Tripoのモデル機能は次世代エージェントエコシステムにおいてスキル(Skills)として接続され、エージェントが3Dアセットの生成、呼び出し、編集を行えるようにしている。

これにより、3D機能はもはや人間のクリエイターだけのものではなくなった。

エージェントコラボレーションが新たな基本的な生産方式になりつつあるトレンドの中で、3D生成はエージェントの標準的な能力セットになり始めている。自動コンテンツ生成、ゲーム構築、仮想シーン構築、ECサイトやインタラクティブシステム向けアセット生産に至るまで、3DはAIシステムの空間表現モジュールになりつつある。

創作コストが下がり、人間のクリエイターとエージェントの両方が空間生成能力を持ち、創作頻度が上がり、エコシステムの密度が閾値に達すれば、新たなコンテンツ形態は条件が整ったときに自然に現れるだろう。

VASTはこのことから、3D生成が専門的なプロダクションツールから大衆の表現言語に変わる臨界点が近づいていると判断している。

そのために、VASTは2026年にUGCインタラクティブコンテンツプラットフォームの構築を加速し、生成能力、配信メカニズム、インタラクティブシステムを統合した完全なループを形成し、3D創作を単一アセットの生産から進化し続けるインタラクティブコンテンツの創造へと変えると表明している。

技術的障壁:AI 3Dアルゴリズムパラダイムの再定義

実際、設立当初からVASTは「すべての人が自分自身のインタラクティブな世界を創造できる」というビジョンを掲げていた。そしてこのビジョンを実現する鍵は、UGC、インタラクション、3D世界という3つの次元にある。

創業当初、チームは「世界」から直接始めようと試みたが、すぐに根本的な矛盾に気づいた。それは、インタラクティブコンテンツの制作コストとハードルが極めて高いということだ。3Aレベルのインタラクティブコンテンツを制作するには、多くの人手、時間、コストが必要となる。創作のハードルが、コンテンツ消費の形態と多様性の上限を決定づけている。

そこでVASTは、まず根本的な問題を解決し、AIでインタラクティブコンテンツの生産方法を再定義することを選んだ。

まず、チームが提案したSparseFlex表現方式は、モデルのディテール、開放面、内部ジオメトリ構造を正確に捉えられるだけでなく、より効率的な学習戦略をサポートし、メモリ使用量を大幅に削減し、AI生成の3Dモデルをユーザー体験と大規模商業応用において真に産業利用可能なものにしている。

アップデートされたTripo H3.1はさらに進んでおり、入力参照画像の再現度とアライメントが向上し、全体構造と局部詳細の両方でトップクラスの表現効果を実現している。キャラクターの形状、顔、幾何学テキストなど様々なケースにおいて、これまでの課題を解決した。

VASTはこのフラッグシップモデルに関して総合的な横断評価テストを実施した。結果は、フォントの浮き彫り、顔の五官、複雑な機械構造など、いずれにおいてもTripo H3.1が入力アライメント、構造精度、テクスチャ品質、生成速度などの各コア指標で業界トップを達成していることを示している。

UGCインタラクティブコンテンツにとって、精度だけでは十分ではない。クリエイターには「速さ」と「すぐに使えること」がより求められる。高品質かつ高効率であると同時に、エンジンパイプライン内でリアルタイムに実装できる必要がある。

しかし品質と速度の間には長期的な構造的緊張関係が存在する。精度を追求すれば生成時間が長くなり、速度を追求すれば構造や詳細が犠牲になりがちだ。トポロジー構造、幾何精度、テクスチャ品質、エンジン互換性、編集可能性——ある問題を解決するたびに、別の問題を犠牲にすることが多い。

これが、AI 3DがPGCの産業応用からスケーラブルなUGCインタラクティブコンテンツへ移行する上での重要なボトルネックとなっている。

そのため、VASTのアルゴリズムチームは大胆かつ根本的な選択を行った。それは、AI 3D大規模モデルをゼロから再構築するというものである。第一原理から出発し、従来の路線で限界的な最適化を行うだけでなく、全く新しい思考方法、全く新しいアルゴリズムフレームワークで、3Dがどのように表現されるべきか、どのように生成されるべきかを再考した。

これがTripo Pシリーズ誕生の背景である。このシリーズのリリースは、AI 3D大規模モデルのアルゴリズムパラダイムが2.0段階に入ったことを意味する。速度、品質、工学的可用性が同時に成立し始めたのである。

具体的には、既存の3次元メッシュ生成はシーケンシャル化の妥協に悩まされることが多い。長大なシーケンシャルデータが生成効率を著しく制約し、一方向の因果バイアスが空間のグローバルなインタラクションを阻害している。Tripo P1.0は、空間生成の基本的パラダイムを初めて再構築した。そのSmart Mesh機能はTripo Studioプラットフォームですでに利用可能である。

Tripo P1.0は3次元オブジェクトの局所計算を放棄し、代わりに統一されたネイティブな確率空間を構築する。モデルは次の点を「予測」するのではなく、空間全体の構造に対してマクロな確率収縮を行う。モデルはまずノイズ空間から形体を構築する「基底」を析出し、その後、複雑なトポロジー関係が基底に依存しながら統一確率空間内で進化する。

この全く新しい空間モデリング哲学により、Tripo P1.0は次元構築の壁を打ち破った。それは無秩序なノイズ空間において直接、高次元情報の瞬時のアライメントを実現し、極めて複雑な3次元トポロジー構造を同期的に「収束」させて成形し、局所的な断片の接合からグローバルな創発への根本的な飛躍を実現した。

最終的な結果は、Tripo P1.0が2秒以内にプロのモデラーレベルの3Dモデルを直接生成できるということである。トポロジーはクリーンで、配線は安定し、エンジンで使用可能である。

さらにVASTは、この全く新しいアプローチの下で、モデルの編集可能性と精度の拡張性が極めて高い最適化の可能性を得ることを発見した。

物体創造から世界創造へ,AI 3Dの未来進化

物体を理解し生成することから、世界全体を理解し生成することへ。それがVASTが一貫して堅持してきた技術と製品の路線である。

設立当初、VASTは最も原始的で自然であり、情報密度が最も高いコンテンツモダリティである3Dに焦点を当てた。当時からVASTは明確にしていた。世界モデルは汎用モデルの究極形態であり、三次元空間のネイティブな理解の上に構築されなければならない、と。

2025年、VASTは中核的な研究開発リソースを世界モデルの方向に投入している。これまでに蓄積された5000万件の高品質な3Dおよび世界モデルデータベース、世界的に見ても最高のAIとグラフィックスのクロスチームの人材密度、そして業界の先駆者として三次元理解生成分野で蓄積したシステムレベルの研究開発およびエンジニアリング経験が、この路線におけるVASTの独自の優位性を構成している。

VASTは汎用世界モデルの構築に取り組んでいる。このモデルはインタラクティブな仮想世界を生成できるだけでなく、知覚、理解、物理推論の能力を備え、次世代のインタラクティブコンテンツ、身体を持つ知能(具身智能)、シミュレーションなど、より幅広いシナリオに広く貢献することができる。

このような投資は、VASTがAI 3Dと世界モデルの間に深い関連性があると信じていることに基づいている。前者は後者にとって避けて通れない基盤であり、3Dは機械と人間の共通インターフェースでもある。世界モデルが最終的にどのような形で実現されるにせよ、三次元空間のネイティブな理解と生成能力は重要な構成要素である。

VASTの創業者兼CEOである宋亚宸の見解では、「先に見る」よりも「先に信じる」ことを選択することが、スタートアップ企業が大規模プラットフォームと異なる本質であり、先行者利益を築く鍵である。

AI 3Dはかつて、高投資で不確実性に満ちた市場と見なされていた。2023年にVASTが設立されたとき、業界には収束した模範となる道筋も成熟した技術フレームワークもなく、そのため多くの人はこの困難な挑戦の道を選ばなかった。

3年間、VASTは継続的な投資を通じて、アルゴリズムの業界標準の上限を押し上げ、クリエイターの参入障壁を下げ、産業の利用可能な境界を広げることに貢献してきた。

現在、650万人以上のクリエイターがVASTが構築したエコシステム上で創作を行い、9万以上の企業や開発者がここでアプリケーションを構築している。そしてVASTの一人ひとりのユーザーが、逆に技術をより成熟させ、製品をより完成度の高いものにし、創作のハードルをより低くし、コンテンツ消費の想像力をより豊かにし、後続の挑戦者のスタート地点をより高くしている。個人の創造が集まることで、最終的にシステム全体のエコシステムが変わるのである。

AI 3Dに対する投資家の判断と考察

ヘンシューキャピタル:

我々はAI技術を評価する際、常に一つの核心的な問いを中心に考えています。それは、本当に実装され、価値を創造できるかどうかです。VASTの3D生成ソリューションが示す技術成熟度と製品完成度には感銘を受けました。効果が優れているだけでなく、より重要なのは「使える」ことです。自動車設計から身体を持つ知能のシミュレーション、産業デジタルツインからスマート製造に至るまで、3Dコンテンツの効率的な生成は、仮想と現実の融合を実現する鍵です。VASTのパイプラインはすでにreadyであり、技術は検証されており、まさに我々が探していた「AIが産業をエンパワーする」理想的な対象です。世界モデルのブレイクスルーが人間と物理世界の相互作用の方法を再定義し、VASTはその変革の最先端に立っていると信じています。

ユエンホー・プーファ:

各コンテンツプラットフォームの進化の過程を振り返ると、PGCからPUGC、UGCへの移行は、しばしば制作ツールの根本的な変革を必要としてきました。バイトダンス(字节跳动)は推薦アルゴリズムと低ハードルツールによってショート動画の制作と配信を再定義しました。VASTは同じことを行っており、3D創作のハードルをかつてないほど低くしています。そこには、全く新しいUGCインタラクティブコンテンツプラットフォームを孵化させる可能性が秘められています。我々はVASTの「誰でも3Dを創作できる」という初心とビジョンを深く評価しており、今日の彼らはすでに活発なクリエイターの一群を集め、独特なコミュニティ文化を形成しています。特にVASTのtoC方向への汎化能力を期待しています。AI 3D創作はすぐにショート動画を撮るのと同じくらい簡単になり、関連するコンテンツエコシステムは爆発的に成長するでしょう。VASTが世界モデルという鍵を使って、次世代のインタラクティブコンテンツプラットフォームの扉を開くと信じています。

BVバイドゥベンチャーズ:

3D生成は未来の仮想世界の重要な基盤であり、マルチモーダル生成と世界モデルの重要な方向性でもあります。動画生成と比較して、3Dは物理法則、空間関係、物体インタラクションの論理を自然に内包しており、AIが現実世界を理解しシミュレーションするための重要な経路です。これまで業界における3Dモダリティへの注目度は動画ほどではありませんでしたが、現在、3D生成は技術的ブレイクスルーと商業化において重要な質的変化を迎えており、まさに投資の黄金の機会です。

李飞飞(リー・フェイフェイ)のWorld Labsから、Luma、Googleなどの企業が相次いで布石を打つ中、世界モデルはAIの重要な発展方向となっています。我々は、VASTが国内において突出した優位性を持ち、世界モデルに深く取り組む優れたチームであると信じています。堅実な技術力と製品化能力を兼ね備え、同時に制作ツールとコンテンツプラットフォームを展開し、データ蓄積とビジネス展開においてポジティブな成長ループを形成しています。

我々はVASTが高品質な3Dデータを活用した差別化優位性を構築し、グローバルな生成系AI分野で競争力と長期的な成長可能性を維持することを引き続き期待しています。

春華ベンチャーズ:

VASTの初期投資家として、我々はチームが技術的ブレイクスルーから商業的検証に至るまでの完全なプロセスを目の当たりにしてきました。今回の追加投資を選択したのは、過去1年間の会社のビジネス発展スピードが予想をはるかに上回っていたためです。収益成長とユーザーデータの両方で力強い勢いを示しています。さらに興奮したのは、VASTが創業当初から掲げていたビジョン——UGCインタラクティブコンテンツプラットフォームの構築——が現実のものとなりつつあることです。世界モデル技術の継続的なブレイクスルーに伴い、3D創作の大衆化はもはや遠い未来ではなく、手の届く現在となっています。我々はVASTがこの世代交代の変革においてリーダーになることを確信しています。

北京市AI産業投資基金:

前回の投資に続き、我々はVASTに追加投資を行いました。その理由は、チームの実行力と技術的リーダーシップを評価したからです。過去半年間、VASTの商業化進捗は予想を上回り、3Dプリント、工業デザイン、カルチャー&エンターテインメントなど複数の分野で規模化された応用を実現し、収益は爆発的に成長しました。智譜(Zhipu)が中国のAI企業による基礎大規模モデル分野でのグローバル競争力を代表するなら、VASTは3Dおよび世界モデル分野で同様の物語を紡いでいます。北京市が重点的に支援するAIモデル層企業として、VASTは技術革新の最先端を代表するだけでなく、AIが新たな生産性を強化し、デジタル経済と実体経済の深い融合を推進する典型的な事例です。我々はVASTが業界のリーダーシップを発揮し続け、中国の人工知能産業がグローバル競争でより大きな発言権を得ることに貢献することを期待しています。