3Dの生成・理解・編集を統合したマルチモーダルモデル「Hunyuan3D-Buffalo 1.0」

CGソフト

2026年8月3日(現地時間) – Tencent(テンセント)は、スケーラブルな3D生成、理解、および編集を統合したマルチモーダルモデル「Hunyuan3D-Buffalo 1.0」を発表しました。

Hunyuan3D-Buffalo 1.0 パイプラインの概要

Hunyuan3D-Buffalo 1.0は、「Tencent Hunyuan3D」プロジェクトの一環として公開されたものであり、3Dの理解、テキストからの3D生成、指示ベースの3D編集、およびパーツレベルの3D生成を可能にする、統合型の3Dマルチモーダル・フレームワークです。言語、3D表現、および生成3Dモジュールを接続することにより、単一の処理パイプラインの中で多様なタスクをサポートしています。

このフレームワークは、共有の「Hunyuan3D-VLM」バックボーンを使用しています。これにより、3D空間における質疑応答(QA)、グラウンディング(言語と3Dオブジェクトの結びつけ)、生成、編集、およびパーツレベルの分解といった各タスクを橋渡ししています。

さらに、この統合された表現を基盤として「Hunyuan3D DiT」モジュールを組み合わせることで、マルチモーダル生成の拡張性(スケーラビリティ)、高品質な3D編集、および精密なパーツ生成を実現しています。

4つの主要機能

パイプラインは、主に以下の4つの機能で構成されています。

3D理解

言語に誘導された推論を活用し、3Dモデルに対する質疑応答(3D QA)とグラウンディングを実行します。

テキストから3D生成

入力されたテキストプロンプトに基づいて、新たな3Dアセットを生成することができます。

3D編集

自然言語の指示を用いて、既存の3Dオブジェクトを編集可能です。

パーツ生成

言語情報を介して、3Dモデルから意味的なパーツ(部品)を抽出および生成することができます。

メッシュ全体とすべてのパーツコンポーネントを視覚化します。これらを結合した状態だけでなく、分解図(エクスプロード表示)として表示させることもでき、モデルの構造把握にも役立ちます。

このフレームワークを使えば、ひとつのモデルで生成から編集、構造の分析までをスムーズに行えます。言葉を使った3DCG制作のプロセスを整理し、作業効率を大きく高める技術として期待されます。


その他詳しい情報はプロジェクトページへ

論文はこちらから

コメント

Translate »
タイトルとURLをコピーしました