11月14日、テンセント・フンユアンの公式WeChatアカウントによると、LiblibAIはテンセント・フンユアン・イメージ30(HunyuanImage 30)およびテンセント・ユートゥーの動画エフェクトモデルYoutu-Video FXを正式にリリースし、より強力で多様なモデル機能により、プラットフォーム上の数千万人の画像クリエイターが豊かな発想を生み出し、効率的に創作できるよう支援すると発表しました
LiblibAIは中国最大のAIコンテンツ制作プラットフォームで、専門的なシーンにおけるAIによるコンテンツの制作と共有を推進し、クリエイティブなプロフェッショナルに、専門的で信頼性が高く、効率的なAI時代の制作ツールを提供していますLiblibAIのモデルや画像クリエイターはすでに2,000万人を超え、日々数百万人規模の創作・交流が継続されており、ユーザーが独自にトレーニングしたオリジナルのAIモデルとワークフローは50万を超えており、累計で5億枚以上の画像が生成されています
今回リリースされたテンセント・フンユアン・イメージ30は、パラメータ規模が800億に達する、世界初のオープンソースで産業レベルのネイティブ多モーダル画像生成モデルです現時点で最も優れた性能と最大のパラメータ数を誇るオープンソースの画像生成モデルであり、その成果は業界トップクラスのクローズドソースモデルに匹敵します
フンユアン・イメージ30は常識を備え、知識を活用した推論が可能です同時に、高い意味理解精度と極めて高い美学的質感を実現し、リアルで高品質な画像を生成できますまた、数千文字に及ぶ複雑な文脈を解析して長文テキストを生成することも可能で、全体としての画像生成性能は業界をリードしています
ネイティブ多モーダルとは、技術アーキテクチャ上、一つのモデルでテキスト、画像、動画、音声など複数のモーダルの入出力を一貫して処理できることを指します従来は複数のモデルを組み合わせて画像理解や画像生成などのタスクを実行していましたが、フンユアン・イメージ30は業界初のオープンソースで産業レベルのネイティブ多モーダル画像生成モデルです
つまり、フンユアン・イメージ30は単なる画像生成モデルとしての絵画能力だけでなく、言語モデルとしての思考力と常識も備えていますまるで“頭脳”を備えた画家のように、画像のレイアウトや構図、筆致をスマートに検討し、世界の知識を活用して常識に基づいた画面構成を推論することが可能です