動察Beatingのモニタリングによると、Metaは超スマートラボが開発した画像生成モデル「Muse Image」を発表した。テキストを直接ピクセルにマッピングする従来のモデルとは異なり、デザインエージェントに似た行動パターンを持つ。
このモデルは、先日発表されたMuse Spark言語モデルと連携して動作する。描画前に、まず構図案を作成する。プロンプトに事実情報が必要な場合は、正確性を確保するためにウェブを検索する。正確なレイアウトが必要な場合は、画像内に直接読み取り可能なテキストをレンダリングし、カスタムプロンプトに基づいて本物のQRコードを構築する。
ユーザーはマーク機能を使って画像上に直接円を描いたり注釈を付けたりすることで、モデルにコンテキストを理解させ、局所的な詳細を微調整させることができ、画像全体を再生成する必要はない。
Muse Imageは現在Meta AIアプリケーションで利用可能であり、日常的な創作は無料で使用できる。より高度な創作ニーズは有料サブスクリプションを通じてアンロックする必要がある。また、今後はAdvantage+広告クリエイティブなどの商用システムにも順次導入される予定である。