2026年9月23日(水)
トップ › テクノロジー › 記事
テクノロジー

アリババ、新画像AI「Qwen-Image-2.1」を発表 オープンソースで画像生成・編集を統合

2026年9月23日 09:13
アリババ、新画像AI「Qwen-Image-2.1」を発表 オープンソースで画像生成・編集を統合

アリババは、新しい画像生成モデル「Qwen-Image-2.1」を発表した。同社の説明によると、このモデルはゼロからのコンテンツ生成と既存画像の編集機能を一つの枠組みに統合している。オープンソースとして公開されたモデルは、32のSingle-Stream DiT層と70億のパラメータを含む。アリババは、このアーキテクチャが品質とコストのバランスを取るように設計されていると述べている。

モデルの注目すべき特徴の一つは、KVキャッシュにより指示を最初のステップで処理し、その後の段階で直接利用できる点だ。これにより不要な計算を防ぎ、メモリ消費を抑える。KVキャッシュは、モデルが必要とする情報を一時的に保存するシステムと定義されている。

Qwen-Image-2.1は、ユーザーの要求に応じて通常またはアルファ出力を生成できる。透明レイヤーを編集し、表情を変更し、新しいテキストを追加し、実写真内の人物をRGBAレイヤーとして抽出できる。この機能により、デザイン要素を後のコンポジションで再利用しやすくなる。

編集面では、システムは同時に10枚の参照画像を利用でき、異なる要素を一つのコンポジションにまとめられる。モデルは、画像の特定の部分のみを変更できる。編集する領域は円、塗りつぶしマーク、または別のマスクで選択できる。指定した領域を変更しつつ、シーンの残りは保持される。パノラマ、インフォグラフィック、ストーリーボードの生成も対応機能に含まれる。タイポグラフィ、ポートレート照明、細部が改善されたとされている。

アリババの主張によると、Qwen-Image-2.1は性能でNano Bananaを上回っている。

文=トルコニュース編集部
出典:cnnturk.com

関連記事