本文へスキップ
MameTechNews
AI

Alibaba、8ステップで生成・編集するQwen-Image-2.1-Turboを公開 ステップ数はチェックポイント側で固定

## POINTS

  • 7Bの生成・編集モデルを8ステップに高速化。既定は2K解像度、CFG=1、prefix KVキャッシュ
  • 8ステップのスケジュールはチェックポイント保存で、num_inference_stepsでは変わらずsigmasの明示が必要
  • X上では基のモデル比2.4〜3.7倍速いとの報告。RTX 5090やMac Studioでのローカル推論例もある

AlibabaのQwenチームは2026年10月9日、Qwen-Image-2.1の高速版チェックポイントQwen-Image-2.1-TurboをHugging Face(Qwen/Qwen-Image-2.1-Turbo)で公開した。基のモデルと同じ7Bの画像生成アーキテクチャで、テキストからの画像生成と画像編集の両方に対応し、ノイズ除去を8ステップで行う。基のモデルの例は40ステップで、既定の解像度はどちらも2048×2048の2K。利用にはDiffusersのソース版に入ったQwenImage21Pipelineを使う。注意点として、推奨の8ステップのサンプリングスケジュールはチェックポイントに保存されて自動で読み込まれ、num_inference_stepsを指定してもスケジュールは変わらない。変えるには呼び出し時にsigmasを明示する必要があり、他のスケジュールは評価されていない。既定はCFG=1で、テキストと参照画像の文脈をステップ間で再利用するprefix KVキャッシュを使う。X上の利用者からは、基のモデルより2.4〜3.7倍速く、文字描画では同等以上の品質との報告がある。量子化版は2.6GBから14.2GBまで出回っており、RTX 5090やMac Studioでのローカル推論も報告されている。