画像生成WebUI「InvokeAI v6.14.2」公開、Z-Imageのエンコーダー制限やVRAM管理を改善

画像生成WebUI「InvokeAI v6.14.2」公開、Z-Imageのエンコーダー制限やVRAM管理を改善

基本情報

項目 内容
リポジトリ invoke-ai/InvokeAI
版 v6.14.2
公開日 2026-09-28
ライセンス Apache-2.0
出典の種類 公開元の一次情報(公式GitHubリポジトリのリリースノート)

収集・肉付けの時点で当サイトのコードが確定させた値です。日付はJST。

概要

InvokeAIのバージョン6.14.2がリリースされました。InvokeAI(invoke-ai/InvokeAI)は、Pythonで開発されているApache-2.0ライセンスのオープンソースソフトウェアで、Stable Diffusionなどの画像生成モデルを実行・操作するための高度なWebUIとクリエイティブエンジンを提供します。画像生成だけでなく、img2imgやインペインティング、アウトペインティングなど多角的な画像編集機能を備えています。

特定構成でのエラー回避や操作性の向上が含まれているため、対象モデルを利用しているユーザーやCanvas機能を活用しているユーザーはアップデートを検討すると良いでしょう。

主な変更点

Canvasテキストツールにおけるカスタムフォントのインポート対応

Canvas内のテキストツールにおいて、ユーザーが手元のカスタムフォントをインポートして使用できるようになりました。この機能は、Canvas上で生成画像に文字入れを行うクリエイターに影響します。アップデート後は、標準で用意されているフォント以外のフォントファイルを読み込ませることで、デザインの幅を広げることができます。

krea-2での参照画像によるスタイル転送機能

参照画像(Reference Image)を読み込ませることで、krea-2に画像のスタイルを転送する機能が追加されました。krea-2を利用して特定の画風やグラフィックのスタイルを維持した画像を生成したいユーザーに大きく貢献します。GUI上で参照画像を指定することでスタイル転送を適用できます。

量子化Qwen2.5-VLエンコーダーのVRAM領域確保と解放の改善

量子化されたQwen2.5-VLエンコーダーの実行時に、必要なVRAM領域をあらかじめ確保し、処理終了後に確実にVRAMを解放する仕組みが導入されました(PR #9572)。VRAM容量に制限のあるローカル環境でQwen2.5-VLエンコーダーを使用するユーザーに影響します。更新後は、生成処理後のVRAMの解放が適切に行われるため、VRAM不足によるエラーや後続処理の速度低下を防止できます。

FLUX.2 [dev] FP4 Mistralスターターモデルの削除

MistralローダーがFP4に対応していなかったため、FLUX.2 [dev] FP4 Mistralエンコーダーのスターターモデルが削除されました(PR #9587)。従来の環境では12.3 GBのモデルデータをダウンロードしても最初の生成時に形状の不一致でエラーが発生していました。この問題に遭遇していたユーザーやFLUX.2 [dev]モデルを利用するユーザーに影響します。アップデート後は選択肢からFP4が除外されます。利用者はFP8、BF16、またはGGUF形式などの対応しているバリエーションを選択してください。

Z-Imageモデルの対応エンコーダーをQwen3 4Bへ限定

Z-Imageモデルにおいて、利用できるQwen3エンコーダーが「Qwen3 4B」に制限されました(PR #9587)。Z-Imageは2560幅の埋め込みデータを必要としますが、以前はKlein 9B用の8Bエンコーダー(4096幅)が選択可能となっており、デノイズ処理の段階でエラーを引き起こしていました。Z-Imageを使用して生成を行うユーザーに影響します。更新後はUIのモデル選択や自動割り当てでQwen3 4Bモデルのみが適用されるようになり、設定の誤りによる不具合が防止されます。

モデル名変更時のバリデーションおよび保存処理の修正

モデル名を変更する際、3文字の短い名前を設定できるようバリデーション条件(文字数チェック)が修正されました。あわせて、フォームのエラー状態がクリアされた後に保存ボタンが押せなくなる不具合も解消されています(PR #9587)。モデル管理画面でモデル名の変更や整理を行うユーザーに影響します。設定変更時の挙動が正しくなったため、特別な対応を行わずに直感的な名前変更が可能です。

ショートカットキー「I」の適用範囲拡大

Canvas、Gallery、Viewerの各画面において、キーボードの「I」キーによるショートカット操作が有効化されました(PR #9569)。キーボード操作を中心に効率的に作業を行いたいユーザーに影響します。特に追加の準備は不要で、アップデート直後から各画面で「I」キーによる操作が可能です。

ComfyUIのメタデータ(comfy.gguf.orig_shape)への対応

ComfyUIで作成・出力されたGGUFモデルのメタデータであるcomfy.gguf.orig_shapeを正しく読み込んで処理する調整が行われました(PR #9564)。ComfyUI環境と併用してモデルファイルやGGUFを連携させているユーザーに影響します。

対応モデル・ハードウェア

InvokeAI 6.14.2では、サポートされる各種画像生成モデルおよびビジョン・言語エンコーダーモデルに関して、互換性の向上や不具合を防止するための制限・調整が行われています。今回のバージョンで影響を受けるモデルおよびフォーマットは以下の通りです。

krea-2

krea-2において、参照画像(Reference Image)を入力として指定した画像スタイル転送がサポートされました。これにより、既存の画像が持つスタイルや質感をkrea-2による画像生成プロセスへ反映させることが可能になっています。

FLUX.2 [dev] および Mistral エンコーダー

MistralローダーにおけるFP4形式のサポートが存在しない問題に対処するため、FLUX.2 [dev] のFP4 Mistralエンコーダースターターモデルが削除されました。12.3 GBのモデルデータをダウンロードした後にテンソルの形状不一致(shape mismatch)エラーで生成が停止する問題が解消されています。なお、FP4は除外されましたが、FLUX.2 [dev] におけるGGUF形式やFP8、BF16の各バリエーションは影響を受けず、引き続き利用可能です。

Z-Image および Qwen3 エンコーダー

Z-Imageモデルで利用可能なエンコーダーが「Qwen3 4B」(variant: qwen3_4b)に限定されました。Z-Imageは内部で2560次元幅の埋め込みデータを処理する仕様となっていますが、従来はKlein 9B用の8Bエンコーダー(4096次元幅)も選択可能となっており、デノイズ処理の初回ステップで不整合によるエラーが発生していました。今回の修正により、エンコーダー選択ピッカー、Z-Image切り替え時の自動選択、およびメタデータ読み出しの各処理においてガードが適用され、適切なQwen3 4Bエンコーダーのみが提供されます。

Qwen2.5-VL(量子化モデル)

量子化されたQwen2.5-VLエンコーダーモデルを動作させる際、VRAM領域の確保と処理完了後の領域解放が適切に処理されるよう改善されました。これにより、VRAM容量の逼迫によるリソースの枯渇やエラーを防ぎ、より安定した推論実行が可能になります。

ComfyUI GGUF形式メタデータへの対応

ComfyUI環境で出力・利用されるGGUFモデルに含まれるメタデータcomfy.gguf.orig_shapeを正しく解釈し処理する対応が追加されました。ComfyUIで量子化・作成されたGGUF形式モデルを取り扱う際の互換性が強化されています。

その他のエンコーダー関連の修正

SDNQガード処理がフォルダー形式のエンコーダー識別の途中で処理を中断させてしまう問題が解消され、エンコーダーの検出処理が正常に行われるよう改善されています。

アップデート方法

InvokeAIの導入およびアップデートには、公式提供のLauncherを利用することが推奨されています。公式リポジトリの導入ガイドに従い、以下のリンクからLauncherをダウンロードして更新を行ってください。

Download the Launcher

既存の環境を運用している場合、ランチャーを通じて最新のバージョン6.14.2への更新を適用できます。更新後は、削除されたFLUX.2 [dev] FP4 Mistralスターターモデルを避け、BF16、FP8、またはGGUF形式のエンコーダーが指定されていることを確認してください。また、Z-Imageモデルを使用している場合は、エンコーダーがQwen3 4Bに設定されていることを確認してください。

関連記事

次に読むなら

出典