画像・動画・音声

ComfyUI向け画像生成モデル「Comfy-Org/Ming-Image」公開

ComfyUIで利用可能なtext-to-imageモデル「Comfy-Org/Ming-Image」のファイル構成や仕様、透過背景対応などの特徴を解説します。

新モデル

Together AI、構造化データの意思決定に特化した4Bモデル「Tev1-4B-experimental」公開

Together AIがQwen3.5-4Bをベースに開発した、構造化データからの選択肢選定に特化した実験的モデル「Tev1-4B-experimental」のスペックや特徴、使い方を解説します。

画像・動画・音声

H3-to-LTX Latent Adapter公開:MiniMax-H3とLTX-2.5を接続

MiniMax-H3のビデオ潜在変数をLTX-2.5へ変換するアダプター「H3-to-LTX Latent-Adapter」の仕様や用途を解説します。

画像・動画・音声

アニメ風音声対応のTTSモデル「Irodori-TTS-v4.1-Anime」公開

アニメ調の音声データでファインチューニングされた日本語TTSモデル「Irodori-TTS-v4.1-Anime」のスペックや量子化バリエーション、音声クローニング機能について解説します。