週次まとめ

DeepSeek-V4.1-FlashとMiniCPM5-2Bの登場:週次オープンモデルまとめ

DeepSeek-V4.1-FlashやMiniCPM5-2Bなどの新型モデルの公開、vLLM v0.29.0やUnslothのアップデートなど、ローカル推論・学習環境の最新動向を振り返ります。

画像・動画・音声

ComfyUI向け音楽生成モデル「YuE2-3B」リパッケージ版が公開

Comfy-Orgより音楽生成モデル「YuE2-3B」のComfyUI向けリパッケージ版「Comfy-Org/YuE2」が公開されました。導入に必要なファイル構成や動作環境、モデルのスペックを解説します。

新モデル

DeepSeek-V4.1-Flashの検閲解除版FP8モデルがHugging Faceに公開

552BのMoEマルチモーダルモデル「DeepSeek-V4.1-Flash」の重みレベルで検閲解除(abliteration)を行ったFP8版の特徴やスペック、動作環境を解説します。

新モデル

Qwen3.8-27Bの高速化ファインチューン「Signal-3.8-27B-GGUF」公開

Qwen3.8-27Bをベースに回答品質を維持したままトークン数を大幅削減し高速化したGGUFモデル「Signal-3.8-27B-GGUF」のスペックや動作環境を解説します。

新モデル

bartowski、Nex-N2.5-mini-GGUFを公開、llama.cpp向け量子化モデル

bartowski氏が公開したエージェント向けマルチモーダルモデル「nex-agi_Nex-N2.5-mini-GGUF」のスペック、ベンチマーク、動作環境に必要なVRAM容量を解説します。

技術解説

Together AI、オープンウェイトモデルのファインチューニング機能を拡充し値下げも実施

Together AIがオープンウェイトモデル向けファインチューニングサービスをアップデート。新モデルの追加、ライブメトリクス追跡、Expert LoRAの導入、早期停止機能や最大70%の値下げを発表しました。

新モデル

Pantheon-Reasoning-26B-A4B-1.1-V2 GGUF版が公開、ローカル実行向け量子化を提供

Grypheの推論・ロールプレイ特化型26Bモデル「Pantheon-Reasoning-26B-A4B-1.1-V2」のGGUF版がbartowski氏より公開。必要メモリや対応環境を速報。

新モデル

Edge0、スマホクラスで動く35BのMoEモデル「Edge0-35B-A3B-preview」公開

Edge0が公開した、35BクラスのスパースMoEモデル「Edge0-35B-A3B-preview」のスペック、ベンチマーク性能、動作環境を解説。4-bit量子化とストリーミング推論で省メモリ動作を実現。

画像・動画・音声

Lightricks、動画生成モデル「LTX-2.5」向けのLoRA・IC-LoRA複数種を公開

Lightricksは、オープンウェイトの動画生成モデル「Lightricks/LTX-2.5」に対応するLoRAおよびIC-LoRAアダプターを複数公開しました。キャラクターの一貫性保持、シネマグラフ制作、カラー化、映像修復などの機 ...

技術解説

NVIDIA BioNeMo Inference Runtime発表、Boltz-2の推論を高速化

NVIDIAがオープンウェイトの生体分子構造予測モデルBoltz-2などの推論を高速化する「NVIDIA BioNeMo Inference Runtime(BioIR)」を発表。H100 GPUを用いたスループット向上や電力削減の仕 ...