ComfyUI向け音楽生成モデル「YuE2-3B」リパッケージ版が公開
Comfy-Orgより音楽生成モデル「YuE2-3B」のComfyUI向けリパッケージ版「Comfy-Org/YuE2」が公開されました。導入に必要なファイル構成や動作環境、モデルのスペックを解説します。
DeepSeek-V4.1-Flashの検閲解除版FP8モデルがHugging Faceに公開
552BのMoEマルチモーダルモデル「DeepSeek-V4.1-Flash」の重みレベルで検閲解除(abliteration)を行ったFP8版の特徴やスペック、動作環境を解説します。
Qwen3.8-27Bの高速化ファインチューン「Signal-3.8-27B-GGUF」公開
Qwen3.8-27Bをベースに回答品質を維持したままトークン数を大幅削減し高速化したGGUFモデル「Signal-3.8-27B-GGUF」のスペックや動作環境を解説します。
bartowski、Nex-N2.5-mini-GGUFを公開、llama.cpp向け量子化モデル
bartowski氏が公開したエージェント向けマルチモーダルモデル「nex-agi_Nex-N2.5-mini-GGUF」のスペック、ベンチマーク、動作環境に必要なVRAM容量を解説します。
Together AI、オープンウェイトモデルのファインチューニング機能を拡充し値下げも実施
Together AIがオープンウェイトモデル向けファインチューニングサービスをアップデート。新モデルの追加、ライブメトリクス追跡、Expert LoRAの導入、早期停止機能や最大70%の値下げを発表しました。
Pantheon-Reasoning-26B-A4B-1.1-V2 GGUF版が公開、ローカル実行向け量子化を提供
Grypheの推論・ロールプレイ特化型26Bモデル「Pantheon-Reasoning-26B-A4B-1.1-V2」のGGUF版がbartowski氏より公開。必要メモリや対応環境を速報。
Edge0、スマホクラスで動く35BのMoEモデル「Edge0-35B-A3B-preview」公開
Edge0が公開した、35BクラスのスパースMoEモデル「Edge0-35B-A3B-preview」のスペック、ベンチマーク性能、動作環境を解説。4-bit量子化とストリーミング推論で省メモリ動作を実現。
Lightricks、動画生成モデル「LTX-2.5」向けのLoRA・IC-LoRA複数種を公開
Lightricksは、オープンウェイトの動画生成モデル「Lightricks/LTX-2.5」に対応するLoRAおよびIC-LoRAアダプターを複数公開しました。キャラクターの一貫性保持、シネマグラフ制作、カラー化、映像修復などの機 ...
NVIDIA BioNeMo Inference Runtime発表、Boltz-2の推論を高速化
NVIDIAがオープンウェイトの生体分子構造予測モデルBoltz-2などの推論を高速化する「NVIDIA BioNeMo Inference Runtime(BioIR)」を発表。H100 GPUを用いたスループット向上や電力削減の仕 ...
NVIDIA NIM最適化でNemotron 3 Ultraのスループットが2.5倍に向上
NVIDIA Nemotron 3 Ultra向けNIM 2.0.12の最適化により、B200システム上でのスループットが2.5倍に向上した技術詳細とローカル環境での活用法を解説します。