3値ウェイトモデルのテスト版「prism-ml/Ternary-Bonsai-2-27B-gguf-dev」公開
Qwen3.8-27Bをベースにした3値量子化モデルのGGUF開発用ビルド「prism-ml/Ternary-Bonsai-2-27B-gguf-dev」の概要や利用条件を解説します。
llamafile 0.10.6公開、llama.cpp更新とCUDA/HIPのグラフ機能強化
単一ファイルでLLMを実行できる「llamafile」のバージョン0.10.6がリリース。llama.cppのb10441への更新やCUDA/HIPのグラフ機能有効化、セキュリティ強化などの変更点を解説します。
マルチモーダル基盤モデル「Intern-S2-397B」のGGUF量子化版公開
上海AIラボのマルチモーダル基盤モデル「Intern-S2-397B」のGGUF量子化版が公開。llama.cppやLM Studio等でのローカル実行手順やスペックを解説。
Orion-26B-A4B-v1.1のGGUF量子化版が公開、マルチモーダル対応
bartowski氏によるマルチモーダル対応モデル「Orion-26B-A4B-v1.1」のGGUF量子化版公開について、ファイルサイズや必要メモリ、対応環境を解説します。
Qwen3.8-27Bの高速化ファインチューン「Signal-3.8-27B-GGUF」公開
Qwen3.8-27Bをベースに回答品質を維持したままトークン数を大幅削減し高速化したGGUFモデル「Signal-3.8-27B-GGUF」のスペックや動作環境を解説します。
bartowski、Nex-N2.5-mini-GGUFを公開、llama.cpp向け量子化モデル
bartowski氏が公開したエージェント向けマルチモーダルモデル「nex-agi_Nex-N2.5-mini-GGUF」のスペック、ベンチマーク、動作環境に必要なVRAM容量を解説します。
IFM、K2-Horizon-MoVA-36B-A4BのGGUF版を公開:llama.cppに対応
IFMが公開したMoEモデル「K2-Horizon-MoVA-36B-A4B」のGGUF版について、スペックや動作環境、必要メモリの目安を解説します。
Qwopus3.8-27B-Flash GGUF版公開、エージェント向け軽量化モデル
Qwen3.8-27Bをベースにしたエージェント向けファインチューンモデル「Jackrong/Qwopus3.8-27B-Flash-GGUF」のスペックや性能、動作環境を解説します。