Orion-26B-A4B-v1.1のGGUF量子化版が公開、マルチモーダル対応
bartowski氏によるマルチモーダル対応モデル「Orion-26B-A4B-v1.1」のGGUF量子化版公開について、ファイルサイズや必要メモリ、対応環境を解説します。
Tencent、Qwen3向けSASスパースアテンションチェックポイント公開
Tencentが公開したQwen3モデル向けSAS(Simple Attention Sparsification)チェックポイントの仕様や導入方法、動作環境を解説します。
DeepSeek-V4.1-Flashの検閲解除版FP8モデルがHugging Faceに公開
552BのMoEマルチモーダルモデル「DeepSeek-V4.1-Flash」の重みレベルで検閲解除(abliteration)を行ったFP8版の特徴やスペック、動作環境を解説します。
Qwen3.8-27Bの高速化ファインチューン「Signal-3.8-27B-GGUF」公開
Qwen3.8-27Bをベースに回答品質を維持したままトークン数を大幅削減し高速化したGGUFモデル「Signal-3.8-27B-GGUF」のスペックや動作環境を解説します。
bartowski、Nex-N2.5-mini-GGUFを公開、llama.cpp向け量子化モデル
bartowski氏が公開したエージェント向けマルチモーダルモデル「nex-agi_Nex-N2.5-mini-GGUF」のスペック、ベンチマーク、動作環境に必要なVRAM容量を解説します。
Pantheon-Reasoning-26B-A4B-1.1-V2 GGUF版が公開、ローカル実行向け量子化を提供
Grypheの推論・ロールプレイ特化型26Bモデル「Pantheon-Reasoning-26B-A4B-1.1-V2」のGGUF版がbartowski氏より公開。必要メモリや対応環境を速報。
Edge0、スマホクラスで動く35BのMoEモデル「Edge0-35B-A3B-preview」公開
Edge0が公開した、35BクラスのスパースMoEモデル「Edge0-35B-A3B-preview」のスペック、ベンチマーク性能、動作環境を解説。4-bit量子化とストリーミング推論で省メモリ動作を実現。
DeepSeek-V4.1-Flash公開、552BのMoEマルチモーダルモデル
deepseek-aiが最大100万トークン対応のマルチモーダルMoEモデル「DeepSeek-V4.1-Flash」をHugging Faceに公開。スペックや動作環境を解説します。
Nex-AGI、エージェント向けモデル「Nex-N2.5-Pro」を公開
Nex-AGIが長期タスク向けエージェントモデル「Nex-N2.5」ファミリーを発表。mini、Pro、MaxのウェイトがHugging Face等で公開されており、スペックやベンチマーク結果を解説します。
Nex-AGI、長期タスク向けオープンウェイトモデル「Nex-N2.5-mini」を公開
Nex-AGIがコンピュータ操作やウェブブラウジングなどの長期タスク向けに開発したマルチモーダルオープンウェイトモデル「Nex-N2.5-mini」のスペック、性能、動作環境を解説します。