意思決定モデルの台頭と推論エンジン高速化:オープンウェイトAI週報

今週の数字
当サイトが今週公開した記事から機械的に集計した値です。
| 項目 | 値 |
|---|---|
| 公開した記事 | 36本 |
| 画像・動画・音声 | 13本 |
| 新モデル | 12本 |
| エンジン・ツール | 10本 |
| コミュニティ | 1本 |
| 取り上げた新モデル | 25本 |
| 8GBのGPUで動く(目安) | 5本 |
| 12GBのGPUで動く(目安) | 7本 |
| 16GBのGPUで動く(目安) | 8本 |
| 24GBのGPUで動く(目安) | 11本 |
| パラメータ数 15〜40B | 6本 |
| パラメータ数 4〜15B | 5本 |
| パラメータ数 〜4B | 2本 |
| パラメータ数 40B超 | 2本 |
| 過去記事に追記した変換版 | 18件(GGUF 10件、FP8 1件、MLX 7件) |
| 記事数の多かった発信元 | efficient-large-model(5)、ggml-org(3)、unslothai/unsloth(2) |
| 未確認のまま残っている記事 | 1本 |
単独記事にしなかった急上昇モデル
今週 Hugging Face で注目を集めたものの、単独記事にしなかったリポジトリです。参考として一覧にするだけで、モデルカードの内容は確認していません。
| モデル | いいね | ダウンロード | 記事にしなかった理由 |
|---|---|---|---|
| PSRben/VisionHOPE | 402 | 1,516 | 著名リスト外の発信元 |
| Aleph-Alpha/Kolibri-1 | 388 | 1,135 | 元モデルの記事が無い変換版 |
| ISTA-DASLab/Qwen3.8-Flash-Next-GSQ-RCO-Coder-GGUF | 260 | 351,230 | 著名リスト外の発信元 |
| NaiveAI/Naive-N0.5-Flash | 165 | 1,920 | 著名リスト外の発信元 |
| bartowski/FrogNano-4B-2609-GGUF | 11 | 7,519 | 元モデルの記事が無い変換版 |
| bartowski/bytkim_Qwen3.8-27B-pi-GGUF | 7 | 3,909 | 元モデルの記事が無い変換版 |
| bartowski/GLM-5.3-Flash-BF16-GGUF | 4 | 2,288 | 元モデルの記事が無い変換版 |
| bartowski/cosmicoptima_computer-10-GGUF | 3 | 6,853 | 元モデルの記事が無い変換版 |
| bartowski/OmniJev_OneJev-9B-GGUF | 3 | 3,333 | 元モデルの記事が無い変換版 |
| bartowski/Lythri_Lythri-4B-A2B-GGUF | 2 | 2,819 | 元モデルの記事が無い変換版 |
単独記事にしなかったパッチ版
監視しているプロジェクトのリリースのうち、パッチ版・リリースノートが短いものです。全ての版はエンジン別ページにあります。
| プロジェクト | 版 | リリースノート |
|---|---|---|
| magnitudedev/magnitude | @magnitudedev/cli@0.2.2 | GitHub |
| magnitudedev/magnitude | @magnitudedev/cli@0.2.3 | GitHub |
| ollama/ollama | v0.35.1 | GitHub |
| turboderp-org/exllamav3 | v1.5.4 | GitHub |
| unslothai/unsloth | v0.1.902-beta | GitHub |
いいね数が伸びたモデル
当サイトが記事化したモデルの週次スナップショットから集計しました。いいねはHugging Face上の累積値、ダウンロード数は直近30日のローリング値です。
→ 横にスクロールできます
| モデル | いいねの増分 | いいね合計 | ダウンロード数(30日) | 期間 |
|---|---|---|---|---|
| Edge0/Audio8-ASR-Infinite | +1,401 | 2,426 | 40,004 | 2026-W40 → 2026-W41 |
| Qwen/Qwen3.8-27B | +515 | 16,939 | 6,821,761 | 2026-W40 → 2026-W41 |
| deepseek-ai/DeepSeek-V4.1-Flash | +283 | 4,093 | 798,422 | 2026-W40 → 2026-W41 |
| Viggle/Qwen-Image-2.1-viggle-turbo | +246 | 587 | 272,896 | 2026-W40 → 2026-W41 |
| prism-ml/Ternary-Bonsai-2-27B-gguf | +228 | 2,416 | 4,045,810 | 2026-W40 → 2026-W41 |
今週のハイライト
今週のローカルAIモデルを取り巻く動きの中で、特に注目すべきハイライトは以下の3点です。
第一に、構造化出力や意思決定に特化したモデルの台頭と、そのGGUF対応が進んだことです。Cloudflareが公開した「clef」や「clef-flash」、そしてggml-orgが公開した「OpenJev-GGUF」など、特定のタスクや構造化データの処理に最適化されたモデルが相次ぎました。これにより、手元のPCで実行できるエージェントや自動化ツールの実用性が大きく向上します。
第二に、動画生成モデル向けのLoRAアダプタが非常に活発にリリースされたことです。Efficient-Large-Modelによる「LongLive-Plug」シリーズや、Lightricksによる動画修復・画質変換用のLoRAなど、既存の強力なモデルを実用的にカスタマイズ・制御する手法が充実しました。
第三に、ローカル推論エンジンの高速化と機能拡張の競争が激化していることです。新しいRust製エンジン「Magnitude」の登場や、「Ollama v0.35.0」による意思決定モデル向け新APIの追加など、開発者が手元の環境でより快適にモデルを動かすための基盤が急速に整いつつあります。
分野別トレンド
テキスト生成
今週は、特定の用途や推論能力に特化した実用志向のモデルが数多く登場しました。一般的な対話だけでなく、構造化されたデータの出力や、複雑な思考プロセスを要するタスクに向けた最適化が進んでいます。
Cloudflareは、構造化された意思決定タスクに特化した「clef」(27.4B)および軽量版の「clef-flash」(9.4B)を公開しました。これらは、API連携やデータ抽出などの用途で高い精度を発揮します。また、国内のELYZAからは、思考プロセスを出力できる推論モデル「ELYZA-Thinking-1.0」の32Bおよび33Bモデルが公開され、日本語環境における高度な推論タスクのローカル実行が可能になりました。さらに、以前から公開されていた「Xing4.0-29B-A4B」や「Hemmingway-1」なども当サイトで取り上げており、中規模帯の選択肢がさらに豊かになっています。
画像・動画・音声
動画生成における制御技術の向上と、音声処理に特化したユニークなモデルの公開が目立つ一週間でした。
動画生成の分野では、ベースとなる大規模モデルを効率的に制御するためのLoRAが多数リリースされました。特に、Wan2.1やWan2.2をターゲットにした「LongLive-Plug-Wan2.2-TI2V-5B-cfg」などのLoRAアダプタは、少ないステップ数での高品質な生成や、カメラアングルの制御を可能にします。音声分野では、Googleが音声の書き起こしや話者分離に適した「DiarizationLM-Gemma-4-E4B-v1」を公開し、実用的な音声処理のローカル実行を後押ししています。なお、トルコ語の合成音声データセット「alania-synthetic-speech-tr」の公開も報告されていますが、こちらは公式に確認が取れていない未確認の情報ですのでご注意ください。
エンジン・ツール
ローカル環境での実行速度の極限化と、最新モデルへの迅速な対応を目指す開発競争が続いています。
画像生成GUIの「ComfyUI v0.38.0」が公開され、最新のHunyuan Image 3.5やQwen-Image 2.1へのサポートが追加されました。また、ローカルLLM実行環境として人気の「Ollama v0.35.0」では、意思決定モデルを扱いやすくするための新しいAPIが実装されています。さらに、Rustで書かれた新しい推論エンジン「Magnitude」が登場し、メモリ削減やApple Siliconへの最適化を進める「Magnitude CLI 0.2.4」や「@magnitudedev/cli v0.2.5」といったアップデートが矢継ぎ早に行われました。これらのツールの進化により、限られたハードウェア資源でも最新のモデルを効率的に動かせる環境が整いつつあります。
業界の動き
ローカルで動かす話題ではないため単独の記事にしなかった、企業・研究機関の発表です。要点だけを載せています。
- ankitjh4: インド政府の公開文書から抽出・正規化された、55,050件のテキストデータを含むデータセット「Bharat Guide」が公開されました。(発表)
- Kuyawa: macOSおよびWindows向けに、チャットを通じてプラグインを作成・拡張できるデスクトップアプリ「DeepSeek Harness Desktop」が開発されています。(発表)
- NVIDIA Developer: WindowsおよびLinux上でONNX RuntimeとNVIDIA TensorRT RTXを組み合わせ、ローカルAI推論を高速化するためのC++サンプルコード「DIN Deploy」が公開されました。(発表)
- NVIDIA Developer: 音声認識モデル「NVIDIA Nemotron 3.5 ASR」において、サウジアラビアのNajdiやHijaziなどの地方方言に対応するためのファインチューニング手法が発表されました。(発表)
- Hugging Face Blog: 多言語のテキスト読み上げ(TTS)および音声クローニングモデルを標準化された手法で評価するための「Open TTS Leaderboard」がHugging Face上で公開されました。(発表)
今週の記事
当サイトの記事ログからコードが組み立てた一覧です。同じ話題の記事は1行にまとめています。
新モデル
→ 横にスクロールできます
| 公開日 | モデル | パラメータ数 | 最小のVRAM階層 | ライセンス | 変換版 | 記事 |
|---|---|---|---|---|---|---|
| 2026-10-05 | Qwen/Qwen3.8-Flash-Next | 180.0B | — | qwen-community-1.0 | — | 「Qwen3.8-Flash-Next」マルチモーダル対応のMoEモデル:必要メモリ約402GB |
| 2026-10-04 | LiquidAI/LFM2.5-350M-Diffusion-Exp | 425M | 4GB | lfm1.0 | — | 「LFM2.5-350M-Diffusion-Exp」ブロック拡散型の軽量言語モデル:必要VRAM 4GB〜 |
| 2026-10-04 | ggml-org/GLM-5.3-Flash-GGUF | 321.3B | — | other | — | 「GLM-5.3-Flash-GGUF」VLMモデル:必要メモリ約150GB |
| 2026-10-03 | — | — | — | — | — | Ai2が科学研究向けレポート生成モデル「AstaBrief 8B」を公開 |
| 2026-10-02 | elyza/ELYZA-Thinking-1.0-llm-jp-4-32b-a3b | 32.1B | 80GB | apache-2.0 | — | 推論モデル「ELYZA-Thinking-1.0」の32B/33Bモデル公開 |
| 2026-10-02 | Cloudflare/clef-flash | 9.4B | 4GB | apache-2.0 | 3 | 「clef-flash」構造化出力特化型モデル:当サイトでの回答例・必要VRAM 4GB〜・GGUF版あり |
| 2026-09-28 | orcarouter/OrcaSAQ-2-27B | 27.8B | 16GB | apache-2.0 | — | 「OrcaSAQ-2-27B」テキスト生成モデル:当サイトでの回答例・必要VRAM 16GB〜(続報: 「clef」構造化意思決定モデル:必要VRAM 12GB〜・GGUF版あり) |
| 2026-09-28 | Altworld/Hemmingway-1 | 26.9B | 12GB | cc-by-nc-4.0 | 3 | 「Hemmingway-1」日常文章特化の言語モデル:必要VRAM 12GB〜・GGUF版あり |
| 2026-09-28 | apple/LensVLM-9B | 9.4B | 4GB | apple-amlr | 3 | 「LensVLM-9B」長文を画像として縮小して処理する視覚言語モデル:必要VRAM 4GB〜・GGUF版あり |
| 2026-09-28 | XingChen-AGI/Xing4.0-29B-A4B | 31.2B | 24GB | apache-2.0 | 3 | 「Xing4.0-29B-A4B」テキスト生成モデル:当サイトでの回答例・必要VRAM 24GB〜 |
画像・動画・音声
→ 横にスクロールできます
| 公開日 | モデル | パラメータ数 | 最小のVRAM階層 | ライセンス | 変換版 | 記事 |
|---|---|---|---|---|---|---|
| 2026-10-05 | google/DiarizationLM-Gemma-4-E4B-v1 | 8.0B | 8GB | apache-2.0 | — | 「DiarizationLM-Gemma-4-E4B-v1」音声処理向け大規模言語モデル:必要VRAM 8GB〜 |
| 2026-10-02 | nvidia/PixelUMM | 8.2B | 24GB | nvidia-one-way-noncommercial-license | — | 「PixelUMM」マルチモーダルモデル:必要VRAM 24GB〜 |
| 2026-10-02 | — | — | — | — | — | トルコ語の合成音声データセット「alania-synthetic-speech-tr」公開 |
| 2026-10-01 | FermionResearch/Phonon-2 | 627M | 4GB | cc-by-4.0 | — | 「Phonon-2」音声認識モデル:必要VRAM 4GB〜 |
| 2026-10-01 | Lightricks/LTX-2.5-22b-IC-LoRA-SDR-To-HDR | — | — | ltx-2.x-community-license | — | 「LTX-2.5-22b-IC-LoRA-SDR-To-HDR」動画生成モデル:配布ファイル一覧 |
| 2026-09-30 | Lightricks/LTX-2.5-22b-IC-LoRA-Restore | — | — | ltx-2.x-community-license | — | 「LTX-2.5-22b-IC-LoRA-Restore」動画修復向けIC-LoRAモデル:配布ファイル一覧 |
| 2026-09-30 | lilylilith/QI_2.1_AnyAngle | 7.1B | 48GB | apache-2.0 | — | 「QI_2.1_AnyAngle」カメラアングル操作LoRA:必要VRAM 48GB〜・配布ファイル一覧 |
| 2026-09-30 | Efficient-Large-Model/LongLive-Plug-Wan2.1-T2V-14B-few-step | — | — | apache-2.0 | — | 「LongLive-Plug-Wan2.1-T2V-14B-few-step」:当サイトの生成動画・配布ファイル一覧 |
| 2026-09-30 | Efficient-Large-Model/LongLive-Plug-Wan2.1-T2V-14B-cfg | — | — | apache-2.0 | — | 「LongLive-Plug-Wan2.1-T2V-14B-cfg」動画生成モデル:当サイトの生成動画・配布ファイル一覧 |
| 2026-09-30 | Efficient-Large-Model/LongLive-Plug-MiniMax-H3-cfg | — | — | minimax-h3-community-license-agreement | — | 動画生成モデル「MiniMax-H3」向けLoRAアダプタ2種公開 |
| 2026-09-29 | Efficient-Large-Model/LongLive-Plug-Wan2.2-TI2V-5B-few-step | — | — | apache-2.0 | — | 「LongLive-Plug-Wan2.2-TI2V-5B-few-step」:当サイトの生成動画・配布ファイル一覧(続報: 「LongLive-Plug-Wan2.2-TI2V-5B-cfg」動画生成モデル:当サイトの生成動画・配布ファイル一覧) |
| 2026-09-28 | akatz-ai/MiniMax-H3-Character-Swap-LoRA | — | — | minimax-h3-community-license-agreement | — | 「MiniMax-H3-Character-Swap-LoRA」動画生成モデル:配布ファイル一覧 |
エンジン・ツール
| 公開日 | プロジェクト | 版 | 記事 |
|---|---|---|---|
| 2026-10-03 | magnitudedev/magnitude | @magnitudedev/cli@0.2.5 | 推論エンジン「@magnitudedev/cli」v0.2.5公開、M5 Mac対応やMoE高速化 |
| 2026-10-03 | mudler/LocalAI | v4.11.0 | AIエンジン「LocalAI v4.11.0」公開、フェイルオーバー機能や音声認識・3Dモーション生成に対応 |
| 2026-10-03 | magnitudedev/magnitude | @magnitudedev/cli@0.2.4 | 推論エンジン「Magnitude CLI 0.2.4」公開、メモリ削減と初回ロード高速化を実現 |
| 2026-10-02 | sgl-project/sglang | v0.5.21 | 高速推論エンジン「SGLang v0.5.21」公開、PDインスタンスの動的切り替えに対応 |
| 2026-10-02 | — | — | 意思決定特化型モデル「OpenJev」のテスト用GGUFモデル公開(続報: 「OpenJev-GGUF」27.4Bの意思決定特化型モデル:必要VRAM 24GB〜) |
| 2026-10-01 | unslothai/unsloth | v0.1.901-beta | Unsloth v0.1.901-beta公開、4-bit学習のメモリ削減とデスクトップUI強化 |
| 2026-10-01 | — | — | 推論エンジン「Magnitude」公開、公式はllama.cpp比で最大2倍速、当サイトのCPU実測では約21倍遅い |
| 2026-09-30 | ollama/ollama | v0.35.0 | ローカルLLM実行ツール「Ollama v0.35.0」公開、意思決定モデル向け新API追加 |
| 2026-09-30 | Comfy-Org/ComfyUI | v0.38.0 | 画像生成GUI「ComfyUI v0.38.0」公開、Hunyuan Image 3.5やQwen-Image 2.1… |
| 2026-09-29 | unslothai/unsloth | v0.1.900-beta | unsloth Desktop v0.1.900-beta公開。Laya搭載と生成高速化 |
コミュニティ
| 公開日 | 記事 |
|---|---|
| 2026-10-04 | Aleph AlphaがオープンウェイトMoEモデル「Kolibri」公開、VRAM要件や性能を議論 |
