意思決定モデルの台頭と推論エンジン高速化:オープンウェイトAI週報

意思決定モデルの台頭と推論エンジン高速化:オープンウェイトAI週報

今週の数字

当サイトが今週公開した記事から機械的に集計した値です。

項目 値
公開した記事 36本
 画像・動画・音声 13本
 新モデル 12本
 エンジン・ツール 10本
 コミュニティ 1本
取り上げた新モデル 25本
 8GBのGPUで動く(目安) 5本
 12GBのGPUで動く(目安) 7本
 16GBのGPUで動く(目安) 8本
 24GBのGPUで動く(目安) 11本
 パラメータ数 15〜40B 6本
 パラメータ数 4〜15B 5本
 パラメータ数 〜4B 2本
 パラメータ数 40B超 2本
過去記事に追記した変換版 18件(GGUF 10件、FP8 1件、MLX 7件)
記事数の多かった発信元 efficient-large-model(5)、ggml-org(3)、unslothai/unsloth(2)
未確認のまま残っている記事 1本

単独記事にしなかった急上昇モデル

今週 Hugging Face で注目を集めたものの、単独記事にしなかったリポジトリです。参考として一覧にするだけで、モデルカードの内容は確認していません。

モデル いいね ダウンロード 記事にしなかった理由
PSRben/VisionHOPE 402 1,516 著名リスト外の発信元
Aleph-Alpha/Kolibri-1 388 1,135 元モデルの記事が無い変換版
ISTA-DASLab/Qwen3.8-Flash-Next-GSQ-RCO-Coder-GGUF 260 351,230 著名リスト外の発信元
NaiveAI/Naive-N0.5-Flash 165 1,920 著名リスト外の発信元
bartowski/FrogNano-4B-2609-GGUF 11 7,519 元モデルの記事が無い変換版
bartowski/bytkim_Qwen3.8-27B-pi-GGUF 7 3,909 元モデルの記事が無い変換版
bartowski/GLM-5.3-Flash-BF16-GGUF 4 2,288 元モデルの記事が無い変換版
bartowski/cosmicoptima_computer-10-GGUF 3 6,853 元モデルの記事が無い変換版
bartowski/OmniJev_OneJev-9B-GGUF 3 3,333 元モデルの記事が無い変換版
bartowski/Lythri_Lythri-4B-A2B-GGUF 2 2,819 元モデルの記事が無い変換版

単独記事にしなかったパッチ版

監視しているプロジェクトのリリースのうち、パッチ版・リリースノートが短いものです。全ての版はエンジン別ページにあります。

プロジェクト 版 リリースノート
magnitudedev/magnitude @magnitudedev/cli@0.2.2 GitHub
magnitudedev/magnitude @magnitudedev/cli@0.2.3 GitHub
ollama/ollama v0.35.1 GitHub
turboderp-org/exllamav3 v1.5.4 GitHub
unslothai/unsloth v0.1.902-beta GitHub

いいね数が伸びたモデル

当サイトが記事化したモデルの週次スナップショットから集計しました。いいねはHugging Face上の累積値、ダウンロード数は直近30日のローリング値です。

→ 横にスクロールできます

モデル いいねの増分 いいね合計 ダウンロード数(30日) 期間
Edge0/Audio8-ASR-Infinite +1,401 2,426 40,004 2026-W40 → 2026-W41
Qwen/Qwen3.8-27B +515 16,939 6,821,761 2026-W40 → 2026-W41
deepseek-ai/DeepSeek-V4.1-Flash +283 4,093 798,422 2026-W40 → 2026-W41
Viggle/Qwen-Image-2.1-viggle-turbo +246 587 272,896 2026-W40 → 2026-W41
prism-ml/Ternary-Bonsai-2-27B-gguf +228 2,416 4,045,810 2026-W40 → 2026-W41

今週のハイライト

今週のローカルAIモデルを取り巻く動きの中で、特に注目すべきハイライトは以下の3点です。

第一に、構造化出力や意思決定に特化したモデルの台頭と、そのGGUF対応が進んだことです。Cloudflareが公開した「clef」や「clef-flash」、そしてggml-orgが公開した「OpenJev-GGUF」など、特定のタスクや構造化データの処理に最適化されたモデルが相次ぎました。これにより、手元のPCで実行できるエージェントや自動化ツールの実用性が大きく向上します。

第二に、動画生成モデル向けのLoRAアダプタが非常に活発にリリースされたことです。Efficient-Large-Modelによる「LongLive-Plug」シリーズや、Lightricksによる動画修復・画質変換用のLoRAなど、既存の強力なモデルを実用的にカスタマイズ・制御する手法が充実しました。

第三に、ローカル推論エンジンの高速化と機能拡張の競争が激化していることです。新しいRust製エンジン「Magnitude」の登場や、「Ollama v0.35.0」による意思決定モデル向け新APIの追加など、開発者が手元の環境でより快適にモデルを動かすための基盤が急速に整いつつあります。

分野別トレンド

テキスト生成

今週は、特定の用途や推論能力に特化した実用志向のモデルが数多く登場しました。一般的な対話だけでなく、構造化されたデータの出力や、複雑な思考プロセスを要するタスクに向けた最適化が進んでいます。

Cloudflareは、構造化された意思決定タスクに特化した「clef」(27.4B)および軽量版の「clef-flash」(9.4B)を公開しました。これらは、API連携やデータ抽出などの用途で高い精度を発揮します。また、国内のELYZAからは、思考プロセスを出力できる推論モデル「ELYZA-Thinking-1.0」の32Bおよび33Bモデルが公開され、日本語環境における高度な推論タスクのローカル実行が可能になりました。さらに、以前から公開されていた「Xing4.0-29B-A4B」や「Hemmingway-1」なども当サイトで取り上げており、中規模帯の選択肢がさらに豊かになっています。

画像・動画・音声

動画生成における制御技術の向上と、音声処理に特化したユニークなモデルの公開が目立つ一週間でした。

動画生成の分野では、ベースとなる大規模モデルを効率的に制御するためのLoRAが多数リリースされました。特に、Wan2.1やWan2.2をターゲットにした「LongLive-Plug-Wan2.2-TI2V-5B-cfg」などのLoRAアダプタは、少ないステップ数での高品質な生成や、カメラアングルの制御を可能にします。音声分野では、Googleが音声の書き起こしや話者分離に適した「DiarizationLM-Gemma-4-E4B-v1」を公開し、実用的な音声処理のローカル実行を後押ししています。なお、トルコ語の合成音声データセット「alania-synthetic-speech-tr」の公開も報告されていますが、こちらは公式に確認が取れていない未確認の情報ですのでご注意ください。

エンジン・ツール

ローカル環境での実行速度の極限化と、最新モデルへの迅速な対応を目指す開発競争が続いています。

画像生成GUIの「ComfyUI v0.38.0」が公開され、最新のHunyuan Image 3.5やQwen-Image 2.1へのサポートが追加されました。また、ローカルLLM実行環境として人気の「Ollama v0.35.0」では、意思決定モデルを扱いやすくするための新しいAPIが実装されています。さらに、Rustで書かれた新しい推論エンジン「Magnitude」が登場し、メモリ削減やApple Siliconへの最適化を進める「Magnitude CLI 0.2.4」や「@magnitudedev/cli v0.2.5」といったアップデートが矢継ぎ早に行われました。これらのツールの進化により、限られたハードウェア資源でも最新のモデルを効率的に動かせる環境が整いつつあります。

業界の動き

ローカルで動かす話題ではないため単独の記事にしなかった、企業・研究機関の発表です。要点だけを載せています。

  • ankitjh4: インド政府の公開文書から抽出・正規化された、55,050件のテキストデータを含むデータセット「Bharat Guide」が公開されました。(発表)
  • Kuyawa: macOSおよびWindows向けに、チャットを通じてプラグインを作成・拡張できるデスクトップアプリ「DeepSeek Harness Desktop」が開発されています。(発表)
  • NVIDIA Developer: WindowsおよびLinux上でONNX RuntimeとNVIDIA TensorRT RTXを組み合わせ、ローカルAI推論を高速化するためのC++サンプルコード「DIN Deploy」が公開されました。(発表)
  • NVIDIA Developer: 音声認識モデル「NVIDIA Nemotron 3.5 ASR」において、サウジアラビアのNajdiやHijaziなどの地方方言に対応するためのファインチューニング手法が発表されました。(発表)
  • Hugging Face Blog: 多言語のテキスト読み上げ(TTS)および音声クローニングモデルを標準化された手法で評価するための「Open TTS Leaderboard」がHugging Face上で公開されました。(発表)

今週の記事

当サイトの記事ログからコードが組み立てた一覧です。同じ話題の記事は1行にまとめています。

新モデル

→ 横にスクロールできます

公開日 モデル パラメータ数 最小のVRAM階層 ライセンス 変換版 記事
2026-10-05 Qwen/Qwen3.8-Flash-Next 180.0B — qwen-community-1.0 — 「Qwen3.8-Flash-Next」マルチモーダル対応のMoEモデル:必要メモリ約402GB
2026-10-04 LiquidAI/LFM2.5-350M-Diffusion-Exp 425M 4GB lfm1.0 — 「LFM2.5-350M-Diffusion-Exp」ブロック拡散型の軽量言語モデル:必要VRAM 4GB〜
2026-10-04 ggml-org/GLM-5.3-Flash-GGUF 321.3B — other — 「GLM-5.3-Flash-GGUF」VLMモデル:必要メモリ約150GB
2026-10-03 — — — — — Ai2が科学研究向けレポート生成モデル「AstaBrief 8B」を公開
2026-10-02 elyza/ELYZA-Thinking-1.0-llm-jp-4-32b-a3b 32.1B 80GB apache-2.0 — 推論モデル「ELYZA-Thinking-1.0」の32B/33Bモデル公開
2026-10-02 Cloudflare/clef-flash 9.4B 4GB apache-2.0 3 「clef-flash」構造化出力特化型モデル:当サイトでの回答例・必要VRAM 4GB〜・GGUF版あり
2026-09-28 orcarouter/OrcaSAQ-2-27B 27.8B 16GB apache-2.0 — 「OrcaSAQ-2-27B」テキスト生成モデル:当サイトでの回答例・必要VRAM 16GB〜(続報: 「clef」構造化意思決定モデル:必要VRAM 12GB〜・GGUF版あり)
2026-09-28 Altworld/Hemmingway-1 26.9B 12GB cc-by-nc-4.0 3 「Hemmingway-1」日常文章特化の言語モデル:必要VRAM 12GB〜・GGUF版あり
2026-09-28 apple/LensVLM-9B 9.4B 4GB apple-amlr 3 「LensVLM-9B」長文を画像として縮小して処理する視覚言語モデル:必要VRAM 4GB〜・GGUF版あり
2026-09-28 XingChen-AGI/Xing4.0-29B-A4B 31.2B 24GB apache-2.0 3 「Xing4.0-29B-A4B」テキスト生成モデル:当サイトでの回答例・必要VRAM 24GB〜

画像・動画・音声

→ 横にスクロールできます

公開日 モデル パラメータ数 最小のVRAM階層 ライセンス 変換版 記事
2026-10-05 google/DiarizationLM-Gemma-4-E4B-v1 8.0B 8GB apache-2.0 — 「DiarizationLM-Gemma-4-E4B-v1」音声処理向け大規模言語モデル:必要VRAM 8GB〜
2026-10-02 nvidia/PixelUMM 8.2B 24GB nvidia-one-way-noncommercial-license — 「PixelUMM」マルチモーダルモデル:必要VRAM 24GB〜
2026-10-02 — — — — — トルコ語の合成音声データセット「alania-synthetic-speech-tr」公開
2026-10-01 FermionResearch/Phonon-2 627M 4GB cc-by-4.0 — 「Phonon-2」音声認識モデル:必要VRAM 4GB〜
2026-10-01 Lightricks/LTX-2.5-22b-IC-LoRA-SDR-To-HDR — — ltx-2.x-community-license — 「LTX-2.5-22b-IC-LoRA-SDR-To-HDR」動画生成モデル:配布ファイル一覧
2026-09-30 Lightricks/LTX-2.5-22b-IC-LoRA-Restore — — ltx-2.x-community-license — 「LTX-2.5-22b-IC-LoRA-Restore」動画修復向けIC-LoRAモデル:配布ファイル一覧
2026-09-30 lilylilith/QI_2.1_AnyAngle 7.1B 48GB apache-2.0 — 「QI_2.1_AnyAngle」カメラアングル操作LoRA:必要VRAM 48GB〜・配布ファイル一覧
2026-09-30 Efficient-Large-Model/LongLive-Plug-Wan2.1-T2V-14B-few-step — — apache-2.0 — 「LongLive-Plug-Wan2.1-T2V-14B-few-step」:当サイトの生成動画・配布ファイル一覧
2026-09-30 Efficient-Large-Model/LongLive-Plug-Wan2.1-T2V-14B-cfg — — apache-2.0 — 「LongLive-Plug-Wan2.1-T2V-14B-cfg」動画生成モデル:当サイトの生成動画・配布ファイル一覧
2026-09-30 Efficient-Large-Model/LongLive-Plug-MiniMax-H3-cfg — — minimax-h3-community-license-agreement — 動画生成モデル「MiniMax-H3」向けLoRAアダプタ2種公開
2026-09-29 Efficient-Large-Model/LongLive-Plug-Wan2.2-TI2V-5B-few-step — — apache-2.0 — 「LongLive-Plug-Wan2.2-TI2V-5B-few-step」:当サイトの生成動画・配布ファイル一覧(続報: 「LongLive-Plug-Wan2.2-TI2V-5B-cfg」動画生成モデル:当サイトの生成動画・配布ファイル一覧)
2026-09-28 akatz-ai/MiniMax-H3-Character-Swap-LoRA — — minimax-h3-community-license-agreement — 「MiniMax-H3-Character-Swap-LoRA」動画生成モデル:配布ファイル一覧

エンジン・ツール

コミュニティ