手元で動かせるオープンウェイトのテキスト生成モデルの新着・アップデート。配布ファイルの実サイズから当サイトが算出した必要メモリと動作GPUの目安を、記事ごとに表で載せています。

新モデル

Cactus Compute、8〜29MBの自動化モデル「Needle 3」公開

Cactus Computeが公開したスマートフォンやIoT向けの超軽量自動化モデル「Needle 3」のスペック、ツール呼び出し性能、Hacker Newsでの反応を解説します。

新モデル

3値ウェイトモデルのテスト版「prism-ml/Ternary-Bonsai-2-27B-gguf-dev」公開

Qwen3.8-27Bをベースにした3値量子化モデルのGGUF開発用ビルド「prism-ml/Ternary-Bonsai-2-27B-gguf-dev」の概要や利用条件を解説します。

新モデル

Qwen3.8-27Bベースの3値ウェイトモデル「Bonsai 2 27B」MLX 2bit版公開

Prism MLによるQwen3.8-27Bをベースにした3値(Ternary)ウェイトのMLX 2bit版モデル「Bonsai 2 27B」のスペックやベンチマーク結果を速報でお伝えします。

新モデル

三値量子化された27Bモデル「Bonsai 2 27B GGUF」公開

Prism MLによるQwen3.8-27Bベースの三値言語モデル「Bonsai 2 27B GGUF」のスペックや推論性能、専用llama.cppでの実行方法を解説します。

新モデル

Tencent、ドキュメント解析モデル「WeVisDoc-2B/4B」公開

Tencentがページ画像から構造化Markdownを抽出するエンドツーエンドのドキュメント解析モデル「WeVisDoc-2B」および「WeVisDoc-4B」を公開しました。特徴やベンチマーク結果、導入方法を解説します。

新モデル

harshatheg/Qwen-2.5-1B-RLCD公開:Apple Silicon向け並列制約付きデコーディング

Apple Silicon環境での高速な構造化データ出力を実現する「harshatheg/Qwen-2.5-1B-RLCD」のスペックや推論性能、MLXを用いた実装について解説します。

新モデル

EleutherAI、OLMo-3-7Bのハッキング耐性検証用モデル2種公開

EleutherAIが報酬ハッキングの動態研究用として公開した「OLMo-3-7B」ベースのモデル2種について、スペックや検証結果、動作環境を解説します。

新モデル

Salience-27B-R6のGGUF量子化版公開、思考最適化された27Bマルチモーダルモデル

Vction Labs開発のSalience-27B-R6のGGUF量子化版が公開。思考効率化と100万トークン対応を備えたマルチモーダル27Bモデルのスペックと動作環境を解説。

新モデル

マルチモーダル基盤モデル「Intern-S2-397B」のGGUF量子化版公開

上海AIラボのマルチモーダル基盤モデル「Intern-S2-397B」のGGUF量子化版が公開。llama.cppやLM Studio等でのローカル実行手順やスペックを解説。

新モデル

EleutherAI、データ帰属の基準モデル「bergson-wikitext-gpt2-leaderboard」公開

EleutherAIによる学習データ帰属のベンチマーク基準モデル「EleutherAI/bergson-wikitext-gpt2-leaderboard」の概要やスペック、各種影響度評価手法のスコアを解説します。