Cactus Compute、8〜29MBの自動化モデル「Needle 3」公開
Cactus Computeが公開したスマートフォンやIoT向けの超軽量自動化モデル「Needle 3」のスペック、ツール呼び出し性能、Hacker Newsでの反応を解説します。
3値ウェイトモデルのテスト版「prism-ml/Ternary-Bonsai-2-27B-gguf-dev」公開
Qwen3.8-27Bをベースにした3値量子化モデルのGGUF開発用ビルド「prism-ml/Ternary-Bonsai-2-27B-gguf-dev」の概要や利用条件を解説します。
Qwen3.8-27Bベースの3値ウェイトモデル「Bonsai 2 27B」MLX 2bit版公開
Prism MLによるQwen3.8-27Bをベースにした3値(Ternary)ウェイトのMLX 2bit版モデル「Bonsai 2 27B」のスペックやベンチマーク結果を速報でお伝えします。
三値量子化された27Bモデル「Bonsai 2 27B GGUF」公開
Prism MLによるQwen3.8-27Bベースの三値言語モデル「Bonsai 2 27B GGUF」のスペックや推論性能、専用llama.cppでの実行方法を解説します。
Tencent、ドキュメント解析モデル「WeVisDoc-2B/4B」公開
Tencentがページ画像から構造化Markdownを抽出するエンドツーエンドのドキュメント解析モデル「WeVisDoc-2B」および「WeVisDoc-4B」を公開しました。特徴やベンチマーク結果、導入方法を解説します。
harshatheg/Qwen-2.5-1B-RLCD公開:Apple Silicon向け並列制約付きデコーディング
Apple Silicon環境での高速な構造化データ出力を実現する「harshatheg/Qwen-2.5-1B-RLCD」のスペックや推論性能、MLXを用いた実装について解説します。
EleutherAI、OLMo-3-7Bのハッキング耐性検証用モデル2種公開
EleutherAIが報酬ハッキングの動態研究用として公開した「OLMo-3-7B」ベースのモデル2種について、スペックや検証結果、動作環境を解説します。
Salience-27B-R6のGGUF量子化版公開、思考最適化された27Bマルチモーダルモデル
Vction Labs開発のSalience-27B-R6のGGUF量子化版が公開。思考効率化と100万トークン対応を備えたマルチモーダル27Bモデルのスペックと動作環境を解説。
マルチモーダル基盤モデル「Intern-S2-397B」のGGUF量子化版公開
上海AIラボのマルチモーダル基盤モデル「Intern-S2-397B」のGGUF量子化版が公開。llama.cppやLM Studio等でのローカル実行手順やスペックを解説。
EleutherAI、データ帰属の基準モデル「bergson-wikitext-gpt2-leaderboard」公開
EleutherAIによる学習データ帰属のベンチマーク基準モデル「EleutherAI/bergson-wikitext-gpt2-leaderboard」の概要やスペック、各種影響度評価手法のスコアを解説します。