エンジン・ツール

「unsloth」v0.1.810-beta公開:マルチユーザー対応とDocker刷新

オープンソースのLLM実行・微調整ツール「unsloth」の最新版v0.1.810-betaが公開。マルチユーザーアカウント機能の追加やDockerイメージの刷新、ハードウェア対応の拡大について解説します。

技術解説

GLMが独自推論インフラ構築を発表、中国製アクセラレータ活用と大規模MoEのローカル実行手法

GLMが10万台超の中国製AIアクセラレータを用いた独自推論インフラと「GLM-5.3-Flash」の稼働を発表。さらに744B MoEモデルをMacBookで動かすNVMeストリーミング手法も解説します。

コミュニティ

3値LLMの1.58ビットの壁を破る「BITCOS」論文公開

3値大規模言語モデルの重み分布の偏りに着目し、1.485ビット/重みを達成した研究「Breaking the 1.58-bit Barrier for Ternary LLMs」の概要とコミュニティの議論を紹介します。

技術解説

TensorRT Edge-LLMとQwen3.6-27BでMLPerf Edge Agenticベンチマークを高速化

NVIDIA Jetson AGX Thor上でTensorRT Edge-LLMとQwen3.6-27Bを用いてMLPerf Edge Agenticベンチマークを実行し、従来のリファレンス比6.4倍の高速化を達成した詳細と再現手順 ...

新モデル

harshatheg/Qwen-2.5-1B-RLCD公開:Apple Silicon向け並列制約付きデコーディング

Apple Silicon環境での高速な構造化データ出力を実現する「harshatheg/Qwen-2.5-1B-RLCD」のスペックや推論性能、MLXを用いた実装について解説します。

企業・資金調達

IEEE Spectrum: 2026年の推論ハードウェア革命とオープンモデルへの影響

IEEE Spectrumが報じた2026年のAI推論ハードウェア革命の動向を解説。Groq、Cerebras、HBM4、NVFP4量子化などの技術がローカルLLM運用に与える影響を技術者向けに速報します。

企業・資金調達

Mistral AIとMozillaが提携、Firefox Smart WindowにAIモデル採用

Mistral AIとMozillaがパートナーシップを締結し、ウェブブラウザ機能「Firefox Smart Window (beta)」にMistralのAIモデルを採用。プライバシーを重視した多言語対応AIの提供を開始。 ...

新モデル

EleutherAI、OLMo-3-7Bのハッキング耐性検証用モデル2種公開

EleutherAIが報酬ハッキングの動態研究用として公開した「OLMo-3-7B」ベースのモデル2種について、スペックや検証結果、動作環境を解説します。

コミュニティ

LLMの限界と仕様定義コスト:ナビエ–ストークス解決後の弱気な視点

LLMが数学の難問を解決する一方で、知能労働の代替には厳密な仕様定義と監視コストが障壁になるとする技術コミュニティの議論を紹介します。

エンジン・ツール

ComfyUI v0.36.0公開:汎用ループやYue2・Marigold v2に対応

ComfyUI v0.36.0がリリース。汎用ループ(Generic Loops)の実装をはじめ、音楽生成モデル「Yue2」や深度推定「Marigold v2」のサポート、LlamaベースモデルのRoPE処理高速化などの変更点を解説し ...