画像・動画・音声

音楽生成モデル「YuE2-3B」公開、歌詞とスタイルから楽曲制作

m-a-pがオープンな音楽生成モデル「YuE2-3B」を公開。AR-NAR Mixture-of-Transformersを採用し、48kHzステレオ音声を生成。スペックや動作環境、ベンチマーク結果を解説します。

新モデル

DeepSeek-V4.1-FlashがHugging Faceに公開、484.6BパラメータのMoEモデル

deepseek-aiが最大100万トークン対応のマルチモーダルMoEモデル「DeepSeek-V4.1-Flash」をHugging Faceに公開。スペックや動作環境を解説します。

技術解説

NVIDIA Dynamo、マルチモーダルモデル向けEPD分散サービングの活用法を公開

NVIDIA Developerが公開したマルチモーダルモデルのサービングを加速する「Encode-Prefill-Decode (EPD) disaggregation」の活用法について解説します。NVIDIA DynamoによるT ...

技術解説

Goodfire、Ai2のオープン後学習スタックでOlmoモデルの挙動を追跡

GoodfireがAllen Institute for AI (Ai2)のオープンなポストトレーニングスタックを利用し、Olmoモデルの望ましくない挙動の追跡や予測を行った事例を解説します。

新モデル

Nex-AGIがエージェント向けモデル「Nex-N2.5-Pro」を発表、ウェイト公開は準備中

Nex-AGIが長期タスク向けエージェントモデル「Nex-N2.5」ファミリーを発表。mini、Pro、MaxのウェイトがHugging Face等で公開されており、スペックやベンチマーク結果を解説します。

新モデル

Nex-AGI、長期タスク向けオープンウェイトモデル「Nex-N2.5-mini」を公開

Nex-AGIがコンピュータ操作やウェブブラウジングなどの長期タスク向けに開発したマルチモーダルオープンウェイトモデル「Nex-N2.5-mini」のスペック、性能、動作環境を解説します。

企業・資金調達

Mistral AI、シリーズDで30億ユーロを調達しオープンウェイトAI開発を加速

Mistral AIがシリーズDで30億ユーロの資金調達を実施。フロンティア研究の拡張やオープンウェイトモデルの開発継続についてお伝えします。

新モデル

OpenBMB、オンデバイス向け2Bモデル「MiniCPM5-2B-GGUF」公開

OpenBMBが公開した2Bクラスのオープンウェイトモデル「MiniCPM5-2B-GGUF」のスペック、ベンチマーク性能、動作環境、入手方法を解説します。

新モデル

OpenBMB、2BクラスでSOTAを達成したオンデバイス向け「MiniCPM5-2B」公開

OpenBMBが公開した2Bクラスのオンデバイス向け大規模言語モデル「MiniCPM5-2B」のスペック、ベンチマーク性能、動作環境、利用方法を解説します。

週次まとめ

推論エンジンの更新とQwopus等の実用GGUFモデル登場

ggml v0.23.0やExLlamaV3などの推論エンジンアップデートと、QwopusやK2-Horizon-MoVAのGGUF版公開など、ローカルAIの最新動向をまとめます。