Nex-N2.5 まとめ:必要VRAM・GGUF版

2026年9月27日

このモデルについて

Nex-N2.5 は、Nex-AGI が公開したエージェント用途に特化したモデルのファミリーです。「現実の環境で、長い時間をかけて進める作業」を目標にしており、パソコンやブラウザを操作する、プログラムを書いて実行・テストする、といった作業を、画面を見て結果を確かめながら自分で修正して進められるように訓練されています。

サイズは mini・Pro・Max の3つです。

モデル 規模 入力 位置づけ
Nex-N2.5-mini 約 35B の MoE テキスト・画像 手元で動かせる大きさ
Nex-N2.5-Pro 約 397B の MoE テキスト・画像 性能重視
Nex-N2.5-Max 約 1.6T の MoE テキストのみ 旗艦(当サイトでは未掲載)

mini と Pro は前世代 Nex-N2 のマルチモーダル(画像も読める)の土台を引き継ぎ、PC 操作・ブラウザ操作・画面を見ながらのエージェント動作を強化したものです。公開されている設定ファイル上のアーキテクチャは Qwen3.5 の MoE(qwen3_5_moe)です。

何がすごいのか

公開元の比較表では、PC 操作・ターミナル操作・Web での調べ物で、Pro がクローズドな最前線モデルに数ポイント差まで迫っています。一方、ソフトウェア開発では大きな差が残ります。

→ 横にスクロールできます

評価(何を測るか) mini Pro Max Claude Opus 5 GPT-5.6 Sol
OSWorld-Verified(PC の画面操作) 71.2 82.2 — 83.4 83.2
Terminal-Bench 2.1(ターミナル操作) 73.4 82.7 86.1 89.1 88.8
SWE-Bench Pro(実際のソフトウェア開発) 43.8 61.2 65.7 79.2 64.6
BrowseComp(Web での調べ物) 83.4 89.7 92.6 90.8 90.4
  • PC の画面操作(OSWorld-Verified)で、Pro は最前線モデルとほぼ並びます。 なお、同じ表で最も高いのは Qwen3.8-Max の 86.1 です。
  • mini は、手元に載る規模で 70点台を出しています。 約 35B の MoE で、OSWorld-Verified 71.2、Terminal-Bench 2.1 73.4 は、自分の PC で動かすエージェントの頭脳として有力な数字です。
  • ソフトウェア開発では差が大きいです。 SWE-Bench Pro で Pro の 61.2 に対し Claude Opus 5 は 79.2、同じく表にある DeepSWE v1.1 でも 55.8 対 73.7、実務タスクの Job Bench でも 41.4 対 65.7 です。

注意点として、コーディングと PC 操作の評価は公開元自身の実行環境(NexAU・NexCUA)で測られています。エージェントの成績は実行環境(ハーネス)によって大きく変わるため、他社の発表値と完全に同じ条件の比較ではありません。

手元で動かすときのポイント

  • 現実的なのは mini です。 当サイトが追跡している GGUF 版などの変換版(下の「派生版・量子化版」)を使えば、量子化の段階に応じて一般的な GPU でも試せます。Pro は、最も小さい 1bit 級の量子化(IQ1_S)でも約 98GB のメモリが必要です(当サイトの算出)。
  • 公開元は、専用の修正を入れた SGLang の Docker イメージ(nexagi/sglang:v0.5.18-nex-patch)でのサーバー起動を案内しています。
  • 重みを落とさずに試すなら、OpenRouter 経由で mini・Pro のホスティング版も使えます。
  • ライセンスは Apache-2.0 で、商用利用もできます。

出典: nex-agi/Nex-N2.5-mini・nex-agi/Nex-N2.5-Pro のモデルカードと設定ファイル(2026-09-25 時点)。ベンチマークの数値は公開元が掲載した値です。

当サイトの記録とデータ

当サイトが Nex-N2.5 系統について公開した記事(2本)と、記事の公開後に見つかった変換版(GGUF・MLX等)、必要メモリの判定を1ページにまとめたものです。必要メモリはモデルカードの公称値ではなく、当サイトが配布ファイルのサイズから機械的に算出した値です。モデル系統別まとめの1ページです。

基本情報

項目 内容
元のモデル nex-agi/Nex-N2.5-Pro, nex-agi/Nex-N2.5-mini
公開元 Nex-AGI
ライセンス(モデルカード) apache-2.0
記事数 2本

動作環境

動作環境の目安(Local Model Watch 算出) — パラメータ数 396.8B

手持ちのVRAM 選べる量子化 ファイルサイズ 必要メモリの目安
98GB超のVRAMが必要(複数GPUまたはCPUオフロードが前提) IQ1_S 81.8GB 98.2GB

必要メモリは配布ファイルの実サイズに実行時のオーバーヘッド(KVキャッシュ等)を20%見込んだ概算で、文脈長・バッチサイズ・推論エンジンによって増減します。公開元の公称値ではなく、当サイトがファイルサイズから機械的に算出した値です。 ファイルサイズは変換版 bartowski/Nex-N2.5-Pro-GGUF の配布ファイルの実測値です。 他のモデルとの比較はVRAM別の早見表を参照してください。 量子化の名前の読み方は用語集にあります。

数値は nex-agi/Nex-N2.5-Pro のものです。大きさの違う他のモデルは下の記事を参照してください。

手元で動かせるか

Ollama・LM Studio・llama.cpp で動かせます(変換版を利用)。

公開元の配布は safetensors ですが、bartowski/Nex-N2.5-Pro-GGUF が GGUF版を公開しているため、そちらを使えば手元で動きます。

ライセンス apache-2.0(商用利用可): 商用利用を含めて自由に利用・改変・再配布できます。再配布時にライセンス文と変更点の告知が必要で、特許の許諾条項があります。

配布形式・当サイトが見つけた変換版・各推論エンジンの登録表を突き合わせた判定です。「確認できていない」は当サイトが見つけていないという意味で、存在しないことの断定ではありません。ライセンスの要約は法的助言ではないため、実際の利用にあたっては公開元の原文を確認してください。

判定は nex-agi/Nex-N2.5-Pro についてのものです。

派生版・量子化版

→ 横にスクロールできます

追記日 配布元 形式 リポジトリ 最小のVRAM階層(量子化・必要メモリの目安)
2026-09-18 bartowski GGUF(imatrix) bartowski/Nex-N2.5-Pro-GGUF IQ1_S 98.2GB(単体のGPUには収まらない)
2026-09-18 DevQuasar GGUF DevQuasar/nex-agi.Nex-N2.5-Pro-GGUF Q2_K 161.8GB(単体のGPUには収まらない)
2026-09-18 bartowski GGUF(imatrix) bartowski/nex-agi_Nex-N2.5-mini-GGUF Q2_K 15.5GB(16GB VRAMで動作)
2026-09-18 mradermacher GGUF mradermacher/Nex-N2.5-mini-GGUF Q2_K 14.5GB(16GB VRAMで動作)
2026-09-18 mlx-community MLX mlx-community/Nex-N2.5-mini-OptiQ-4bit MLX 4bit 24.8GB(32GB VRAMで動作)
2026-09-18 mlx-community MLX mlx-community/Nex-N2.5-mini-oQ4 MLX 4bit 22.8GB(24GB VRAMで動作)

各リポジトリの量子化とファイルサイズ:

  • bartowski/Nex-N2.5-Pro-GGUF の量子化: IQ1_S 81.8GB / IQ1_M 91.3GB / IQ2_XXS 107.2GB / IQ2_XS 113.1GB / IQ2_S 119.0GB / IQ2_M 132.5GB / Q2_K 140.4GB / IQ3_XXS 157.9GB / IQ3_XS 165.9GB / Q3_K_S 167.7GB / Q3_K_M 176.9GB / Q3_K_L 186.5GB / IQ3_M 195.1GB / IQ4_XS 204.5GB / Q4_0 210.0GB / Q4_K_S 217.5GB / Q4_1 232.0GB / IQ4_NL 232.4GB / Q4_K_M 233.6GB / Q5_K_S 263.4GB / Q5_K_M 284.6GB / Q6_K_S 310.3GB / Q6_K 325.8GB / Q8_0 392.6GB
  • DevQuasar/nex-agi.Nex-N2.5-Pro-GGUF の量子化: Q2_K 134.8GB / Q3_K_M 176.5GB / Q4_K_M 224.1GB / Q5_K_M 262.4GB
  • bartowski/nex-agi_Nex-N2.5-mini-GGUF の量子化: IQ2_XXS 10.1GB / IQ2_XS 10.5GB / IQ2_S 11.2GB / IQ2_M 12.3GB / Q2_K 12.9GB / IQ3_XXS 14.5GB / IQ3_XS 15.2GB / Q3_K_S 15.2GB / Q3_K_M 16.2GB / Q3_K_L 17.0GB / IQ3_M 17.7GB / IQ4_XS 18.5GB / Q4_0 18.6GB / Q4_K_S 19.5GB / Q4_1 20.5GB / IQ4_NL 20.8GB / Q4_K_M 20.8GB / Q4_K_L 22.5GB / Q5_K_S 23.4GB / Q5_K_M 25.1GB / Q6_K 27.4GB / Q6_K_L 30.1GB / Q8_0 34.4GB / BF16 64.6GB
  • mradermacher/Nex-N2.5-mini-GGUF の量子化: Q2_K 12.1GB / Q3_K_S 14.1GB / Q3_K_M 15.6GB / Q3_K_L 16.9GB / IQ4_XS 17.6GB / Q4_K_S 18.5GB / Q4_K_M 19.7GB / Q5_K_S 22.3GB / Q5_K_M 23.0GB / Q6_K 26.6GB / Q8_0 34.4GB
  • mlx-community/Nex-N2.5-mini-OptiQ-4bit の量子化: MLX 4bit 20.6GB
  • mlx-community/Nex-N2.5-mini-oQ4 の量子化: MLX 4bit 19.0GB

この節は、記事公開後に見つかった変換版を当サイトが機械的に追記したものです。必要メモリは配布ファイルのサイズから算出した概算です。

記事(シリーズ自身のモデルを先に、新しい順)

リポジトリ

最終更新 2026-09-27(JST)。ページ前半の解説は、出典に挙げた一次資料をもとに AI を用いて執筆したものです。「当サイトの記録とデータ」以降の表と一覧は、記事ログからコードが組み立てています。