Naive-N0.5 まとめ:必要VRAM
当サイトが Naive-N0.5 系統について公開した記事(1本)と、記事の公開後に見つかった変換版(GGUF・MLX等)、必要メモリの判定を1ページにまとめたものです。必要メモリはモデルカードの公称値ではなく、当サイトが配布ファイルのサイズから機械的に算出した値です。モデル系統別まとめの1ページです。
基本情報
| 項目 | 内容 |
|---|---|
| 元のモデル | NaiveAI/Naive-N0.5-Flash |
| 公開元 | NaiveAI |
| ライセンス(モデルカード) | mit |
| 記事数 | 1本 |
動作環境
動作環境の目安(Local Model Watch 算出)
| 手持ちのVRAM | 選べる量子化 | ファイルサイズ | 必要メモリの目安 |
|---|---|---|---|
| 690GB超のVRAMが必要(複数GPUまたはCPUオフロードが前提) | そのままの精度 | 575.4GB | 690.5GB |
必要メモリは配布ファイルの実サイズに実行時のオーバーヘッド(KVキャッシュ等)を20%見込んだ概算で、文脈長・バッチサイズ・推論エンジンによって増減します。公開元の公称値ではなく、当サイトがファイルサイズから機械的に算出した値です。 他のモデルとの比較はVRAM別の早見表を参照してください。 量子化の名前の読み方は用語集にあります。
手元で動かせるか
現時点では Ollama・LM Studio・llama.cpp で動かせません。
公開元の配布は safetensors のみで、llama.cpp の登録表にもこのモデルのアーキテクチャ名がありません。これらのツールで動かせるようになるには、まず llama.cpp 側が対応する必要があります。公開元と実績のある量子化担当以外による変換版は 4 件あります。現時点で動かすなら transformers(PyTorch) で読み込む形になり、必要メモリは上の表のとおりです。
ライセンス mit(商用利用可): 商用利用を含めて自由に利用・改変・再配布できます。再配布時に著作権表示とライセンス文を残すことが条件です。
配布形式・当サイトが見つけた変換版・各推論エンジンの登録表を突き合わせた判定です。「確認できていない」は当サイトが見つけていないという意味で、存在しないことの断定ではありません。ライセンスの要約は法的助言ではないため、実際の利用にあたっては公開元の原文を確認してください。
派生版・量子化版
→ 横にスクロールできます
| 追記日 | 配布元 | 形式 | リポジトリ | 最小のVRAM階層(量子化・必要メモリの目安) |
|---|---|---|---|---|
| 2026-10-05 | NaiveAI | FP8 | NaiveAI/Naive-N0.5-Flash-FP8-Draft | FP8 1.5GB(4GB VRAMで動作) |
| 2026-10-05 | NaiveAI | FP8 | NaiveAI/Naive-N0.5-Flash-FP8 | FP8 352.2GB(単体のGPUには収まらない) |
各リポジトリの量子化とファイルサイズ:
- NaiveAI/Naive-N0.5-Flash-FP8-Draft の量子化: FP8 1.2GB
- NaiveAI/Naive-N0.5-Flash-FP8 の量子化: FP8 293.5GB
この節は、記事公開後に見つかった変換版を当サイトが機械的に追記したものです。必要メモリは配布ファイルのサイズから算出した概算です。
記事(シリーズ自身のモデルを先に、新しい順)
| 公開日 | モデル | 種類 | 記事 |
|---|---|---|---|
| 2026-10-05 | NaiveAI/Naive-N0.5-Flash | 新モデル | 「Naive-N0.5-Flash」AI研究とコーディング向けMoEモデル:必要メモリ約690GB |
リポジトリ
最終更新 2026-10-06(JST)。記事ログからコードが組み立てたページで、AIモデルが書いた文章はありません。