LLM-jp(国立情報学研究所)のオープンモデルまとめ:公開モデル一覧・ライセンス

LLM-jp(国立情報学研究所)について

LLM-jp は、組織カードによれば、国立情報学研究所(NII)の主宰のもと、大学や企業の自然言語処理・計算機システムの研究者・技術者1,000人以上が参加する取り組みです。日本語に強いオープンソースの LLM を共同で作ること、研究開発の情報を共有すること、モデル・ツール・技術資料を公開することを目的にしています。最新の LLM-jp-4 は、NII の大規模言語モデル研究開発センターが開発しています。

何を公開しているのか

  • LLM-jp-4(2026年): 8B(3月)、MoE の 32B-A3B(3月)、33B(8月)と、それぞれの基盤モデル(Base)・指示追従版・思考(thinking)版です。モデルカードによれば、基盤モデルは事前学習と中間学習だけで、追加学習したモデルは SFT と DPO で調整しており、強化学習は使っていません。
  • LLM-jp-4-VL 9B(2026年8月): llm-jp-4-8b-thinking と SigLIP 2 を組み合わせた、画像も読めるモデルです。ベータ版と違い、商用利用でライセンス・利用規約の問題が無いデータだけで学習したとしています。
  • 音声: 音声合成の kaburi-tts(2026年7月)、音声対話の llm-jp-moshi などです。
  • 学習の途中段階や、疎なモデルの研究用のチェックポイントも大量に公開しています(組織の公開モデルは268件)。

ライセンス

LLM-jp-4 の系統は Apache-2.0 で、商用利用を含めて広く使えます。Llama をもとにした研究用のモデル(Llama-Mimi など)は元の Llama のライセンスです。使う前に各モデルのライセンス原文を確認してください。上の要約は法的な助言ではありません。

手元で動かすときのポイント

  • 思考版には公式の GGUF があります。 llm-jp-4 の 8B・32B-A3B・33B の thinking 版は、LLM-jp 自身が GGUF を出しています。
  • 家庭用の GPU なら 8B か 32B-A3B が候補です。 32B-A3B は MoE で、動くのは約3B です。使い方の例は公式のクックブック(GitHub の llm-jp-4-cookbook)にまとまっています。

出典: llm-jp の組織カード、llm-jp/llm-jp-4-8b-thinking・llm-jp/llm-jp-4-vl-9b のモデルカード、Hugging Face 上の llm-jp の組織のモデル一覧(いずれも 2026-09-26 時点)。

当サイトの記録とデータ

当サイトはまだLLM-jp(国立情報学研究所)のモデルの記事を公開していません。下の Hugging Face のモデル一覧は、コードが毎日取得しています。公開元別のまとめの1ページで、シリーズ名はモデル系統別まとめの各ページへリンクしています。

基本情報

項目 内容
Hugging Face の組織 llm-jp
Hugging Face の公開モデル数 268件
公式モデルの記事 0本
派生モデルの記事 0本

Hugging Face で公開しているモデル

公開元が Hugging Face で公開しているモデルは全部で 268件です。そのうち、当サイトが扱う生成モデル(テキスト・画像・動画・音声など)の新しいものを組織ごとに最大15件並べています。分類・特徴抽出などのモデル、研究用の部品、モデルカードの無いリポジトリは除き、公開元自身の量子化版・補助の別版は元のモデルの行にまとめています。重みを整数型に詰めて保存したリポジトリは、Hugging Face の集計が実際のパラメータ数と違うため、パラメータ数を空欄にしています。

→ 横にスクロールできます

公開日 モデル 用途 パラメータ数 ライセンス 同じモデルの公式の別版
2026-08-15 llm-jp/llm-jp-4-vl-9b VLM・マルチモーダル 9.1B apache-2.0 —
2026-08-14 llm-jp/llm-jp-4-33b-thinking テキスト生成 33.2B apache-2.0 gguf
2026-08-14 llm-jp/llm-jp-4-33b-base テキスト生成 33.2B apache-2.0 —
2026-07-21 llm-jp/kaburi-tts 音声 — apache-2.0 —
2026-03-30 llm-jp/layoutlmv3-japanese-preview — 111M apache-2.0 —
2026-03-30 llm-jp/llm-jp-4-8b-instruct テキスト生成 8.6B apache-2.0 —
2026-03-16 llm-jp/llm-jp-4-32b-a3b-thinking テキスト生成 32.1B apache-2.0 gguf
2026-03-16 llm-jp/llm-jp-4-32b-a3b-base テキスト生成 32.1B apache-2.0 —
2026-03-16 llm-jp/llm-jp-4-8b-thinking テキスト生成 8.6B apache-2.0 gguf
2026-03-15 llm-jp/llm-jp-4-8b-base テキスト生成 8.6B apache-2.0 —
2026-02-24 llm-jp/llm-jp-3.1-8x13b-32K テキスト生成 73.2B apache-2.0 —
2026-02-24 llm-jp/llm-jp-3.1-8x13b-32K-instruct4 テキスト生成 73.2B apache-2.0 —
2026-01-07 llm-jp/llm-jp-moshi-v1 — 7.7B apache-2.0 —
2025-09-18 llm-jp/Llama-Mimi-8B 音声 8.1B llama3.1 —
2025-09-18 llm-jp/Llama-Mimi-1.3B 音声 1.3B llama3.2 —

Hugging Face の API からコードが取得した値です。最終更新 2026-09-27(JST)。

最終更新 2026-09-27(JST)。ページ前半の解説は、出典に挙げた一次資料をもとに AI を用いて執筆したものです。「当サイトの記録とデータ」以降の表と一覧は、記事ログとHugging Face の API からコードが組み立てています。