Swallow(東京科学大学)のオープンモデルまとめ:公開モデル一覧・ライセンス

Swallow(東京科学大学)について

Swallow は、組織カードによれば、東京科学大学(旧東京工業大学)の岡崎研究室と横田研究室のメンバーを中心に研究開発している大規模言語モデルです。Hugging Face の tokyotech-llm の組織で公開しています。

Swallow の特徴は、海外の有力なモデルに日本語で継続事前学習をして、日本語と英語の両方に強くすることです。数学やコードの力を落とさないように学習データを工夫しており、国内の他の公開元(サイバーエージェントの CAT シリーズなど)の土台にもなっています。

何を公開しているのか

  • Qwen3-Swallow v0.2(2026年2月): 8B・30B-A3B(MoE)・32B です。モデルカードによれば、Qwen3 をもとに、継続事前学習(CPT)・SFT・検証可能な報酬による強化学習(RLVR)で作った日英のモデルで、推論の性能は元の Qwen3 と同等、一部では上回るとしています。学習段階ごとの重み(CPT・SFT・RL)も公開しています。
  • GPT-OSS-Swallow v0.1(2026年2月): OpenAI の gpt-oss をもとにした 20B・120B で、作り方は Qwen3-Swallow と同じです。
  • 医療向け(2026年6月): Qwen3-Swallow と GPT-OSS-Swallow をもとにした Medical-*-Swallow です。
  • 以前の Llama-3.1-Swallow・Swallow-MX(Mixtral ベース)などもあります。

ライセンス

Qwen3-Swallow・GPT-OSS-Swallow・医療向けのモデルは Apache-2.0 です。Llama-3.1-Swallow は Llama 3.3 と Gemma のライセンスを併記しています(学習に使ったモデルの条件を引き継ぐため)。使う前に各モデルのライセンス原文を確認してください。上の要約は法的な助言ではありません。

手元で動かすときのポイント

  • 公式の GGUF はありません(2026-09-26 時点)。代わりに、Qwen3-Swallow には公式の AWQ(INT4)版、GPT-OSS-Swallow には元の gpt-oss と同じ MXFP4 版があります。
  • 家庭用の GPU なら Qwen3-Swallow の 8B か 30B-A3B が候補です。 30B-A3B は MoE で、動くのは約3B です。

出典: tokyotech-llm の組織カード、tokyotech-llm/Qwen3-Swallow-8B-RL-v0.2・tokyotech-llm/GPT-OSS-Swallow-20B-RL-v0.1 のモデルカード、Hugging Face 上の tokyotech-llm の組織のモデル一覧(いずれも 2026-09-26 時点)。

当サイトの記録とデータ

当サイトはまだSwallow(東京科学大学)のモデルの記事を公開していません。下の Hugging Face のモデル一覧は、コードが毎日取得しています。公開元別のまとめの1ページで、シリーズ名はモデル系統別まとめの各ページへリンクしています。

基本情報

項目 内容
Hugging Face の組織 tokyotech-llm
Hugging Face の公開モデル数 138件
公式モデルの記事 0本
派生モデルの記事 0本

Hugging Face で公開しているモデル

公開元が Hugging Face で公開しているモデルは全部で 138件です。そのうち、当サイトが扱う生成モデル(テキスト・画像・動画・音声など)の新しいものを組織ごとに最大15件並べています。分類・特徴抽出などのモデル、研究用の部品、モデルカードの無いリポジトリは除き、公開元自身の量子化版・補助の別版は元のモデルの行にまとめています。重みを整数型に詰めて保存したリポジトリは、Hugging Face の集計が実際のパラメータ数と違うため、パラメータ数を空欄にしています。

→ 横にスクロールできます

公開日 モデル 用途 パラメータ数 ライセンス 同じモデルの公式の別版
2026-06-10 tokyotech-llm/Medical-GPT-OSS-Swallow-120B テキスト生成 116.8B apache-2.0 —
2026-06-10 tokyotech-llm/Medical-Qwen3-Swallow-8B テキスト生成 8.2B apache-2.0 —
2026-06-10 tokyotech-llm/Medical-Qwen3-Swallow-30B-A3B テキスト生成 30.5B apache-2.0 —
2026-06-10 tokyotech-llm/Medical-Qwen3-Swallow-32B テキスト生成 32.8B apache-2.0 —
2026-02-16 tokyotech-llm/GPT-OSS-Swallow-120B-RL-v0.1 テキスト生成 116.8B apache-2.0 MXFP4
2026-02-14 tokyotech-llm/GPT-OSS-Swallow-20B-RL-v0.1 テキスト生成 20.9B apache-2.0 MXFP4
2026-02-03 tokyotech-llm/Qwen3-Swallow-30B-A3B-RL-v0.2 テキスト生成 30.5B apache-2.0 AWQ-INT4
2026-02-02 tokyotech-llm/GPT-OSS-Swallow-120B-SFT-v0.1 テキスト生成 116.8B apache-2.0 —
2026-02-01 tokyotech-llm/Qwen3-Swallow-32B-RL-v0.2 テキスト生成 32.8B apache-2.0 AWQ-INT4
2026-01-28 tokyotech-llm/GPT-OSS-Swallow-20B-SFT-v0.1 テキスト生成 20.9B apache-2.0 —
2026-01-25 tokyotech-llm/Qwen3-Swallow-32B-SFT-v0.2 テキスト生成 32.8B apache-2.0 —
2026-01-24 tokyotech-llm/Qwen3-Swallow-8B-RL-v0.2 テキスト生成 8.2B apache-2.0 AWQ-INT4
2026-01-23 tokyotech-llm/Qwen3-Swallow-30B-A3B-SFT-v0.2 テキスト生成 30.5B apache-2.0 —
2026-01-14 tokyotech-llm/Qwen3-Swallow-32B-CPT-v0.2 テキスト生成 32.8B apache-2.0 —
2026-01-02 tokyotech-llm/Qwen3-Swallow-30B-A3B-CPT-v0.2 テキスト生成 30.5B apache-2.0 —

Hugging Face の API からコードが取得した値です。最終更新 2026-09-27(JST)。

最終更新 2026-09-27(JST)。ページ前半の解説は、出典に挙げた一次資料をもとに AI を用いて執筆したものです。「当サイトの記録とデータ」以降の表と一覧は、記事ログとHugging Face の API からコードが組み立てています。