Swallow(東京科学大学)のオープンモデルまとめ:公開モデル一覧・ライセンス
Swallow(東京科学大学)について
Swallow は、組織カードによれば、東京科学大学(旧東京工業大学)の岡崎研究室と横田研究室のメンバーを中心に研究開発している大規模言語モデルです。Hugging Face の tokyotech-llm の組織で公開しています。
Swallow の特徴は、海外の有力なモデルに日本語で継続事前学習をして、日本語と英語の両方に強くすることです。数学やコードの力を落とさないように学習データを工夫しており、国内の他の公開元(サイバーエージェントの CAT シリーズなど)の土台にもなっています。
何を公開しているのか
- Qwen3-Swallow v0.2(2026年2月): 8B・30B-A3B(MoE)・32B です。モデルカードによれば、Qwen3 をもとに、継続事前学習(CPT)・SFT・検証可能な報酬による強化学習(RLVR)で作った日英のモデルで、推論の性能は元の Qwen3 と同等、一部では上回るとしています。学習段階ごとの重み(CPT・SFT・RL)も公開しています。
- GPT-OSS-Swallow v0.1(2026年2月): OpenAI の gpt-oss をもとにした 20B・120B で、作り方は Qwen3-Swallow と同じです。
- 医療向け(2026年6月): Qwen3-Swallow と GPT-OSS-Swallow をもとにした Medical-*-Swallow です。
- 以前の Llama-3.1-Swallow・Swallow-MX(Mixtral ベース)などもあります。
ライセンス
Qwen3-Swallow・GPT-OSS-Swallow・医療向けのモデルは Apache-2.0 です。Llama-3.1-Swallow は Llama 3.3 と Gemma のライセンスを併記しています(学習に使ったモデルの条件を引き継ぐため)。使う前に各モデルのライセンス原文を確認してください。上の要約は法的な助言ではありません。
手元で動かすときのポイント
- 公式の GGUF はありません(2026-09-26 時点)。代わりに、Qwen3-Swallow には公式の AWQ(INT4)版、GPT-OSS-Swallow には元の gpt-oss と同じ MXFP4 版があります。
- 家庭用の GPU なら Qwen3-Swallow の 8B か 30B-A3B が候補です。 30B-A3B は MoE で、動くのは約3B です。
出典: tokyotech-llm の組織カード、tokyotech-llm/Qwen3-Swallow-8B-RL-v0.2・tokyotech-llm/GPT-OSS-Swallow-20B-RL-v0.1 のモデルカード、Hugging Face 上の tokyotech-llm の組織のモデル一覧(いずれも 2026-09-26 時点)。
当サイトの記録とデータ
当サイトはまだSwallow(東京科学大学)のモデルの記事を公開していません。下の Hugging Face のモデル一覧は、コードが毎日取得しています。公開元別のまとめの1ページで、シリーズ名はモデル系統別まとめの各ページへリンクしています。
基本情報
| 項目 | 内容 |
|---|---|
| Hugging Face の組織 | tokyotech-llm |
| Hugging Face の公開モデル数 | 138件 |
| 公式モデルの記事 | 0本 |
| 派生モデルの記事 | 0本 |
Hugging Face で公開しているモデル
公開元が Hugging Face で公開しているモデルは全部で 138件です。そのうち、当サイトが扱う生成モデル(テキスト・画像・動画・音声など)の新しいものを組織ごとに最大15件並べています。分類・特徴抽出などのモデル、研究用の部品、モデルカードの無いリポジトリは除き、公開元自身の量子化版・補助の別版は元のモデルの行にまとめています。重みを整数型に詰めて保存したリポジトリは、Hugging Face の集計が実際のパラメータ数と違うため、パラメータ数を空欄にしています。
→ 横にスクロールできます
| 公開日 | モデル | 用途 | パラメータ数 | ライセンス | 同じモデルの公式の別版 |
|---|---|---|---|---|---|
| 2026-06-10 | tokyotech-llm/Medical-GPT-OSS-Swallow-120B | テキスト生成 | 116.8B | apache-2.0 |
— |
| 2026-06-10 | tokyotech-llm/Medical-Qwen3-Swallow-8B | テキスト生成 | 8.2B | apache-2.0 |
— |
| 2026-06-10 | tokyotech-llm/Medical-Qwen3-Swallow-30B-A3B | テキスト生成 | 30.5B | apache-2.0 |
— |
| 2026-06-10 | tokyotech-llm/Medical-Qwen3-Swallow-32B | テキスト生成 | 32.8B | apache-2.0 |
— |
| 2026-02-16 | tokyotech-llm/GPT-OSS-Swallow-120B-RL-v0.1 | テキスト生成 | 116.8B | apache-2.0 |
MXFP4 |
| 2026-02-14 | tokyotech-llm/GPT-OSS-Swallow-20B-RL-v0.1 | テキスト生成 | 20.9B | apache-2.0 |
MXFP4 |
| 2026-02-03 | tokyotech-llm/Qwen3-Swallow-30B-A3B-RL-v0.2 | テキスト生成 | 30.5B | apache-2.0 |
AWQ-INT4 |
| 2026-02-02 | tokyotech-llm/GPT-OSS-Swallow-120B-SFT-v0.1 | テキスト生成 | 116.8B | apache-2.0 |
— |
| 2026-02-01 | tokyotech-llm/Qwen3-Swallow-32B-RL-v0.2 | テキスト生成 | 32.8B | apache-2.0 |
AWQ-INT4 |
| 2026-01-28 | tokyotech-llm/GPT-OSS-Swallow-20B-SFT-v0.1 | テキスト生成 | 20.9B | apache-2.0 |
— |
| 2026-01-25 | tokyotech-llm/Qwen3-Swallow-32B-SFT-v0.2 | テキスト生成 | 32.8B | apache-2.0 |
— |
| 2026-01-24 | tokyotech-llm/Qwen3-Swallow-8B-RL-v0.2 | テキスト生成 | 8.2B | apache-2.0 |
AWQ-INT4 |
| 2026-01-23 | tokyotech-llm/Qwen3-Swallow-30B-A3B-SFT-v0.2 | テキスト生成 | 30.5B | apache-2.0 |
— |
| 2026-01-14 | tokyotech-llm/Qwen3-Swallow-32B-CPT-v0.2 | テキスト生成 | 32.8B | apache-2.0 |
— |
| 2026-01-02 | tokyotech-llm/Qwen3-Swallow-30B-A3B-CPT-v0.2 | テキスト生成 | 30.5B | apache-2.0 |
— |
Hugging Face の API からコードが取得した値です。最終更新 2026-09-27(JST)。
最終更新 2026-09-27(JST)。ページ前半の解説は、出典に挙げた一次資料をもとに AI を用いて執筆したものです。「当サイトの記録とデータ」以降の表と一覧は、記事ログとHugging Face の API からコードが組み立てています。