llama.cpp の更新履歴と概要
C/C++で書かれたLLM推論エンジン。GGUF形式のモデルをCPU・GPU(CUDA / Metal / Vulkan / ROCm)で動かす。ローカルLLMのエコシステムの土台で、Ollama・LM Studio・KoboldCppなどが内部で使っている。
分類: 推論エンジン・ランタイム。推論エンジン・ツール一覧の1ページです。
基本情報
| 項目 | 内容 |
|---|---|
| リポジトリ | ggml-org/llama.cpp |
| ライセンス | MIT |
| 主要言語 | C++ |
| GitHubスター数 | 128,500(2026-09-17時点) |
| 最新版 | v0.4.1(2026-09-15) |
| 導入手順 | 公式ドキュメント |
プロジェクト自身の説明(原文): “LLM inference in C/C++”
更新履歴
当サイトがGitHubのリリース一覧から機械的にまとめたものです。プレリリースは載せていません。単独記事を書いた版は右端の列から読めます。それ以外の版はこの表でだけ追跡しています。
| 版 | 公開日 | リリースノート | 当サイトの記事 |
|---|---|---|---|
| v0.4.1 | 2026-09-15 | GitHub | — |
| v0.4.0 | 2026-09-05 | GitHub | — |
| v0.3.0 | 2026-08-25 | GitHub | — |
当サイトの記事
まだ記事はありません。
最終更新 2026-09-18(JST)。基本情報はGitHub APIの値、冒頭の説明は当サイトの編集部が書いたものです。