llama.cpp の更新履歴と概要

2026年9月18日

C/C++で書かれたLLM推論エンジン。GGUF形式のモデルをCPU・GPU(CUDA / Metal / Vulkan / ROCm)で動かす。ローカルLLMのエコシステムの土台で、Ollama・LM Studio・KoboldCppなどが内部で使っている。

分類: 推論エンジン・ランタイム。推論エンジン・ツール一覧の1ページです。

基本情報

項目 内容
リポジトリ ggml-org/llama.cpp
ライセンス MIT
主要言語 C++
GitHubスター数 128,500(2026-09-17時点)
最新版 v0.4.1(2026-09-15)
導入手順 公式ドキュメント

プロジェクト自身の説明(原文): “LLM inference in C/C++”

更新履歴

当サイトがGitHubのリリース一覧から機械的にまとめたものです。プレリリースは載せていません。単独記事を書いた版は右端の列から読めます。それ以外の版はこの表でだけ追跡しています。

公開日 リリースノート 当サイトの記事
v0.4.1 2026-09-15 GitHub
v0.4.0 2026-09-05 GitHub
v0.3.0 2026-08-25 GitHub

当サイトの記事

まだ記事はありません。

最終更新 2026-09-18(JST)。基本情報はGitHub APIの値、冒頭の説明は当サイトの編集部が書いたものです。