トピック

·トピック一覧へ

llama.cpp

llama.cppに関する最新のAI・ITニュースを新着順にまとめ、DevPickのAIが要点を要約しています。

新着記事・要約(4件)

gihyo.jp2026/10/8
AI要約

MicrosoftがWindows向けのローカルAI推論基盤Windows MLに、LLM実行エンジンllama.cppを実験的に統合した

  • •Microsoftは2026年10月7日にWindows MLへのllama.cppの統合を発表した
  • •llama.cppは大規模言語モデル(LLM)を実行するための推論エンジンである
  • •今回の統合は実験的なサポートとして提供されている
PC Watchby 劉 尭2026/10/6
AI要約

ローカルLLM実行環境の定番ツールllama.cppがv0.6.0として公開され、新モデルGLM-5.3-Flashへの対応とMetalによる高速化が実現された

  • •ggml-orgが10月5日に新モデル「GLM-5.3-Flash」をサポートしたllama.cpp v0.6.0を公開した
  • •同ソフトはGitHubから無料でダウンロード可能で、ライセンスはMITが採用されている
  • •Metalによる高速化機能も追加され、ローカルでのLLM実行環境がさらに進化している
#LLM/モデル動向#生成AI活用・ツール
Hacker NewsHN投稿者: anerli2026/10/1

Launch HN: Magnitude (YC S25) – エージェント向けの自己最適化推論エンジン

Launch HN: Magnitude (YC S25) – Self-optimizing inference engine for agents

AI要約

エージェント向けにハードウェア上で最大限の速度で動作する自己最適化推論エンジン「Magnitude」が発表され、llama.cppより最大2倍高速であるとされている

  • •Mac、Linux、Windowsの任意のハードウェア上で動作する推論エンジンである
  • •既存の推論エンジンであるllama.cppと比較して最大2倍の速度向上を実現している
  • •開発者は過去に4,000以上のGitHubスターと100,000以上のダウンロードを獲得したオープンソースブラウザエージェントを開発した経験を持つ
#半導体・インフラ#AIエージェント
Hacker NewsHN投稿者: pptadversary2026/9/27
AI要約

llama.cppのn-gramキャッシュに対する4つの変更により、ドラフティング速度が最大41.6倍に向上し、メモリ使用量も削減された

  • •n-gramキャッシュへの4つの変更により、ドラフティング処理が最大41.6倍高速化された
  • •静的キャッシュの読み込み速度が最大23.5倍向上した
  • •ピークメモリ使用量が最大2.65倍低下した