llama.cpp
C/C++ 实现的高性能本地推理引擎,CPU 也能跑量化模型。
- 官网
- https://github.com/ggml-org/llama.cpp
- 分类
- 模型与基础设施
- 标签
- 开源 推理 量化
- 评分
- 4.5 / 5.0
- 来源
- 手工收录
- 更新时间
- 2026-09-14
本条目由程序自动抓取公开信息生成,仅供学习与技术参考;商标与版权归原作者所有,如有侵权请联系删除。
C/C++ 实现的高性能本地推理引擎,CPU 也能跑量化模型。
本条目由程序自动抓取公开信息生成,仅供学习与技术参考;商标与版权归原作者所有,如有侵权请联系删除。