#gguf

共 1 篇文章

开源项目与方案 2026/7/12

Llama.cpp 本地大模型部署实战

本文介绍如何使用 llama.cpp 在本地或边缘设备上低门槛部署大模型。涵盖纯 C/C++ 架构、多平台硬件适配、量化压缩、CPU+GPU 混合推理及 OpenAI 兼容服务部署,并提供从安装到 API 调用的完整可复现流程,帮助开发者快速构建本地 LLM 应用。

llama-cpp local-llm
阅读更多