用户12801654
llama.cpp 与 GGUF 格式:本地大模型的“裸引擎“
原创
关注作者
腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
用户12801654
社区首页
>
专栏
>
llama.cpp 与 GGUF 格式:本地大模型的“裸引擎“
llama.cpp 与 GGUF 格式:本地大模型的“裸引擎“
用户12801654
关注
发布于 2026-10-07 22:11:14
发布于 2026-10-07 22:11:14
20
0
举报
概述
本篇拆到"发动机"层:llama.cpp 是什么、GGUF 为什么成为本地模型的主流容器格式、Windows/Linux 怎么获取、llama-cli 怎么跑模型、llama-server 怎么起 OpenAI 兼容服务。适合想搞懂底层、想榨性能、想把自己应用接到轻量级推理服务上的人。读完你会:拿到 llama.cpp 可执行文件、跑通第一个 .gguf 模型、理解 Q4_K_M/Q8_0 量化档
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系
cloudcommunity@tencent.com
删除。
模型
问题归档
专栏文章
快讯文章归档
关键词归档
开发者手册归档
开发者手册 Section 归档