首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >llama.cpp 与 GGUF 格式:本地大模型的“裸引擎“

llama.cpp 与 GGUF 格式:本地大模型的“裸引擎“

作者头像
用户12801654
发布于 2026-10-07 22:11:14
发布于 2026-10-07 22:11:14
200
举报
概述
本篇拆到"发动机"层:llama.cpp 是什么、GGUF 为什么成为本地模型的主流容器格式、Windows/Linux 怎么获取、llama-cli 怎么跑模型、llama-server 怎么起 OpenAI 兼容服务。适合想搞懂底层、想榨性能、想把自己应用接到轻量级推理服务上的人。读完你会:拿到 llama.cpp 可执行文件、跑通第一个 .gguf 模型、理解 Q4_K_M/Q8_0 量化档

原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。

如有侵权,请联系 cloudcommunity@tencent.com 删除。

问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档