首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >踩坑实战:Roo Code 调用本地模型卡顿?手把手教你优化到原生速度

踩坑实战:Roo Code 调用本地模型卡顿?手把手教你优化到原生速度

作者头像
虫无涯
发布于 2026-09-29 13:35:44
发布于 2026-09-29 13:35:44
340
举报
概述
最近在搭本地 AI 编码环境的时候,碰到了一个非常典型的「反差感」问题:同样是跑本地 Ollama 部署的 Llama 3.1 8B 模型,用命令行直接跑、curl 调 API、甚至用 Continue 插件,都是秒出结果,首 token 基本 1~2 秒就能出来;但唯独在 VSCode 里用 Roo Code 的时候,慢得离谱,经常要等十几秒才开始响应,长对话更是卡到没法用。
文章被收录于专栏:全栈测试技术全栈测试技术

原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。

如有侵权,请联系 cloudcommunity@tencent.com 删除。

问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档