虫无涯
踩坑实战:Roo Code 调用本地模型卡顿?手把手教你优化到原生速度
原创
关注作者
腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
虫无涯
社区首页
>
专栏
>
踩坑实战:Roo Code 调用本地模型卡顿?手把手教你优化到原生速度
踩坑实战:Roo Code 调用本地模型卡顿?手把手教你优化到原生速度
虫无涯
关注
发布于 2026-09-29 13:35:44
发布于 2026-09-29 13:35:44
34
0
举报
概述
最近在搭本地 AI 编码环境的时候,碰到了一个非常典型的「反差感」问题:同样是跑本地 Ollama 部署的 Llama 3.1 8B 模型,用命令行直接跑、curl 调 API、甚至用 Continue 插件,都是秒出结果,首 token 基本 1~2 秒就能出来;但唯独在 VSCode 里用 Roo Code 的时候,慢得离谱,经常要等十几秒才开始响应,长对话更是卡到没法用。
文章被收录于专栏:
全栈测试技术
全栈测试技术
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系
cloudcommunity@tencent.com
删除。
人工智能
#Roo Code
问题归档
专栏文章
快讯文章归档
关键词归档
开发者手册归档
开发者手册 Section 归档