霍格沃兹-测试开发学社
换了模型、改了 Prompt,怎么知道线上没变差?用影子流量回放给 AI 功能做一次改版体检
原创
关注作者
腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
霍格沃兹-测试开发学社
社区首页
>
专栏
>
换了模型、改了 Prompt,怎么知道线上没变差?用影子流量回放给 AI 功能做一次改版体检
换了模型、改了 Prompt,怎么知道线上没变差?用影子流量回放给 AI 功能做一次改版体检
霍格沃兹-测试开发学社
关注
发布于 2026-09-18 14:09:29
发布于 2026-09-18 14:09:29
67
0
举报
概述
一次只想「让回答更礼貌」的 Prompt 微调上线了。离线那几十条手写用例全绿,评审顺利签字,灰度放量。可几天后翻线上日志才发现:某一类问题的拒答率悄悄往上爬,平均回答长度也短了一截——模型变「客气」了,客气到该答的也开始打太极。
文章被收录于专栏:
霍格沃兹测试开发学社
霍格沃兹测试开发学社
ceshiren0001
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系
cloudcommunity@tencent.com
删除。
测试策略
测试开发
AI测试解决方案
问题归档
专栏文章
快讯文章归档
关键词归档
开发者手册归档
开发者手册 Section 归档