用户10589160
多模型测试先按任务分层再比较结果
原创
关注作者
腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
用户10589160
社区首页
>
专栏
>
多模型测试先按任务分层再比较结果
多模型测试先按任务分层再比较结果
用户10589160
关注
发布于 2026-10-04 17:06:14
发布于 2026-10-04 17:06:14
18
0
举报
概述
这是一次个人使用后的选型笔记。我以前会给多个模型同一条提示词,然后按“哪一个回答更好”做主观选择。后来发现,只要任务类型不同,评价标准就应该不同;把聊天、代码生成、长文档分析和批处理混在一起测试,结论通常不稳定。
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系
cloudcommunity@tencent.com
删除。
媒体AI
问题归档
专栏文章
快讯文章归档
关键词归档
开发者手册归档
开发者手册 Section 归档