ETL 小当家
大模型到底「有多困惑」?一文彻底搞懂 Perplexity
原创
关注作者
腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
ETL 小当家
社区首页
>
专栏
>
大模型到底「有多困惑」?一文彻底搞懂 Perplexity
大模型到底「有多困惑」?一文彻底搞懂 Perplexity
ETL 小当家
关注
发布于 2026-02-26 20:37:42
发布于 2026-02-26 20:37:42
1.8K
0
举报
概述
评价一个大语言模型好不好,最直观的感受是「用着爽不爽」,但这种主观评价存在 3 个致命缺陷: 1. **不可复现**:你觉得好用的模型,我可能觉得答非所问,没有统一标准; 2. **效率极低**:不可能在模型训练的每一步,都找大量人来做人工打分; 3. **无法量化过程**:模型训练时,我们需要一个精准的数字,实时判断「模型是变好了还是变差了」。 因此,我们需要一个**客观、可量化、可复现**
文章被收录于专栏:
人工智能
人工智能
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系
cloudcommunity@tencent.com
删除。
AIGC
人工智能
大模型部署
#人工智能
#大模型
#aigc
问题归档
专栏文章
快讯文章归档
关键词归档
开发者手册归档
开发者手册 Section 归档