首页
学习
活动
专区
圈层
工具
发布

本地智能体编程基准测试:Qwen3.8-Flash-Next NVFP4 对比 27B 及其他模型

这次我用 Qwen3.8-Flash-Next 的 NVFP4 版本做了本地智能体编程基准测试,也顺手和 27B 模型以及其他几个模型比了比那个分数偏低的,是 HuggingFace 上一个随机发布的未审查版本之后我还打算测测别的版本

结论挺有意思:在全部我测过的本地模型里,它的分数几乎是最高的,而且效率特别突出——每拿一分需要的请求数和生成 token 数都是最少的,并且是在中等推理强度下做到的这个基准里,极高推理强度(xhigh)依然没啥用不仅如此,它跑得还特别快

关键是,这还只是个训练没充分的模型,表现就已经这么能打了

  • 发表于:
  • 原文链接https://page.om.qq.com/page/OkWz6IWnSX89qwaIsBYE491Q0
  • 腾讯「腾讯云开发者社区」是腾讯内容开放平台帐号(企鹅号)传播渠道之一,根据《腾讯内容开放平台服务协议》转载发布内容。
  • 如有侵权,请联系 cloudcommunity@tencent.com 删除。
领券