腾讯云图像识别提供强大的视觉理解能力,支持对图片和视频的智能分析,广泛适用于内容理解、智能打标、目标识别等场景。
产品功能
基于不同的 AI 技术架构,图像识别产品分为两类产品形态:视觉理解大模型与传统 CV 模型。
视觉理解大模型
基于大模型技术打造的视觉理解产品,泛化能力强,适合开放识别场景。视觉理解大模型支持两种使用模式:
应用场景模式:针对具体业务场景(如智慧门店巡检、电商素材打标),您可在 产品控制台 直接配置并调试业务规则。线上调用 时,仅需传入规则 ID 即可实现场景化识别。该模式有助于您更高效地管理业务规则、深度分析场景问题。
传统 CV 模型
在特定业务场景积累的领域模型,适合识别需求固定且耗时要求高的场景。
商品识别:覆盖电商、广告场景下的常见商品,并输出商品所在坐标。
车辆识别:识别图片中车辆的品牌、车系、类型、颜色等,覆盖轿车、SUV、大型客车等市面常见车。
车辆识别(增强版):在车辆识别的基础上增加了车牌识别的功能。可对图片中车辆的车型和车牌进行同时识别,输出车辆的车牌信息,以及车辆品牌、车系、类型、颜色和车辆在图中的坐标等信息,覆盖轿车、SUV、大型客车等市面常见车。
文件封识别:检测图片中是否包含符合文件封(即文件、单据、资料等的袋状包装)特征的物品,可应用于物流行业对文件快递的包装审核等场景。