根据需求,在搜索框内输入文字描述,例如输入“打电话”、“白色面包车”、 “骑电瓶车未戴头盔”、“自行车”、“小推车”、“小狗”等开放文字语义描述,即可搜索出相关目标。搜索范围广,既支持人、机动车、非机动车等安防场景的高频目标搜索 ,也广泛支持特定物品、异常行为等特征搜索。利用多模态大模型技术,提取图像与拟搜索语言的特征,并将图像特征与搜索语言中关键语义特征对齐,实现高精度搜索。如能够理解 “穿红色衣服”、“黑色背包”、“戴帽子”、“拉杆箱”、“棍棒”等对目标的文字描述,精准搜索出相关目标。针对常见目标的检索,TOP20命中率可达90%以上。
