WAW-Agent

W-Agent

产品能力

围绕身份识别、人体2D/3D关节点和图搜万物三类能力构建,输出结构稳定,便于搜人、查人、检索、比对、复核和自动化 Agent 调用。

图搜万物

上传图片并输入一句描述,自动框出图中的目标,适合快速找人、找物和图像复核。

人体2D/3D关节点

上传同一人的有序图片序列,返回每帧 2D 关节点和 3D 关节点结果,适合姿态分析、动作理解、行为复核和后续算法处理。

身份识别

支持已跟踪人形步态序列解析,也支持输入矫正后的人脸图做人脸识别、输入单张人体图做 ReID 识别,输出人脸特征、步态特征、ReID 特征、ReID 结构化属性、情绪信息、帧号和坐标框,可用于搜人、查人、比对和业务复核。

我要做什么 推荐接口/流程 边界和不要误用
判断是否同一人 上传同一 track 的有序人体序列,调用 /v1/sequences/{task_id}/parse,读取 gait_feature、face_feature、reid_feature,同类型特征做点积。 不要用原始图片相似度或不同类型特征交叉比较。
从视频得到每个人的 2D/3D 关节点 推荐本地视频预处理生成每个人的 sequence 文件夹,再逐个调用 /v1/sequences/{task_id}/gait-pose。 关节点接口的输入是单人序列图片;多人视频需先在本地拆成每个人的序列。
已有单人序列,想提取关节点 按序列流程上传图片,再调用 /v1/sequences/{task_id}/gait-pose。 pose 坐标相对上传序列图片;如果是人体 crop,映射回原视频要结合 crop/meta 信息。
在图片里找目标 调用 /v1/object-search,传原始 image_base64 和 prompt。 boxes 是原图像素坐标;找不到目标返回 boxes: [],不是错误。
提取人脸特征 上传已经检测并矫正好的人脸图片,调用 /v1/features/face,读取 512 维 feature。 服务端不做人脸检测和矫正;请在客户端或前置流程中先裁剪、矫正人脸。
提取人体 ReID 特征 上传单个人体图片,调用 /v1/features/reid,读取 512 维 feature。 输入应是单个人体目标图;多人原图需先检测人体框并裁剪。