围绕身份识别、人体2D/3D关节点和图搜万物三类能力构建,输出结构稳定,便于搜人、查人、检索、比对、复核和自动化 Agent 调用。
上传图片并输入一句描述,自动框出图中的目标,适合快速找人、找物和图像复核。
上传同一人的有序图片序列,返回每帧 2D 关节点和 3D 关节点结果,适合姿态分析、动作理解、行为复核和后续算法处理。
支持已跟踪人形步态序列解析,也支持输入矫正后的人脸图做人脸识别、输入单张人体图做 ReID 识别,输出人脸特征、步态特征、ReID 特征、ReID 结构化属性、情绪信息、帧号和坐标框,可用于搜人、查人、比对和业务复核。
| 我要做什么 | 推荐接口/流程 | 边界和不要误用 |
|---|---|---|
| 判断是否同一人 | 上传同一 track 的有序人体序列,调用 /v1/sequences/{task_id}/parse,读取 gait_feature、face_feature、reid_feature,同类型特征做点积。 | 不要用原始图片相似度或不同类型特征交叉比较。 |
| 从视频得到每个人的 2D/3D 关节点 | 推荐本地视频预处理生成每个人的 sequence 文件夹,再逐个调用 /v1/sequences/{task_id}/gait-pose。 | 关节点接口的输入是单人序列图片;多人视频需先在本地拆成每个人的序列。 |
| 已有单人序列,想提取关节点 | 按序列流程上传图片,再调用 /v1/sequences/{task_id}/gait-pose。 | pose 坐标相对上传序列图片;如果是人体 crop,映射回原视频要结合 crop/meta 信息。 |
| 在图片里找目标 | 调用 /v1/object-search,传原始 image_base64 和 prompt。 | boxes 是原图像素坐标;找不到目标返回 boxes: [],不是错误。 |
| 提取人脸特征 | 上传已经检测并矫正好的人脸图片,调用 /v1/features/face,读取 512 维 feature。 | 服务端不做人脸检测和矫正;请在客户端或前置流程中先裁剪、矫正人脸。 |
| 提取人体 ReID 特征 | 上传单个人体图片,调用 /v1/features/reid,读取 512 维 feature。 | 输入应是单个人体目标图;多人原图需先检测人体框并裁剪。 |
API 地址:https://www.w-agent.cn/api
登录后在“账户信息 - API Key”创建 API Key,并在请求中填写 Authorization: Bearer <api_key>。
上传一张图片并输入文字描述,接口返回匹配目标的坐标框。image_base64 使用原始 Base64,不带 data:image/... 前缀。
POST https://www.w-agent.cn/api/v1/object-search
Authorization: Bearer <api_key>
Content-Type: application/json
{
"image_base64": "...",
"prompt": "穿红色上衣的人"
}
返回图中目标框、标签和本次按图片计费的信息;找不到目标时 boxes 为空数组,不是调用失败;免注册试用可调用 /v1/public/object-search/trial。
{
"boxes": [
{"x1": 10, "y1": 20, "x2": 120, "y2": 260, "label": "person"}
],
"billing": {
"amount": 10,
"currency": "CNY",
"price_amount": 10,
"price_currency": "CNY",
"charge_amount": 10,
"charge_currency": "CNY",
"order_id": "locate_xxx"
}
}
image_base64 待检索图片的原始 Base64 内容,不带 data:image/... 前缀;建议使用 JPEG 或 PNG。prompt 要查找的目标描述,例如“门口的箱子”或“穿红衣服的人”,支持中文或英文取决于上游模型。boxes 匹配目标在上传图片中的像素坐标框,可能返回 0 个、1 个或多个;label 是模型生成标签,不是固定类别。购买后获得 30 天有效额度;调用时优先从套餐额度扣费,超出部分继续从充值余额按原价扣费。
W-Agent 按实际处理量计费,注册用户从账户余额扣费。计费字段会出现在任务账单和使用记录中,便于系统自动对账。
为自动化 Agent 提供稳定的机器可读说明文件,便于发现服务能力、接口、认证方式、支付方式和输出字段。
按算法和调用方式分别下载资源。没有对应实现的语言或客户端暂不提供下载。
| 算法类型 | 使用 API KEY 调用 API 示例 | 使用 X402 协议调用 API 示例 | ||
|---|---|---|---|---|
| python | c++ | go | python | |
| 图搜万物 | object-search-api-key-python.zip | object-search-api-key-cpp.zip | object-search-api-key-go.zip | object-search-x402-python.zip |
| 人体2D/3D关节点 | pose-api-key-python.zip | pose-api-key-cpp.zip | pose-api-key-go.zip | pose-x402-python.zip |
| 步态识别 | gait-api-key-python.zip | gait-api-key-cpp.zip | gait-api-key-go.zip | gait-x402-python.zip |
| 人脸识别 | face-api-key-python.zip | face-api-key-cpp.zip | — | face-x402-python.zip |
| ReID识别 | reid-api-key-python.zip | reid-api-key-cpp.zip | reid-api-key-go.zip | reid-x402-python.zip |
支持接入实时摄像头。
| 算法类型 | windows | mac |
|---|---|---|
| 图搜万物 | - | - |
| 人体2D/3D关节点 | - | - |
| 步态识别 | - | - |