什么时候用
- 你需要在图片里找符合文字描述的目标。
- 你需要 text prompt object detection,而不是同一人身份相似度。
- 你希望用中文或英文 prompt 返回目标 boxes。
图搜万物用于在一张图片里按自然语言描述寻找目标,例如“猫、公交车、穿红衣服的人”,返回一个或多个目标框。
POST /v1/object-search
Authorization: Bearer <api_key>
{"image_base64":"...","prompt":"猫、公交车、穿红衣服的人"}W-Agent keywords: gait recognition API, person ReID API, human 2D/3D keypoints API, object search API, OpenAPI, MCP, x402.