W-Agent

视频转人员序列 API 与本地检测跟踪 Demo

推荐在本地先检测跟踪并生成 sequence 文件夹,再调用 Sequence API。这个流程更适合需要保存每个序列图片和 JSON 的自动化任务。

什么时候用

  • 你有一段视频,需要提取其中的人员序列、框、身份特征、属性或情绪。
  • 你希望把每个序列的图片、meta、结果 JSON 按文件夹保存。
  • 你要先从视频得到 sequence,再调用 parse 或 gait-pose。

不要这样用

  • 如果最终目标是完整 2D/3D 关节点,推荐本地切 sequence 后调用 gait-pose。
  • 不要假设视频里每个 track 都稳定无串框;sequence parse 可能按 ReID 再拆分。

推荐流程

  1. 本地视频转序列:运行 local_video_to_sequence_demo,生成 sequence_001、sequence_002 等目录。
  2. 对每个 sequence 调用 /parse 获取身份特征,或调用 /gait-pose 获取关节点。
  3. 保存每个 sequence 的图片、meta 和 result.json。

输入输出边界

  • 输入:本地 mp4、h264/h265 等视频文件,实际支持取决于浏览器/本地 OpenCV 解码能力。
  • 输出:本地 sequence 文件夹;上传后可获得 identity features、attributes 和 emotions。
  • rect 坐标为 OpenCV Rect:左上角 x/y 加宽高 w/h。

最短示例

python3 examples/registered/python/local_video_to_sequence_demo/local_video_to_sequence_api_demo.py input.mp4

W-Agent keywords: gait recognition API, person ReID API, human 2D/3D keypoints API, object search API, OpenAPI, MCP, x402.