Python OpenCV实现姿态识别

前言

想要使用摄像头实现一个多人姿态识别

环境安装

下载并安装 Anaconda

官网连接 https://anaconda.cloud/installers
下载 anaconda nucleus

安装 Jupyter Notebook

检查Jupyter Notebook是否安装
检查Jupyter Notebook是否安装

Tip:这里涉及到一个切换Jupyter Notebook内核的问题,在我这篇文章中有提到
AnacondaNavigator Jupyter Notebook更换Python内核https://blog.csdn.net/a71468293a/article/details/122992170

生成Jupyter Notebook项目目录

打开Anaconda Prompt切换到项目目录
切换到项目目录
输入Jupyter notebook在浏览器中打开 Jupyter Notebook
在浏览器中打开
并创建新的记事本
创建新的记事本

下载训练库

图片以及训练库都在下方链接
https://github.com/quanhua92/human-pose-estimation-opencv
将图片和训练好的模型放到项目路径中
graph_opt.pb为训练好的模型

单张图片识别

导入库

import cv2 as cv
import os
import matplotlib.pyplot as plt

加载训练模型

net=cv.dnn.readNetFromTensorflow("graph_opt.pb")

初始化

inWidth=368
inHeight=368
thr=0.2

BODY_PARTS = { "Nose": 0, "Neck": 1, "RShoulder": 2, "RElbow": 3, "RWrist": 4,
               "LShoulder": 5, "LElbow": 6, "LWrist": 7, "RHip": 8, "RKnee": 9,
               "RAnkle": 10, "LHip": 11, "LKnee": 12, "LAnkle": 13, "REye": 14,
               "LEye": 15, "REar": 16, "LEar": 17, "Background": 18 }

POSE_PAIRS = [ ["Neck", "RShoulder"], ["Neck", "LShoulder"], ["RShoulder", "RElbow"],
               ["RElbow", "RWrist"], ["LShoulder", "LElbow"], ["LElbow", "LWrist"],
               ["Neck", "RHip"], ["RHip", "RKnee"], ["RKnee", "RAnkle"], ["Neck", "LHip"],
               ["LHip", "LKnee"], ["LKnee", "LAnkle"], ["Neck", "Nose"], ["Nose", "REye"],
               ["REye", "REar"], ["Nose", "LEye"], ["LEye", "LEar"] ]

载入图片

img = cv.imread("image.jpg")

显示图片

plt.imshow(img)

显示图片

调整图片颜色

plt.imshow(cv.cvtColor(img,cv.COLOR_BGR2RGB))

调整图片颜色

姿态识别

def pose_estimation(frame):
    frameWidth=frame.shape[1]
    frameHeight=frame.shape[0]
    net.setInput(cv.dnn.blobFromImage(frame, 1.0, (inWidth, inHeight), (127.5, 127.5, 127.5), swapRB=True, crop=False))
    out = net.forward()
    out = out[:, :19, :, :]  # MobileNet output [1, 57, -1, -1], we only need the first 19 elements
    
    assert(len(BODY_PARTS) == out.shape[1])
    
    points = []
    
    for i in range(len(BODY_PARTS)):
        # Slice heatmap of corresponging body's part.
        heatMap = out[0, i, :, :]

        # Originally, we try to find all the local maximums. To simplify a sample
        # we just find a global one. However only a single pose at the same time
        # could be detected this way.
        _, conf, _, point = cv.minMaxLoc(heatMap)
        x = (frameWidth * point[0]) / out.shape[3]
        y = (frameHeight * point[1]) / out.shape[2]
        # Add a point if it's confidence is higher than threshold.
        points.append((int(x), int(y)) if conf > thr else None)
        
    for pair in POSE_PAIRS:
        partFrom = pair[0]
        partTo = pair[1]
        assert(partFrom in BODY_PARTS)
        assert(partTo in BODY_PARTS)

        idFrom = BODY_PARTS[partFrom]
        idTo = BODY_PARTS[partTo]
		# 绘制线条
        if points[idFrom] and points[idTo]:
            cv.line(frame, points[idFrom], points[idTo], (0, 255, 0), 3)
            cv.ellipse(frame, points[idFrom], (3, 3), 0, 0, 360, (0, 0, 255), cv.FILLED)
            cv.ellipse(frame, points[idTo], (3, 3), 0, 0, 360, (0, 0, 255), cv.FILLED)
            
    t, _ = net.getPerfProfile()
    freq = cv.getTickFrequency() / 1000
    cv.putText(frame, '%.2fms' % (t / freq), (10, 20), cv.FONT_HERSHEY_SIMPLEX, 0.5, (0, 0, 0))
    return frame

# 处理图片
estimated_image=pose_estimation(img)
# 显示图片
plt.imshow(cv.cvtColor(estimated_image,cv.COLOR_BGR2RGB))

显示识别后图片

视频识别

Tip:与上面图片识别代码是衔接的
视频识别
视频来自互联网,侵删

cap = cv.VideoCapture('testvideo.mp4')
cap.set(3,800)
cap.set(4,800)

if not cap.isOpened():
    cap=cv.VideoCapture(0)
if not cap.isOpened():
    raise IOError("Cannot open vide")
    
while cv.waitKey(1) < 0:
    hasFrame,frame=cap.read()
    if not hasFrame:
        cv.waitKey()
        break
        
    frameWidth=frame.shape[1]
    frameHeight=frame.shape[0]
    net.setInput(cv.dnn.blobFromImage(frame, 1.0, (inWidth, inHeight), (127.5, 127.5, 127.5), swapRB=True, crop=False))
    out = net.forward()
    out = out[:, :19, :, :]  # MobileNet output [1, 57, -1, -1], we only need the first 19 elements
    
    assert(len(BODY_PARTS) == out.shape[1])
    
    points = []
    
    for i in range(len(BODY_PARTS)):
        # Slice heatmap of corresponging body's part.
        heatMap = out[0, i, :, :]

        # Originally, we try to find all the local maximums. To simplify a sample
        # we just find a global one. However only a single pose at the same time
        # could be detected this way.
        _, conf, _, point = cv.minMaxLoc(heatMap)
        x = (frameWidth * point[0]) / out.shape[3]
        y = (frameHeight * point[1]) / out.shape[2]
        # Add a point if it's confidence is higher than threshold.
        points.append((int(x), int(y)) if conf > thr else None)
        
    for pair in POSE_PAIRS:
        partFrom = pair[0]
        partTo = pair[1]
        assert(partFrom in BODY_PARTS)
        assert(partTo in BODY_PARTS)

        idFrom = BODY_PARTS[partFrom]
        idTo = BODY_PARTS[partTo]

        if points[idFrom] and points[idTo]:
            cv.line(frame, points[idFrom], points[idTo], (0, 255, 0), 3)
            cv.ellipse(frame, points[idFrom], (3, 3), 0, 0, 360, (0, 0, 255), cv.FILLED)
            cv.ellipse(frame, points[idTo], (3, 3), 0, 0, 360, (0, 0, 255), cv.FILLED)
            
    t, _ = net.getPerfProfile()
    freq = cv.getTickFrequency() / 1000
    cv.putText(frame, '%.2fms' % (t / freq), (10, 20), cv.FONT_HERSHEY_SIMPLEX, 0.5, (0, 0, 0))
    
    cv.imshow('Video Tutorial',frame)

实时摄像头识别

Tip:与上面图片识别代码是衔接的
摄像头识别

cap = cv.VideoCapture(0)
cap.set(cv.CAP_PROP_FPS,10)
cap.set(3,800)
cap.set(4,800)

if not cap.isOpened():
    cap=cv.VideoCapture(0)
if not cap.isOpened():
    raise IOError("Cannot open vide")
    
while cv.waitKey(1) < 0:
    hasFrame,frame=cap.read()
    if not hasFrame:
        cv.waitKey()
        break
        
    frameWidth=frame.shape[1]
    frameHeight=frame.shape[0]
    net.setInput(cv.dnn.blobFromImage(frame, 1.0, (inWidth, inHeight), (127.5, 127.5, 127.5), swapRB=True, crop=False))
    out = net.forward()
    out = out[:, :19, :, :]  # MobileNet output [1, 57, -1, -1], we only need the first 19 elements
    
    assert(len(BODY_PARTS) == out.shape[1])
    
    points = []
    
    for i in range(len(BODY_PARTS)):
        # Slice heatmap of corresponging body's part.
        heatMap = out[0, i, :, :]

        # Originally, we try to find all the local maximums. To simplify a sample
        # we just find a global one. However only a single pose at the same time
        # could be detected this way.
        _, conf, _, point = cv.minMaxLoc(heatMap)
        x = (frameWidth * point[0]) / out.shape[3]
        y = (frameHeight * point[1]) / out.shape[2]
        # Add a point if it's confidence is higher than threshold.
        points.append((int(x), int(y)) if conf > thr else None)
        
    for pair in POSE_PAIRS:
        partFrom = pair[0]
        partTo = pair[1]
        assert(partFrom in BODY_PARTS)
        assert(partTo in BODY_PARTS)

        idFrom = BODY_PARTS[partFrom]
        idTo = BODY_PARTS[partTo]

        if points[idFrom] and points[idTo]:
            cv.line(frame, points[idFrom], points[idTo], (0, 255, 0), 3)
            cv.ellipse(frame, points[idFrom], (3, 3), 0, 0, 360, (0, 0, 255), cv.FILLED)
            cv.ellipse(frame, points[idTo], (3, 3), 0, 0, 360, (0, 0, 255), cv.FILLED)
            
    t, _ = net.getPerfProfile()
    freq = cv.getTickFrequency() / 1000
    cv.putText(frame, '%.2fms' % (t / freq), (10, 20), cv.FONT_HERSHEY_SIMPLEX, 0.5, (0, 0, 0))
    
    cv.imshow('Video Tutorial',frame)

参考

  1. DeepLearning_by_PhDScholar
    Human Pose Estimation using opencv | python | OpenPose | stepwise implementation for beginners
    https://www.youtube.com/watch?v=9jQGsUidKHs
### 回答1: OpenCV是一个流行的计算机视觉库,可以用Python编程语言进行编写。它可以用于人体姿态识别,通过分析人体的关键点来推断出人体的姿态。在Python中,可以使用OpenCV的姿态估计模块来实现人体姿态识别。这个模块可以通过输入图像来检测人体的关键点,并计算出人体的姿态。通过这种方式,可以实现许多有趣的应用,如人体动作捕捉、运动分析等。 ### 回答2: OpenCV(开源计算机视觉库)是一款广泛使用的计算机视觉工具,能够实现智能识别和处理图像。人体姿态识别(Human Pose Estimation,HPE)是指从给定的图像或视频序列中检测和估计人的关键点位置和人的姿态。本文将介绍如何使用PythonOpenCV实现人体姿态识别。 首先,需要安装OpenCV库。在Python中,可以使用pip install opencv-python命令进行安装。接下来,需要下载并使用已训练好的HPE模型。这个模型可以从互联网上下载,也可以使用已经训练好的模型文件。这里我们将使用CMU的OpenPose模型。该模型支持多个人的关键点估计。 下一步,需要将要检测的图像或视频传递给模型,并解析输出的关键点。模型输出的是一个包含人类关键点的多维矩阵。使用OpenCV中的cv2.drawKeypoints函数,可以在图像或视频中将关键点可视化。此外,可以根据关键点的位置,计算骨骼角度和姿态。 实现人体姿态识别的一般步骤如下: 1. 载入图像或视频并将其转化为多帧图像。 2. 将每一帧图像传递给OpenPose模型,以检测人的关键点。 3. 输出人的关键点,可视化并计算人的角度和姿态。 4. 将多帧图像合成视频并保存。 人体姿态识别在很多领域中都有广泛应用,如医学分析、动作捕捉和体育运动员训练。使用PythonOpenCV实现人体姿态识别是非常有挑战性的,但和这样的课题相带来的收获显然是巨大的。 ### 回答3: 人体姿态识别是计算机视觉领域中一个重要的研究课题,它可以帮助我们识别人体动作,分析和监测人体健康状态等。OpenCV是一个流行的开源计算机视觉库,它提供了许多实用的功能,如图像处理、特征检测、分类器训练等,可以用来实现人体姿态识别Python是一种易于学习且广泛使用的编程语言,它与OpenCV结合可以让人体姿态识别任务更容易实现。以下是使用OpenCVPython进行人体姿态识别的步骤: 1.数据获取 首先,需要从适当的数据集中收集足够多的训练数据,包括人的身体动作的图像或视频。常用的数据集包括COCO、MPII等。 2.特征提取 在人体姿态识别中,特征提取是一个重要的步骤。OpenCV提供了很多图像处理方法,如人脸识别、形态学变换、傅里叶变换等。可以利用这些方法进行特征提取和预处理。 3.姿态检测 OpenCV提供了很多现成的模型和算法,如Haar Cascade、HOG+SVM、YOLO等。这些模型可以用来检测人的身体部位和关节点。 4.姿态估计 姿态估计是确定人体关节点位置和方向的过程。OpenCV提供了多种姿态估计算法,如基于模型、深度学习等。 5.结果可视化 最后,可以使用OpenCV的绘图功能将结果可视化,以便更好地展示人体姿态识别结果。 总之,OpenCV提供了许多有用的工具和功能,使人体姿态识别变得更加容易。利用PythonOpenCV,可以迅速构建高效的人体姿态识别系统。
评论 31
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值