使用 Python 和 DirectShow 从相机捕获图像

使用 Python 和 DirectShow 从相机捕获图像

pingmian/2025/4/26 19:45:47/文章来源:https://blog.csdn.net/H_zizi/article/details/138244875

在 Python 中使用 OpenCV 是视觉应用程序原型的一个非常好的解决方案，它允许您快速起草和测试算法。处理从文件中读取的图像非常容易，如果要处理从相机捕获的图像，则不那么容易。OpenCV 提供了一些基本方法来访问链接到 PC 的相机（通过对象），但大多数时候，即使对于简单的原型来说，它们也不够用。例如，不可能列出链接到 PC 的所有摄像机，也没有快速调整摄像机参数的方法来。或者，您可以使用 PyGame 或相机制造商提供的 SDK（如果可用）。VideoCapture

在与相机交互的Windows中，通常使用DirectShow。它的主要优势是：

几乎任何相机都提供了一个驱动程序，允许它从 .DirectShow
这是一项成熟且广泛使用的技术。
它基于 COM 框架，因此设计为从不同的编程语言使用。

相反，这是一项相当古老的技术，正在被Windows Media Foundation所取代，Microsoft不再开发它。但这没什么大不了的，因为它具有所需的所有功能，并且用于许多应用程序，以至于（在我看来），Microsoft 将长期保持它可用。

在这里，我想提出一个完全用 Python 编写的简单应用程序，它允许您使用、在屏幕上显示它们并使用 OpenCV 对它们进行简单的处理。该应用程序基于一个类，该类公开了某些功能，并且可以在其他应用程序中重用。该代码设计为易于更改和扩展。DirectShowDirectShow

使用应用程序

请确保安装了以下 Python 包：numpymatplotlibopencv-pythoncomtypes
运行 main.py。
启动应用程序后，将显示对话框“选择视频设备”。选择一个摄像机，然后按下确定。

将显示一个允许您选择相机分辨率的屏幕。选择所需的分辨率或保留默认值，然后按确定。
摄像机直播显示在屏幕的左侧。
按 Grab 卡普照片，照片将显示在屏幕右侧。您可以使用屏幕右侧的按钮对照片应用一些滤镜，或按保存保存图片。

在 Windows 10 上，如果文本大小已设置为不同于 100% 的值（在 Windows 的“显示设置”屏幕上），则相机的实时图像可能在包含的帧上显示未完全对齐。这似乎是DirectShow的问题，因为我在其他应用程序上也有相同的行为。

简言之DirectShow

DirectShow是编写多媒体应用程序的框架。应用程序的构建基块是一个筛选器，一个执行基本操作的对象，例如：DirectShow

从相机或文件中读取音频\视频
将音频\视频从一种格式转换为另一种格式
将音频\视频渲染到屏幕或文件

滤波器可以具有输入和输出引脚，并且可以将它们连接在一起以执行所需的工作

DirectShow提供一个名为 Filter Graph 的对象，该对象负责收集、链接和运行过滤器。

对于我们的应用程序，我们需要以下过滤器：

相机源过滤器，用于读取相机中的图像
一个过滤器，允许我们对相机提供的每个帧进行一些操作SampleGrabber
在 GUI 上显示摄像机实时流的视频渲染过滤器

本文来自互联网用户投稿，该文观点仅代表作者本人，不代表本站立场。本站仅提供信息存储空间服务，不拥有所有权，不承担相关法律责任。如若转载，请注明出处：http://www.mzph.cn/pingmian/4366.shtml

如若内容造成侵权/违法违规/事实不符，请联系多彩编程网进行投诉反馈email:809451989@qq.com，一经查实，立即删除！

相关文章

Github创建远程仓库（项目）

Github创建远程仓库（项目）

天行健，君子以自强不息；地势坤，君子以厚德载物。每个人都有惰性，但不断学习是好好生活的根本，共勉！ 文章均为学习整理笔记，分享记录为主，如有错误请指正，共同学习进步。…

阅读更多...

制作Android分区镜像

制作Android分区镜像

1 python生成一个sector数据 def get_oem_bootmode(): # Header size SECTOR_SIZE_IN_BYTES 512 header [0 for i in \ range(SECTOR_SIZE_IN_BYTES)] # magic # The ord() built-in function in # Python converts a character # into …

阅读更多...

MongoDB的安装（Linux环境）

MongoDB的安装（Linux环境）

登录到Linux服务器执行 lsb_release -a ，即可得知服务器的版本信息为：CentOS 7。 # CentOS安装lsb_release包 [rootlinux100 ~]# sudo yum install redhat-lsb# 查看Linux版本 [rootlinux100 ~]# lsb_release -a LSB Version: :core-4.1-amd64:core-…

阅读更多...

git tag管理

git tag管理

1. Git 创建tag并推送到云端首先，在本地创建一个新的tag，可以使用 -a 选项添加带有注释信息的annotated tag，或直接创建lightweight tag。例如，若要标记最近一次提交为 v1.0 并附带注释信息： # 创建带有注释信息的a…

阅读更多...

Blender笔记之基本操作

Blender笔记之基本操作

code review! —— 2024-04-27 杭州 Blender笔记…

阅读更多...

c++理论篇(一) ——浅谈tcp缓存与tcp的分包与粘包

c++理论篇(一) ——浅谈tcp缓存与tcp的分包与粘包

介绍在网络通讯中,Linux系统为每一个socket创建了接收缓冲区与发送缓冲区,对于TCP协议来说,这两个缓冲区是必须的.应用程序在调用send/recv函数时,Linux内核会把数据从应用进程拷贝到socket的发送缓冲区中,应用程序在调用recv/read函数时,内核把接收缓冲区中的数据拷贝到应用…

阅读更多...

黑马程序员2024最新SpringCloud微服务开发与实战个人学习心得、踩坑、与bug记录Day1

黑马程序员2024最新SpringCloud微服务开发与实战个人学习心得、踩坑、与bug记录Day1

你好,我是Qiuner. 为记录自己编程学习过程和帮助别人少走弯路而写博客这是我的 github gitee 如果本篇文章帮到了你不妨点个赞吧~ 我会很高兴的 😄 (^ ~ ^) 想看更多那就点个关注吧我会尽力带来有趣的内容 2024黑马程序员 SpringCloud微服务开发与实战&#xff…

阅读更多...

FPGA高端项目：FPGA帧差算法多目标图像识别+目标跟踪，提供11套工程源码和技术支持

FPGA高端项目：FPGA帧差算法多目标图像识别+目标跟踪，提供11套工程源码和技术支持

目录 1、前言免责声明 2、相关方案推荐FPGA帧差算法单个目标图像识别目标跟踪 3、详细设计方案设计原理框图运动目标检测原理OV5640摄像头配置与采集OV7725摄像头配置与采集RGB视频流转AXI4-StreamVDMA图像缓存多目标帧差算法图像识别目标跟踪模块视频输出Xilinx系列FPGA工程源…

阅读更多...

JET毛选学习笔记：如何利用《矛盾论》从做实验到做科研vol. 2

JET毛选学习笔记：如何利用《矛盾论》从做实验到做科研vol. 2

上一节讲完矛盾的普遍性和特殊性都已经5000字了，为了不影响阅读观感（多水几篇），把他们进行了拆分，那我就继续侃大山吧。五、矛盾的同一性和斗争性先做名词解释： 矛盾的同一性（统一&#xf…

阅读更多...

【c++】cpp类的继承

【c++】cpp类的继承

目录 （1）继承概念与语法 （2）派生类的访问控制 （3）继承中的构造和析构 1.类型兼容性原则 2.继承中的构造析构调用原则 3.继承与组合混搭下构造和析构调用原则 （4）同名成员(函数…

阅读更多...

slice

slice

最重要的一张图 endlessSummer :summer[:5]//这是这张图真正厉害的地方为什么向函数传递slice允许在函数内部修改底层数组的元素？ 因为slice值包含指向第一个sllice元素的指针，传入的slice允许在函数内部修改底层数组的元素。复制的slice只是对底层的…

阅读更多...

LabVIEW与Modbus协议的多点温度监控系统

LabVIEW与Modbus协议的多点温度监控系统

LabVIEW与Modbus协议的多点温度监控系统随着工业自动化和智能化水平的不断提升，对于现场监控技术的需求日益增长。开发了一种基于LabVIEW与Modbus协议的多点温度监控系统，实现高效、准确的温度数据采集、处理和显示，以及数据存储功能&#…

阅读更多...

TCP/IP协议族中的TCP（一）：解析其关键特性与机制

TCP/IP协议族中的TCP（一）：解析其关键特性与机制

⭐小白苦学IT的博客主页⭐ ⭐初学者必看：Linux操作系统入门⭐ ⭐代码仓库：Linux代码仓库⭐ ❤关注我一起讨论和学习Linux系统前言 TCP（Transmission Control Protocol，传输控制协议）是一种面向连接的、可靠的、基于字…

阅读更多...

Spring Boot 3自定义注解+拦截器+Redis实现高并发接口限流

Spring Boot 3自定义注解+拦截器+Redis实现高并发接口限流

在当今互联网应用开发中，高并发访问是一个常见的挑战。为了保障系统的稳定性和可靠性，我们需要对接口进行限流，防止因过多的请求导致系统崩溃。本文将介绍如何利用Spring Boot 3中的自定义注解、拦截器和Redis实现高并发接口限流&#xff0…

阅读更多...

牛客社区帖子分页显示实现

牛客社区帖子分页显示实现

下图是前端分页的组件： 下面是对应的静态html页面，每一个方块，都是一个a标签，可以点击，执行的链接是/community/index，GET请求，拼接的参数是current，也就是pageNum，只需…

阅读更多...

使用Python实现语音识别与处理模型

使用Python实现语音识别与处理模型

语音识别与处理是一项重要的人工智能技术，它可以将人类语音转换成文本形式，从而实现语音命令识别、语音转写等功能。在本文中，我们将介绍语音识别与处理的基本原理和常见的实现方法，并使用Python来实现这些模型。什么是语音识别…

阅读更多...

力扣HOT100 208. 实现Trie（前缀树）

力扣HOT100 208. 实现Trie（前缀树）

解题思路： class Trie {private Trie[] children; // 存储子节点的数组private boolean isEnd; // 记录是否为单词结尾public Trie() {children new Trie[26]; // 数组大小为26，代表26个小写字母isEnd false;}public void insert(String word) {Trie …

阅读更多...

智能小程序 Ray 开发实践——基础内容组件 Text 和 Icon 介绍

Text 文本内容。导入 import { Text } from ray-js/ray; Props 属性类型默认值说明支持平台classNamestring样式名涂鸦、微信selectablebooleanfalse文本是否可选涂鸦、微信onClick(e: { type: click }) > voidfalse点击事件涂鸦、微信示例代码基本使用 import Re…

阅读更多...

【yolov8算法道路-墙面裂缝检测-汽车车身凹陷-抓痕-损伤检测】

【yolov8算法道路-墙面裂缝检测-汽车车身凹陷-抓痕-损伤检测】

yolo算法道路-墙面裂缝检测-汽车车身凹陷-抓痕-损伤检测 1. yolo算法裂缝检测-汽车车身凹陷-抓痕检测-汽车车身损伤检测2. yolo房屋墙面路面裂缝-发霉-油漆脱落-渗水-墙皮脱落检测3. 水泥墙面裂缝检测 YOLOv8算法是一种先进的目标检测技术，它基于YOLO系列算法的改进…

阅读更多...

探索矿业数字化平台：实现智能化采矿与管理

探索矿业数字化平台：实现智能化采矿与管理

随着信息技术的迅猛发展，矿业领域也在逐步实现数字化转型。数字化平台的出现为矿业企业带来了更高效、更智能的采矿与管理方式。本文将探讨矿业数字化平台的意义、特点以及未来发展方向。 ### 1. 数字化平台的意义传统的矿业生产和管理方式存在诸多问题&#xff…

阅读更多...

最新文章