图像处理与视觉感知复习--图像特征描述图像生成

文章目录

  • 角点(关键点)的特点
  • 图像分类的流程
  • 梯度方向直方图(HOG)流程
  • 平移、旋转和尺度特征(SIFT)流程
  • 常用的图像生成模型
  • GAN的原理
  • Diffusion Model的原理
  • mAP计算方法

角点(关键点)的特点

  • 紧致&高效:关键点数目比像素少很多
  • 显著性:关键点是独特的、有特色的
  • 局部特性:关键点占据图像的相对较小区域;对杂波和遮挡具有鲁棒性
  • 重复性/再现性:无论几何或光学变换,同一关键点都能被检测到

图像分类的流程

在这里插入图片描述

梯度方向直方图(HOG)流程

在这里插入图片描述

平移、旋转和尺度特征(SIFT)流程

核心步骤:将一幅图像映射(变换)为一个局部特征向量集;特征向量具有平移、缩放、旋转不变性,同时对光照变化、仿射及投影变换也有一定不变性。

在这里插入图片描述
关键点定义:在不同尺度空间的图像下,检测出的具有方向信息的局部极值点。根据归纳我们可以看出特征点具有三个特征:尺度、方向、大小

关键点检测:

  • 尺度空间极值检测
  • 关键点定位
  • 确定关键点方向

关键点描述:

  1. 确定计算描述子所需的图像区域
  2. 将坐标移至关键点主方向,进行坐标旋转,以实现旋转不变性
  3. 在图像半径区域内,对每个像素点求其梯度幅值和方向,梯度幅值乘以高斯权重参数,生成方向直方图。
  4. 在窗口宽度为 2 × 2 2 \times 2 2×2的区域内计算8个方向的梯度方向直方图,绘制每个梯度方向的累加值,即可形成一个种子点
  5. 描述子向量元素门限及门限化后的描述子向量规范化。

关键点匹配:
可以采用穷举法完成。一般都采用一种kd树的数据结构来完成搜索。

常用的图像生成模型

  • 变分自编码器(VAE)
  • 扩散模型(Diffusion Model)
  • 生成对抗网络(Generative Adversarial Network, GAN)

GAN的原理

GAN的训练过程如下:

  • 训练鉴别器
    1. 从训练集中随机抽取真实样本x
    2. 获取一个新的随机噪声向量,并使用生成器生成一个伪造实例 x f x_f xf
    3. 使用鉴别器x和 x f x_f xf进行分类
    4. 计算分类误差并方向传播总误差,以更新鉴别器的可训练参数,将分类误差降至最低
  • 训练生成器
    1. 获得一个新的随机噪声向量z,并使用生成器生成一个伪造示例 x f x_f xf
    2. 使用鉴别器对 x f x_f xf进行分类
    3. 计算分类误差并反向传播该误差,以更新生成器的可训练参数,使鉴别器误差最大化
  • 结束
    平衡状态:
    1. 生成器生成的伪造示例与训练数据集中的真实示例没有区别
    2. 鉴别器只能依靠随机猜测来确定一个特定示例是真实还是伪造的(以1:1的比例猜测一个示例是真实的)

Diffusion Model的原理

扩散模型受扩散原理的启发,扩散模型的工作原理是通过添加高斯噪声(这个步骤是Forward diffusion process)来破坏训练数据,然后学习如何通过逐步反转该添加噪声的过程(这个步骤是reverse process)来恢复原始信息。经过训练,这些模型可以通过充满噪声的图片预测noise、减去 noise然后生成新图片。模型通过最大似然化估计进行训练,目标是学习如何从任意噪声水平的数据恢复到真实数据,在训练完成后,数据生成从标准高斯噪声开始,逐步应用学到的逆变换,通过去噪声步骤逐步生成最终的数据样本。

mAP计算方法

重新定义 T P , F P , T N , F N TP, FP, TN, FN TP,FP,TN,FN

  • T P TP TP: 有预测的边界框与给定类的目标边界框的 I O U > 0.5 IOU > 0.5 IOU>0.5
  • F P FP FP: 有预测的边界框与给定的目标边界框的 I O U < 0.5 IOU < 0.5 IOU<0.5
  • F N FN FN: 对于目标边界框没有预测的边界框

在这里插入图片描述

  • 准确率:衡量的是预测为正的结果中,实际正确的比例
    P r e c i s i o n = T P T P + F P Precision = \dfrac{TP}{TP + FP} Precision=TP+FPTP

  • 召回率:测量正确预测的实际正例的比例
    R e c a l l = T P T P + F N Recall = \dfrac{TP}{TP + FN} Recall=TP+FNTP

  • 平均精度(Average Precision, AP)衡量了模型对正样本的预测准确性,通过不同的召回率下计算并平均精确率来得到,(绘制PR图,下面的面积)形成一个曲线下的面积,较高AP值意味着模型具有更好的检测性能,而AP = 1表示模型的检测是完美的

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.mzph.cn/diannao/28823.shtml

如若内容造成侵权/违法违规/事实不符,请联系多彩编程网进行投诉反馈email:809451989@qq.com,一经查实,立即删除!

相关文章

QY-22 低功耗墒情监测站 厂家直营 无线传输

产品概述 低功耗墒情监测站基于传感、无线通信、处理与控制等物联网技术的开发&#xff0c;利用传感技术&#xff0c;通过传感器测量土壤墒情&#xff0c;并使用物联网进行传输。无需专门的通信线路&#xff0c;在联网的状态下&#xff0c;数据可快速、主动的上报到云平台&…

Vue48-ref属性

一、需求&#xff1a;操作DOM元素 1-1、使用原生的id属性 不太好&#xff01; 1-2、使用 ref属性 原生HTML中&#xff0c;用id属性给元素打标识&#xff0c;vue里面用ref属性。 给哪个元素加了ref属性&#xff0c;vc实例对象就收集哪个元素&#xff01;&#xff01;&#xff0…

光流法大全

H-S光流法 https://blog.csdn.net/Jianwen_Jiang/article/details/79094864 https://blog.csdn.net/jpc20144055069/article/details/96475084 金字塔迭代&#xff08;Iterative Pyramidal&#xff09;LK光流算法 https://github.com/MichaelBeechan/orbslam2-with-…

HTML初体验

可参考jd.com官网&#xff0c;ctrlu查看当前页面源代码 找到你的项目&#xff0c;在项目中创建html类型的网页文件 标准的HTML正确书写格式 <!DOCTYPE html> <html lang"en"> <head><meta charset"UTF-8"><title>Title&…

仅靠独立网站也能赚到100万,真的太牛了

你听说过 Photopea 吗&#xff1f;这是一个免费的类似 Photoshop 的图像编辑器。 这个项目&#xff1a; 每月1300万访问量每月150万用户使用小时每月10万美元的广告收入 Photopea 项目的天才创造者是 Ivan Kutskir。 令人惊讶的是&#xff0c;他独自处理了每日50万用户&…

Tomcat配置详解

文章目录 一、配置文件介绍配置文件日志文件 二、组件组件分层和分类核心组件Tomcat处理请求过程URL对应关系 三、部署java程序手动部署搭建博客状态页 四、常见配置详解tomcat端口号安全配置管理虚拟主机配置Context配置 四、Tomcat Nginx动静分离 一、配置文件介绍 配置好环…

区间DP——AcWing 282. 石子合并

区间DP 定义 区间 DP 是动态规划的一种特殊形式&#xff0c;主要是在一段区间上进行动态规划计算。 运用情况 通常用于解决涉及在一段区间内进行操作、计算最优值等问题。比如计算一个区间内的最大子段和、最小分割代价等。一些常见的场景包括合并操作、划分操作等在区间上…

夏季河湖防溺水新举措:青犀AI视频智能监控系统保障水域安全

近日一则新闻引起大众关注&#xff0c;有网友发布视频称&#xff0c;假期在逛西湖时&#xff0c;发现水面上“平躺”漂浮着一名游客在等待救援。在事发3分钟内&#xff0c;沿湖救生员成功将落水游客救到了岸边。 随着夏季的到来&#xff0c;雨水增多&#xff0c;各危险水域水位…

【镜像制作】制作k8s的yaml配置的备份镜像

文章目录 简介一.备份代码二.dockerfile代码三.cronjob配置 简介 通过shell脚本写一个定期备份k8syaml配置的镜像&#xff0c;然后通过cronjob来实现定期执行&#xff0c;将备份文件上传到ceph存储或者是存放到NAS存储上。 一.备份代码 通过kubectl导出yaml配置文件&#xff0c…

什么是服务器系统端口隐患?

对于服务器来说&#xff0c;首要保障稳定性和安全性。因此&#xff0c;我们仅需保证服务器最基本的功能即可&#xff0c;就像声卡都是默认禁止的。我们并不需要太多的功能&#xff0c;也不需要太多的端口支持。像一些不必要&#xff0c;而且风险较高的端口大可封掉。而一些必要…

如何下载GoldWave 6.80软件及详细安装步骤

GoldWave功能介绍&#xff1a; GoldWave是一款很强大多功能数字音频编辑软件&#xff0c;可以用来消除某些音乐里边的噪音&#xff0c;可以用来声音编缉、播放、录制和转换还是多功能。它的音频特效有很多种可供选择。 GoldWave音频编辑软件与Windows其它应用软件一样&#x…

在Git上,提交记录有误,修改commit方法

在GitLab上&#xff0c;如果你发现提交(commit)有误&#xff0c;可以采取以下几种方式来修正&#xff0c;具体选择哪种方法取决于你的具体情况和需求&#xff1a; 1. 修改最近一次提交&#xff08;Amend&#xff09; 如果你只是想修改最近一次提交的信息&#xff08;比如提交…

GaussDB技术解读——GaussDB架构介绍(四)

目录 11 GaussDB云原生架构 11.1 云原生关键技术架构 11.2 关键技术方案 11.2.1 通信组件 11.2.2 集群管理组件 11.2.3 多租组件 GaussDB架构介绍&#xff08;三&#xff09;从智能关键技术方案、驱动接口关键技术方案等方面对GaussDB架构进行了解读&#xff0c;本篇将…

SpringCloud:Feign远程调用

程序员老茶 &#x1f648;作者简介&#xff1a;练习时长两年半的Java up主 &#x1f649;个人主页&#xff1a;程序员老茶 &#x1f64a; P   S : 点赞是免费的&#xff0c;却可以让写博客的作者开心好久好久&#x1f60e; &#x1f4da;系列专栏&#xff1a;Java全栈&#…

为什么裁员裁的都是干活的?

大家好&#xff0c;我是瑶琴呀。 “裁员裁的都是干活的&#xff1f;”&#xff0c;这可能是个错觉。 公司裁员无外乎两种原因&#xff0c;第一&#xff0c;纯纯想降本增效&#xff0c;留下来的人&#xff0c;一个人干两个人的活。这种属于经济型裁员。第二&#xff0c;业务萎…

在python中使用代理模型加快fmu模拟速度

from pyfmi import load_fmu import pandas as pd import matplotlib.pyplot as plt import numpy as np from sklearn.tree import DecisionTreeRegressor # 决策树算法 from sklearn.metrics import r2_score # 全局 FMU 对象 model = load_fmu(rC:\Users\win10\Desktop\GPS…

LeetCode每日一题 | 419 | 甲板上的战舰 |二维数组遍历

✨今天给大家带来的是LeetCode上的第419题——甲板上的战舰(LeetCode 419. Battleships in a Board✨。这道题目是一个经典的二维数组遍历问题&#xff0c;要求我们在一个棋盘中找到所有的战舰。接下来给大家详细讲解一下解题思路和主要的数据结构哦~&#x1f973; 题目描述 …

驾驭未来:智能网关如何革新车联网体验

车联网&#xff08;Internet of Vehicles&#xff09;是一个跨领域的技术综合体&#xff0c;它基于物联网&#xff0c;利用先进的信息通信技术实现车与车、车与路、车与人、车与服务平台等的全方位网络连接。 龙兴物联智能网关是集成了多协议、多接口&#xff0c;具有综合数据采…

[图解]建模相关的基础知识-11

1 00:00:00,700 --> 00:00:05,090 下一个知识点就是函数在集合上的限制 2 00:00:08,290 --> 00:00:10,200 符号可以这样来 3 00:00:10,210 --> 00:00:16,640 F然后一个往下的箭头A 4 00:00:16,650 --> 00:00:19,520 意思就是说F里面的元素 5 00:00:20,120 --&…

解析网络空间的安全威胁与应对

网络空间的安全威胁与应对 网络空间安全威胁概述 网络空间安全威胁涵盖了从传统的网络攻击到复杂的网络战等多个层面。随着网络技术的发展&#xff0c;网络攻击手段日益翻新&#xff0c;包括病毒、木马、钓鱼、DDoS攻击等。这些攻击手段具有隐蔽性强、破坏力大、传播速度快的…