Tensorboard--模型可视化工具

Tensorboard

  • 1.tensorboard in tensorflow
    • 1.1 tensorboard的启动过程
    • 1.2 tf.summary 可视化类型
    • 1.3 tf.summary 使用demo
  • 2.tensorboard in pytorch
    • 2.1 SummaryWriter 使用demo1
    • 2.2 tSummaryWriter 使用demo2
    • 2.3 tensorboard 数据再读取

tensorboard in tensorflow :tensorboard 是一套用于tensorflow训练过程可视化工具,能够可视化模型的结构,参数,损失函数等。最常用于记录训练过程中参数和损失函数值的变化,用来反馈模型性能指标的变化。

TensorBoard github readme–基础概念、操作,tf.summary.xxx
Get started with TensorBoard–图像、网络图、网络参数的可视化

tensorboard in pytorch: 有多种方式来使用tensorboard。本文想推荐的是通过 TensorboardX [第三方库] 来使用tensorboard。底层实际还是tensorflow的tensorboard. 在pytorch 代码框架下想要使用tensorboard 的话,需安装以下两个包。 pip install tensorboardX、pip install tensorflow # cpu 版本即可。

PyTorch 自带 TensorBoard 使用教程 – from torch.utils.tensorboard import SummaryWriter
PyTorch 使用 TensorboardX 进行网络可视化–from tensorboardX import SummaryWriter

(pytorch 和 tensorflow 使用tensorboard 之间的差别后续在整理。本文先着重于整理tensor low中tensor board的使用。)

从标黄的三个地方可以看出,Summary这个对象蛮重要的。

1.tensorboard in tensorflow

1.1 tensorboard的启动过程

# 1.创建writer,用于写日志文件
writer=tf.summary.FileWriter('/path/to/logs', tf.get_default_graph())
# 2.保存日志文件
writer.close()
# 3.运行可视化命令,启动服务
tensorboard –logdir /path/to/logs
# 4.打开可视化界面
通过浏览器打开服务器访问端口http://xxx.xxx.xxx.xxx:6006

参考文档–Tensorboard 详解(上篇)

1.2 tf.summary 可视化类型

Tensorboard 需要将可视化的数据存盘,这些数据来自 summary操作[summary ops]。 summary操作和tensorflow的其他ops性质是一致的,它能够产生序列化的protobufs数据,然后使用summary.FileWriter写入磁盘。

tensorboard支持以下操作,也就是tensor board能够可视化的对象类型。

tf.summary.FileWriter()    # 指定一个文件用来保存图,可以调用其add_summary()方法将训练过程数据保存在filewriter指定的文件中,详见使用demo
tf.summary.scalar          # 用于追踪模型的loss,
tf.summary.image
tf.summary.audio
tf.summary.text
tf.summary.histogram
tf.summary.merge_all      # 可以将所有summary全部保存到磁盘

tf.summary.scalar、tf.summary.histogram
建议给每类数据赋予一个tag, scalar 和 histogram 的标签里如果有/, 这些数据在存储的时候会存入对应的目录文件中。

1.3 tf.summary 使用demo

自动管理: tf.summary.merge_all(),猜测是直接将训练输出到tensor board中

summary_writer = tf.summary.FileWriter(dir, flush_secs=60)
summary_writer.add_graph(sess.graph)   #添加graph图
tf.summary.scalar('loss', loss)
tf.summary.scalar('accuracy', accuracy)
sum_ops = tf.summary.merge_all()      #自动管理,就是说要算loss 和 accuracy 呗
metall = sess.run(sum_ops, feed_dict={X: batch_x_test, Y: batch_y_test, keep_prob: 1.})
summary_writer.add_summary(metall, global_step=step) # 写入文件

手动管理:

summary_writer = tf.summary.FileWriter(dir', flush_secs=60)
summary_writer.add_graph(sess.graph)        #添加graph图
loss_scalar = tf.summary.scalar('loss', loss)
accuracy_scalar = tf.summary.scalar('accuracy', accuracy)
loss_metall, accuracy_metall, = sess.run([loss_scalar, accuracy_scalar], feed_dict={X: batch_x_test, Y: batch_y_test, keep_prob: 1.})
summary_writer.add_summary(loss_metall, global_step=step)     # 写入文件
summary_writer.add_summary(accuracy_metall, global_step=step) # 写入文件

参考文档:
Tensorflow学习笔记——Summary用法
tf.summary.merge_all()

构建更复杂的图的代码demo

2.tensorboard in pytorch

2.1 SummaryWriter 使用demo1

from tensorboardX import SummaryWriter
writer1 = SummaryWriter('runs/exp')       # 日志保存在‘runs/exp’路径下
writer2 = SummaryWriter()                 # 默认将使用‘runs/日期时间’路径来保存日志
writer3 = SummaryWriter(comment='resnet') # 使用 runs/日期时间-comment 路径来保存日志# 调用 SummaryWriter 实例的各种 add_something 方法向日志中写入不同类型的数据# 标量
writer1.add_scalar(tag, scalar_value, global_step=None, walltime=None)
# tag 子图标识。相同tag的saclar被放在了同一张图表中,方便对比观察
# scalar_value 要求float类型。如果是tensor,则需要调用.item() 方法获取其数值。# 图像
writer1.add_image(tag, img_tensor, global_step=None, walltime=None, dataformats='CHW')
# img_tensor (torch.Tensor / numpy.array): 图像数据
# dataformats (string, optional): 图像数据的格式# 直方图
writer1.add_histogram(tag, values, global_step=None, bins='tensorflow', walltime=None, max_bins=None)
# values (torch.Tensor, numpy.array, or string/blobname): 用来构建直方图的数据# 网络结构
writer1.add_graph(model, input_to_model=None, verbose=False, **kwargs)
# model (torch.nn.Module): 待可视化的网络模型
# input_to_model (torch.Tensor or list of torch.Tensor, optional): 待输入神经网络的变量或一组变量# 嵌入向量 (embedding),作用:高维特征使用PCA、t-SNE等方法降维至二维平面或三维空间显示,还可观察每一个数据点在降维前的特征空间的K近邻情况。
writer1.add_embedding(mat, metadata=None, label_img=None, global_step=None, tag='default', metadata_header=None)
# 可以运行一下参考论文中的demo 加深印象

参考论文:
详解PyTorch项目使用TensorboardX进行训练可视化

2.2 tSummaryWriter 使用demo2

1.记录数据

from tensorboardX import SummaryWriter
# 设置路径
# 数据将存在代码运行文件目录下的./run/xxxyyy/下的文件中,其中run文件目录,xxx附加名称是自动生成的
path = “yyy” 
selfwriter = SummaryWriter(comment=os.path.split(path)
# 添加要观察数据add_scalar方法保证实时观察
# global_step 数据步长
selfwriter.add_scalar("Grad/gradD", d_grad_mean, global_step=dis_iter# ations)
....
selfwriter.add_scalar("Loss/lossD", loss_D, global_step=dis_iterations)
....

2.显示数据:切换至./run/xxxpath/下,运行以下命令,在输出信息中打开对应的网页链接

tensorboard --logdir .

2.3 tensorboard 数据再读取

使用tensorboard 记录实验数据,可以启动服务后,在网页上实时看到被记录指标的变换情况。有时需操作记录下来的数据,那么就涉及到tensorboar 数据再读取问题。

参考博文:https://blog.csdn.net/nima1994/article/details/82844988#commentBox
读取的接口的github 库:https://github.com/tensorflow/tensorboard/blob/master/tensorboard/backend/event_processing/event_accumulator.py

from tensorboard.backend.event_processing import event_accumulator
import matplotlib.pyplot as plt
# 加载日志数据
path = "./runs/xxxyyy/events.out.tfevents.1609854743.pp-System-Product-Name"
ea = event_accumulator.EventAccumulator(path)
# 数据再载入
ea.Reload()
# 输出所有图对应的keys,之后会依据这个keys取出对应的数据
print(ea.scalars.Keys())grad_d = ea.scalars.Items('Grad/gradD')
grad_g = ea.scalars.Items('Grad/gradG')
nd, ng = len(grad_d), len(grad_g)
# 数据长度,event_accumulator默认的数据载入压缩比为500:1,最多载入10000个点
# 所以数据很多的话。最多也就是载入10000个点,我是有后续的点被舍弃掉了么?两个都是10000,但是数据量明明不一样?
print(nd,ng)
# 数据后加工,这里就是展示了绘制
# 数据是[(.step, .value),(),()] 的形式存的
figure = plt.figure()
axes1 = figure.add_subplot(2,1,1)
axes2 = figure.add_subplot(2,1,2)
axes1.plot([i.step for i in grad_d], [i.value for i in grad_d])
axes2.plot([i.step for i in grad_g], [i.value for i in grad_g])
axes1.set_title("grad d")
axes2.set_title("grad g")
plt.savefig("grad_any.png")

下图中上下两子图都包含1万个点,那只能说明采样率不同?(60万个点采1万个Vs 12万个点采1万个)

在这里插入图片描述

如何实现的自动采样率?修改总的采样点数,还需要查看官网接口。(具体效果没有验证过)
初步查看应该修改event_accumulator.EventAccumulator(path)类实例话时的参数size_guidance,不传入时默认为:

DEFAULT_SIZE_GUIDANCE = {COMPRESSED_HISTOGRAMS: 500,IMAGES: 4,AUDIO: 4,SCALARS: 10000,HISTOGRAMS: 1,TENSORS: 10,
}

tf.summary.merge_all 可以将所有summary全部保存到磁盘,以便tensorboard显示。
这个tensorbord 可以显示模型结构?
再看一看这个玩意
summary.merge_all() 的用法

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.mzph.cn/news/444645.shtml

如若内容造成侵权/违法违规/事实不符,请联系多彩编程网进行投诉反馈email:809451989@qq.com,一经查实,立即删除!

相关文章

opencv findContours 报错_acrt_first_block == header

报错_acrt_first_block header 之前一直使用OpenCV3.3VS2015 void AOIAlgorithm::findUnits(Mat& blkGray, vector<vector<cv::Point>> & blkContours) {Mat blkOBW;blur(blkGray, blkGray, cv::Size(5, 5));threshold(blkGray, blkOBW, 0, 255, CV_THR…

TensorFlow(2)-训练数据载入

tensorflow 训练数据载入1. tf.data.Dataset2. dataset 创建数据集的方式2.1 tf.data.Dataset.from_tensor_slices()2.2 tf.data.TextLineDataset()2.3 tf.data.FixedLengthRecordDataset()2.4 tf.data.TFRecordDataset()3. dateset 迭代操作iterator3.1 make_one_shot_iterato…

leetcode66. 加一

给定一个由整数组成的非空数组所表示的非负整数&#xff0c;在该数的基础上加一。 最高位数字存放在数组的首位&#xff0c; 数组中每个元素只存储单个数字。 你可以假设除了整数 0 之外&#xff0c;这个整数不会以零开头。 示例 1: 输入: [1,2,3] 输出: [1,2,4] 解释: 输入…

设备硬件加密方法

在机器视觉或者一些传统制造业行业里经常牵扯到软件加密算法,或者一些简单的加密,比如相机绑定,或者USB接口绑定之类的,那么针对这些硬件设备绑定加密方式,我这里简单的提供一个方法来实现: 方法很简单,从设备管理器里查找关心的USB设备,对比PID,VID和全球唯一标识GU…

addr2line 和 tombstone问题分析

做安卓开发的同学对于tombstone问题应该是很熟悉了,但是对于如何排查和分析值得总结和整理的,这篇文章对入门安卓开发的技术来说是个入门指导,同时对安卓开发的中高级开发也有借鉴。 首先我们来说下什么是tombstone : 当一个动态库(native 程序)开始执行时,系统会注册…

TensorFlow(3)-与训练相关的操作

与训练相关的操作0 gpu版本的tensor flow安装1. tf.control_dependencies(update_ops)0 gpu版本的tensor flow安装 cuda10.2 conda create -n py27 python2.7 conda activate py27 pip install tensorflow1.14.0 验证 gpu版本的tensor可用 import tensorflow as tf print(tf.t…

leetcode14. 最长公共前缀

编写一个函数来查找字符串数组中的最长公共前缀。 如果不存在公共前缀&#xff0c;返回空字符串 ""。 示例 1: 输入: ["flower","flow","flight"] 输出: "fl" 示例 2: 输入: ["dog","racecar",&quo…

Android在子线程里使用Toast报错Can't toast on a thread that has not called Looper.prepare()

在接android SDK的时候有时候为了方便debug调试查看&#xff0c;通过Toast输出相关信息&#xff0c; 实际上这个是在子线程中输出的&#xff0c;在logcat里查看有如下报错java.lang.RuntimeException: Cant toast on a thread that has not called Looper.prepare()。 解决办法…

虚拟机安装windows2012和虚拟机安装国产系统deepin

虚拟机安装windows2012和虚拟机安装国产系统deepin 一.安装windows20121.安装VMWare虚拟机2.1.注意点一&#xff1a;VMWare虚拟网卡2.2.注意点二&#xff1a;配置虚拟网络编辑器3.安装配置Windows Server 2012 R2 二.虚拟机安装deepin1.deepin官网下载ios镜像2.deepin下载合适的…

leetcode876 链表中间的结点

给定一个带有头结点 head 的非空单链表&#xff0c;返回链表的中间结点。 如果有两个中间结点&#xff0c;则返回第二个中间结点。 示例 1&#xff1a; 输入&#xff1a;[1,2,3,4,5] 输出&#xff1a;此列表中的结点 3 (序列化形式&#xff1a;[3,4,5]) 返回的结点值为 3 。 …

TensorFlow(4)-TFRecord

TFRecord1. tf.train.Example1.1 tfrecord 数据范式转化1.2 demo 数据集构建2. TFRecord 读写2.1 写入1-tf.io.TFRecordWriter()2.3 读取-tf.data.TFRecordDataset()2.3 data -> dataset -> 存储-tf.data.experimental.TFRecordWriter()tfrecord 用于存储二进制序列数据的…

Playfab开发(一)如何调用PlayFab接口

本人从事海外游戏制作和发行,参与了不少海外研发团队studio的项目,这里我将个人接触到的一些使用Playfab开发的项目心得分享给大家。 PlayFab简介 playfab是一家主要为游戏开发人员提供游戏开发和管理的跨平台工具及服务的公司, PlayFab正在构建当今游戏所需的所有基于云的…

PlayFab(二)如何通过Demo应用来进一步熟悉Playfab

有时候刚开始接触新的平台会两眼一麻黑,不过这个文章希望能给读者一些启示,Playfab默认会给开发者提供一个应用,这里我暂且叫他”我的游戏“; 我通过官网提供的DEMO测试地址: https://www.vanguardoutrider.com/#/ 来为该应用配置服务器。 如果你是第一次进入这个页面想为…

leetcode718 最长重复子数组

给两个整数数组 A 和 B &#xff0c;返回两个数组中公共的、长度最长的子数组的长度。 示例 1: 输入: A: [1,2,3,2,1] B: [3,2,1,4,7] 输出: 3 解释: 长度最长的公共子数组是 [3, 2, 1]。 说明: 1 < len(A), len(B) < 1000 0 < A[i], B[i] < 100 思路&#xf…

PaperNotes(20)-TGAN-DeliGAN

GAN的文章2篇1.从RS-GAN说起2.TGANAbstract1 Reviews of GANs2.3 Relate to Turing Test3 Related Works4 Experiments4.1 Design of Discriminator5.Conclusion3 DeliGANAbstract1. Introduction2. Related Work3.GAN4.本文方法5.实验5.1. Modified Inception Score5.2. Toy D…

ubuntu apache配置负载均衡篇(一)

首先下载apache2服务器 apt-get install apache2 使得代理生效: a2enmod proxy proxy_ajp proxy_balancer proxy_connect proxy_ftp proxy_http 修改配置 sudo vi /etc/apache2/mods-enabled/proxy.conf ProxyRequests Off <Proxy *> Order deny,allow Deny …

leetcode108 将有序数组转换为二叉搜索树

将一个按照升序排列的有序数组&#xff0c;转换为一棵高度平衡二叉搜索树。 本题中&#xff0c;一个高度平衡二叉树是指一个二叉树每个节点 的左右两个子树的高度差的绝对值不超过 1。 示例: 给定有序数组: [-10,-3,0,5,9], 一个可能的答案是&#xff1a;[0,-3,9,-10,null,…

ubuntu apache配置负载均衡篇(二)

上篇文章说到了基本的负载均衡配置,这次再说下负载均衡里的反向代理配置项参数:ProxyPass与ProxyPassReverse及ProxyPassMatch 1、ProxyPass: 语法:ProxyPass [path] !|url 它主要是用作URL前缀匹配,不能有正则表达式,它里面配置的Path实际上是一个虚拟的路径,在反向…

MachineLearning(12)- RNN-LSTM-tf.nn.rnn_cell

RNN-LSTM1.RNN2.LSTM3. tensorflow 中的RNN-LSTM3.1 tf.nn.rnn_cell.BasicRNNCell()3.2 tf.nn.rnn_cell.BasicLSTMCell()3.3 tf.nn.dynamic_rnn()--多步执行循环神经网络1.RNN RNN-Recurrent Neural Network-循环神经网络 RNN用来处理序列数据。多层感知机MLP层间节点全联接&…

判断微信小游戏用户是否真的分享

作为开发者,传统的微信分享拿到分享的状态码并不能完全确定玩家是否分享到好友或群。 因此一部分开发者给分享做一个定时器,超过5秒就判定玩家分享成功,实际上很容易被玩家利用。 因此我们可以利用微信分享过程中的图片url链接做文章: 1.需要一个web服务器,提供给客户端…