Tensorflow中使用tfrecord方式读取数据

zoukankan html css js c++ java

Tensorflow中使用tfrecord方式读取数据

使用Tensorflow训练神经网络时，我们可以用多种方式来读取自己的数据。如果数据集比较小，而且内存足够大，可以选择直接将所有数据读进内存，然后每次取一个batch的数据出来。如果数据较多，可以每次直接从硬盘中进行读取，不过这种方式的读取效率就比较低了。此篇博客就主要讲一下Tensorflow官方推荐的一种较为高效的数据读取方式——tfrecord。

从宏观来讲，tfrecord其实是一种数据存储形式。使用tfrecord时，实际上是先读取原生数据，然后转换成tfrecord格式，再存储在硬盘上。而使用时，再把数据从相应的tfrecord文件中解码读取出来。那么使用tfrecord和直接从硬盘读取原生数据相比到底有什么优势呢？其实，Tensorflow有和tfrecord配套的一些函数，可以加快数据的处理。实际读取tfrecord数据时，先以相应的tfrecord文件为参数，创建一个输入队列，这个队列有一定的容量（视具体硬件限制，用户可以设置不同的值），在一部分数据出队列时，tfrecord中的其他数据就可以通过预取进入队列，并且这个过程和网络的计算是独立进行的。也就是说，网络每一个iteration的训练不必等待数据队列准备好再开始，队列中的数据始终是充足的，而往队列中填充数据时，也可以使用多线程加速。

tfrecord的存储和读取看一下链接：

http://blog.csdn.net/qq_16949707/article/details/53483493

http://www.360doc.com/content/17/0611/21/42392246_661965445.shtml

查看全文

相关阅读:
SET/JFace ProgressIndicator的使用以及来回滚动进度条实际使用示例
 Java/SWT/JFace项目打包总结注意事项
 StyledText实现的简单Java类文件编辑器
 命令行界面的简单银行系统
 TC二次开发遇到的问题总结
 用Java模仿简单的Ping命令
 Oracle SQL Developer定制每天执行一次存储过程的计划任务
 关于SpringMVC中text/plain的编码导致的乱码问题解决方法
 Spring框架下的定时任务quartz框架的使用
 Delphi 函数参数修饰中的var 、out和const

原文地址：https://www.cnblogs.com/sunshine8/p/7880365.html