6赞

解决tensorflow训练时内存持续增加并占满的问题

作者：赛亚兔备_393 | 2021-10-21 16:54

今天小编就为大家分享一篇解决tensorflow训练时内存持续增加并占满的问题，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧

记录一次小白的tensorflow学习过程，也为有同样困扰的小白留下点经验。

先说我出错和解决的过程。在做风格迁移实验时，使用预加载权重的VGG19网络正向提取中间层结果，结果因为代码不当，在遍历图片提取时内存持续增长，导致提取几十个图片的特征内存就满了。

原因是在对每一张图片正向传播结束后，都会在留下中间信息。具体地说是在我将正向传播的代码与模型的代码分离了，在每次遍历图片时都会正向传播，在tensorflow中新增加了很多的计算节点（如tf.matmul等等），导致内存中遗留了大量的过期信息。

纠正的做法就是一个前提：避免在循环训练图片时额外使用tf计算资源。

使用placeholder作为输入数据的入口，在模型中定义需要使用的函数，包括正向传播。不要在遍历图片时额外使用tf计算。

遇到这种问题一定要回头检查代码，尤其是在别人写的代码基础上改时。多学习公开的源码。

错误示例：

def build_model(model_path):
  model_input = tf.placeholder('float32', [1, IMAGE_HEIGHT, IMAGE_WIDTH, COLOR_CHANNELS])
  vec1 = ...
  ...... 
  return model_input,vec1
  
def get_style_represent(vec):
  # 一些tf计算操作
  return new_vec

with tf.Session() as sess:
  sess.run(tf.global_variables_initializer())
  img_input,vec1 = build_model(VGG19_MODEL)    # 加载模型
  for cur_img_path in imgs_path_list:   # 遍历图片
    cur_img = load_image(cur_img_path)
    vec1_out = sess.run(vec1, feed_dict = {img_input:cur_img})   # 正向传播输出模型中的vec1
    # 对vec1进行一些处理，此处在遍历图片时额外使用了tensorflow的计算节点，导致在内存中遗留信息
    new_vec = get_style_represent(vec1_out)

正确示例：

def build_model(model_path):
  model_input = tf.placeholder('float32', [1, IMAGE_HEIGHT, IMAGE_WIDTH, COLOR_CHANNELS])
  vec1 = ...
  ...... 
  new_vec = ...    # 将get_style_represent计算操作定义在模型中
  return model_input,vec1,new_vec

with tf.Session() as sess:
  sess.run(tf.global_variables_initializer())
  img_input,vec1,new_vec = build_model(VGG19_MODEL)
  for cur_img_path in imgs_path_list:
    cur_img = load_image(cur_img_path)
    # 一次正向传播将处理后的vec1也得到了，避免在每次图片正向传播时留下额外信息
    vec1_out,new_vec_out = sess.run([vec1,new_vec], feed_dict = {img_input:cur_img})

所以，如果你也遇到了同样的问题，不妨看一下你是不是在迭代过程中额外使用了新的tf计算节点吧。

以上这篇解决tensorflow训练时内存持续增加并占满的问题就是小编分享给大家的全部内容了，希望能给大家一个参考，也希望大家多多支持。

推荐阅读

程序员
使用javapackager将图标添加到包中

如何解决《使用javapackager将图标添加到包中》经验，为你挑选了1个好方法。 ... [详细]
程序员
是否可以在Cloud9 IDE上显示选项卡和空格？

如何解决《是否可以在Cloud9IDE上显示选项卡和空格？》经验，为你挑选了1个好方法。 ... [详细]
程序员
通过Angularjs更新textarea行

如何解决《通过Angularjs更新textarea行》经验，为你挑选了1个好方法。 ... [详细]
程序员
在React Native中循环Json和显示

如何解决《在ReactNative中循环Json和显示》经验，为你挑选了1个好方法。 ... [详细]
程序员
Android中的DBFlow与GreenDao orm库

如何解决《Android中的DBFlow与GreenDaoorm库》经验，为你挑选了0个好方法。 ... [详细]
程序员
与std :: unordered_map或std :: map相比,MFC CMap是否具有良好的性能

如何解决《与std::unordered_map或std::map相比,MFCCMap是否具有良好的性能》经验，为你挑选了1个好方法。 ... [详细]
程序员
无法在MySQL 5.7中更改字符集(从latin到utf8)

如何解决《无法在MySQL5.7中更改字符集(从latin到utf8)》经验，为你挑选了1个好方法。 ... [详细]
程序员
使用Django在没有表单(REST api)的情况下访问POST字段数据

如何解决《使用Django在没有表单(RESTapi)的情况下访问POST字段数据》经验，为你挑选了3个好方法。 ... [详细]
程序员
Solr不会覆盖 - 重复的uniqueKey条目

如何解决《Solr不会覆盖-重复的uniqueKey条目》经验，为你挑选了0个好方法。 ... [详细]
程序员
ng-click不工作angularJS

如何解决《ng-click不工作angularJS》经验，为你挑选了1个好方法。 ... [详细]
程序员
使用Text :: CSV根据变量内容在csv文件上打印一行

如何解决《使用Text::CSV根据变量内容在csv文件上打印一行》经验，为你挑选了1个好方法。 ... [详细]
程序员
Netty应用程序优化

如何解决《Netty应用程序优化》经验，为你挑选了1个好方法。 ... [详细]
程序员
如何在GO中访问地图值？

如何解决《如何在GO中访问地图值？》经验，为你挑选了1个好方法。 ... [详细]
程序员
通过sbt插件添加库依赖项 - 每个子项目

如何解决《通过sbt插件添加库依赖项-每个子项目》经验，为你挑选了0个好方法。 ... [详细]
程序员
PyQt messagebox yes或no with if

如何解决《PyQtmessageboxyes或nowithif》经验，为你挑选了1个好方法。 ... [详细]
程序员
Scala - 块不能包含声明

如何解决《Scala-块不能包含声明》经验，为你挑选了2个好方法。 ... [详细]
程序员
Datepicker和timepicker - 设置最大值和最小值

如何解决《Datepicker和timepicker-设置最大值和最小值》经验，为你挑选了2个好方法。 ... [详细]
程序员
React原生弹性框不使用所有可用空间

如何解决《React原生弹性框不使用所有可用空间》经验，为你挑选了1个好方法。 ... [详细]
程序员
滑行.缓存到外部存储(SD卡)

如何解决《滑行.缓存到外部存储(SD卡)》经验，为你挑选了1个好方法。 ... [详细]
程序员
在JavaScript中,Equal to('=='和'===')之间的区别是什么？

如何解决《在JavaScript中,Equalto('=='和'===')之间的区别是什么？》经验，为你挑选了1个好方法。 ... [详细]

赛亚兔备_393

这个屌丝很懒，什么也没留下！

关注作者

Tags | 热门标签

RankList | 热门文章