FCN源码解读之solve.py

转载自 https://blog.csdn.net/qq_21368481/article/details/80636932

solve.py是FCN中解决方案文件，即通过执行solve.py文件可以实现FCN模型的训练和测试过程。以下拿voc-fcn32s文件夹里的solve.py举例分析。

一、源码及分析如下：


   
     
     
     
     
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       #coding=utf-8
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       import caffe
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       import surgery, score
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       import numpy 
       as np
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       import os
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       import sys
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       try:
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
            
       import setproctitle
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           setproctitle.setproctitle(os.path.basename(os.getcwd()))
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       except:
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
            
       pass
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       #加载网络模型的参数信息
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       weights = 
       '../ilsvrc-nets/vgg16-fcn.caffemodel'
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       # init 初始化（选择要执行此代码训练的GPU）
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       caffe.set_device(int(sys.argv[
       1])) 
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       caffe.set_mode_gpu()
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       #使用caffe中的随机梯度下降法解决方案（SGDSolver，也即FCN模型训练时每次迭代只训练一张图片）
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       solver = caffe.SGDSolver(
       'solver.prototxt')
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       solver.net.copy_from(weights) 
       #直接从上述加载的模型中拷贝参数初始化网络
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       # surgeries 由于Vgg16模型是没有上采样层的，所以遇到上采样层（即含有'up'字眼的层），需要利用surgery.py中的interp()函数进行
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       #这些层的初始化，所采用的初始化方法是双线性插值，详见我的另一篇博客https://blog.csdn.net/qq_21368481/article/details/80289350
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       interp_layers = [k 
       for k 
       in solver.net.params.keys() 
       if 
       'up' 
       in k]
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       surgery.interp(solver.net, interp_layers)
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       # scoring val中保存测试集的索引号
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       val = np.loadtxt(
       '../data/segvalid11.txt', dtype=str) 
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       #总训练次数为25*4000=100000次（注：这里不修改的话，直接在solve.prototxt中修改max_iter是没有用的）
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       for _ 
       in range(
       25):
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           solver.step(
       4000)  
       #每训练4000次，进行一次测试，并保存一下模型参数（对应solve.prototxt中的snapshot: 4000）
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           score.seg_tests(solver, 
       False, val, layer=
       'score')

但是直接执行上述代码是无法运行的，会报很多错误，需要进行修改才能运行，具体修改后的代码如下（读者可以和上述源码对比一下，做出相应的修改）：


   
     
     
     
     
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       #coding=utf-8
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       import sys  
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       sys.path.append(
       'D:/caffe/caffe-master/python')  
       #加载caffe中的python文件所在路径（以免报错），注意要加载自己的
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       import caffe
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       import surgery, score
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       import numpy 
       as np
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       import os
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       try:
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           
       import setproctitle
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           setproctitle.setproctitle(os.path.basename(os.getcwd()))
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       except:
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           
       pass
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       '''
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       加载Vgg16模型参数（原因在于FCN中FCN32s是在Vgg16模型上fine-tune来的，而
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       FCN16s是在FCN32s的基础上训练的，所以在FCN16s的solve.py文件中要加载FCN32s
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       训练完后的模型（例如caffemodel-url中给的fcn32s-heavy-pascal.caffemodel，
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       caffemodel-url文件在每个FCN模型文件夹都有，例如voc-fcn32s文件夹，直接
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       复制里面的网址下载即可），FCN8s的加载FCN16s训练好的模型参数。
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       Vgg16模型参数和其deploy.prototxt文件可从我提供的百度云链接上下载：
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       '''
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       vgg_weights = 
       'vgg16-fcn.caffemodel'  
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       vgg_proto = 
       'vgg16_deploy.prototxt'   
       #加载Vgg16模型的deploy.prototxt文件
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       #weights = '../ilsvrc-nets/vgg16-fcn.caffemodel'
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       # init 初始化
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       #caffe.set_device(int(sys.argv[1]))
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       caffe.set_device(
       0)
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       caffe.set_mode_gpu()  
       #如果是CPU训练修改为caffe.set_mode_cpu()，但是好像CPU带不起FCN这个庞大模型（内存不够）
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       solver = caffe.SGDSolver(
       'solver.prototxt')
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       #solver.net.copy_from(weights)
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       vgg_net = caffe.Net(vgg_proto, vgg_weights, caffe.TRAIN)  
       #利用上述加载的vgg_weights和vgg_proto初始化Vgg16网络
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       #将上述网络通过transplant()函数强行复制给FCN32s网络（具体复制方法仍可参见我的
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       #另一篇博客https://blog.csdn.net/qq_21368481/article/details/80289350）
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       surgery.transplant(solver.net, vgg_net)  
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       del vgg_net  
       #删除Vgg16网络
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       # surgeries
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       interp_layers = [k 
       for k 
       in solver.net.params.keys() 
       if 
       'up' 
       in k]
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       surgery.interp(solver.net, interp_layers)
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       #此处训练集的路径需要换成自己的，其中的seg11valid.txt里存放的是训练集每张图片的文件名（不包含扩展名）
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       #可以自行设置哪些图片作为训练集（个人建议直接拿Segmentation文件夹中的val.txt里的当做训练集）
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       val = np.loadtxt(
       'D:/VOC2012/ImageSets/Segmentation/seg11valid.txt', dtype=str)
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       for _ 
       in range(
       25):
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           solver.step(
       4000)
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           score.seg_tests(solver, 
       False, val, layer=
       'score')

1.1 运行

在修改完上述文件的情况下，如果是windows下（装了Anaconda的话直接打开Anaconda Prompt，如果没装的话直接cmd打开命令提示符窗口），直接在voc-fcn32s文件路径下输入以下语句即可进行训练。

python solve.py

如下图所示：

如果在linux下，打开终端，也在voc-fcn32s文件路径下输入以下语句：

sudo python solve.py

如下图所示：

1.2 常见错误

（1）ImportError: No module named surgery

将与voc-fcn32s文件夹同一根目录下的surgery.py文件复制到voc-fcn32s文件夹中，并在开头添加如下代码：


   
     
     
     
     
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       from __future__ 
       import division
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       import sys  
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       sys.path.append(
       'D:/caffe/caffe-master/python')  
       #添加自己caffe中的python文件夹路径
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       import caffe
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       import numpy 
       as np

如果还报No module named score等，同理解决。

（2）路径错误

训练前，还需要修改一下train.prototxt和val.prototxt中的data层中数据集加载路径，拿train.prototxt为例，'sbdd_dir'后的路径修改为自己数据集的路径。


   
     
     
     
     
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       layer {
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
         name: 
       "data"
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
         type: 
       "Python"
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
         top: 
       "data"
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
         top: 
       "label"
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
         python_param {
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           module: 
       "voc_layers"
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           layer: 
       "SBDDSegDataLayer"
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           param_str: 
       "{\'sbdd_dir\': \'D:/VOC2012\', \'seed\': 1337, \'split\': \'train\', \'mean\': (104.00699, 116.66877, 122.67892)}"
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
         }
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       }

同时也要修改一下voc_layers.py文件，因为这里面也有训练集和测试集的加载路径，且在训练过程中是会时时通过这个文件下的代码加载训练图片（原因在于上述train.prototxt中是data层中的module："voc_layers"，所代表的意思就是通过voc_layers.py自行定义的训练集和测试集加载方式来加载），测试图片加载同理。

主要修改其中的class SBDDSegDataLayer(caffe.Layer)类中的setup(self, bottom, top)函数中的路径和load_label(self, idx)函数中的数据集格式以及class VOCSegDataLayer(caffe.Layer)类中的setup(self, bottom, top)函数的路径，都修改为自己的。

详细可参见我的另一篇博客：https://blog.csdn.net/qq_21368481/article/details/80246028。

二、实时绘制loss-iter曲线

caffe中的loss分两种，一种是本次单次迭代输出的loss，一种是多次迭代的平均loss，具体可以参见caffe中的src文件夹下的solver.cpp中的Step(int iters) 函数和UpdateSmoothedLoss(Dtype loss, int start_iter, int average_loss) 函数。

如下所示，Iteration 20, loss = 390815中的loss为20次迭代输出的平均loss，而rain net output #0: loss = 151572为本次单次迭代输出的loss，也即为何两者是不同的（只有在Iteration 0时两者才会相同，因为平均loss是从0开始累加求平均计算出来，第0次迭代输出的平均loss就是第0次迭代输出的loss）。

平均loss的好处的更加平滑，当然不用loss直接用单次的loss都是一样的，两者都能反映训练过程中loss的变化趋势。


   
     
     
     
     
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       I0611 
       22:
       14:
       55.219404  
       6556 solver.cpp:
       228] Iteration 
       0, loss = 
       557193
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       I0611 
       22:
       14:
       55.219404  
       6556 solver.cpp:
       244]     Train net output 
       #0: loss = 557193 (* 1 = 557193 loss)
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       I0611 
       22:
       14:
       55.233840  
       6556 sgd_solver.cpp:
       106] Iteration 
       0, lr = 
       1e-010
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       I0611 
       22:
       15:
       03.114138  
       6556 solver.cpp:
       228] Iteration 
       20, loss = 
       390815
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       I0611 
       22:
       15:
       03.114138  
       6556 solver.cpp:
       244]     Train net output 
       #0: loss = 151572 (* 1 = 151572 loss)
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       I0611 
       22:
       15:
       03.115141  
       6556 sgd_solver.cpp:
       106] Iteration 
       20, lr = 
       1e-010
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       I0611 
       22:
       15:
       11.631978  
       6556 solver.cpp:
       228] Iteration 
       40, loss = 
       299086
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       I0611 
       22:
       15:
       11.632982  
       6556 solver.cpp:
       244]     Train net output 
       #0: loss = 22125.5 (* 1 = 22125.5 loss)
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       I0611 
       22:
       15:
       11.634985  
       6556 sgd_solver.cpp:
       106] Iteration 
       40, lr = 
       1e-010
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       I0611 
       22:
       15:
       19.864284  
       6556 solver.cpp:
       228] Iteration 
       60, loss = 
       238765
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       I0611 
       22:
       15:
       19.865325  
       6556 solver.cpp:
       244]     Train net output 
       #0: loss = 154152 (* 1 = 154152 loss)
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       I0611 
       22:
       15:
       19.866287  
       6556 sgd_solver.cpp:
       106] Iteration 
       60, lr = 
       1e-010

1.Step(int iters) 函数


   
     
     
     
     
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       template <
       typename Dtype>
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       void Solver::Step(
       int iters) {
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
          
       const 
       int start_iter = iter_;   
       //起始迭代点
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
          
       const 
       int stop_iter = iter_ + iters;  
       //终止迭代点
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
          
       int average_loss = 
       this->param_.average_loss();  
       //平均loss=(前average_loss-1次迭代的loss总和+本次迭代的loss)/average_loss
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
         losses_.clear();  
       //清楚用来保存每次迭代所输出的loss
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
         smoothed_loss_ = 
       0; 
       //smoothed_loss即平均loss（注：每次调用Step()函数平均loss就会清零，即从本次迭代开始重新开始累计求平均）
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
          
       while (iter_ < stop_iter) {
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
            
       // zero-init the params
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           net_->ClearParamDiffs();
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
            
       if (param_.test_interval() && iter_ % param_.test_interval() == 
       0
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
               && (iter_ > 
       0 || param_.test_initialization())
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
               && Caffe::root_solver()) {
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
             TestAll();
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
              
       if (requested_early_exit_) {
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
                
       // Break out of the while loop because stop was requested while testing.
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
                
       break;
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
             }
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           }
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
            
       for (
       int i = 
       0; i < callbacks_.size(); ++i) {
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
             callbacks_[i]->on_start();
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           }
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
            
       const 
       bool display = param_.display() && iter_ % param_.display() == 
       0;
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           net_->set_debug_info(display && param_.debug_info());
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
            
       // accumulate the loss and gradient
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           Dtype loss = 
       0;
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
            
       for (
       int i = 
       0; i < param_.iter_size(); ++i) { 
       //这里的param_.iter_size()对于FCN来说，对应solver.prototxt中的iter_size这个参数
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
             loss += net_->ForwardBackward();  
       //前向计算+后向传播（从中可以看出每次迭代过程中其实是param_.iter_size()次前向计算和后向传播）
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           }
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           loss /= param_.iter_size();  
       //求平均
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
            
       // average the loss across iterations for smoothed reporting
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           UpdateSmoothedLoss(loss, start_iter, average_loss); 
       //更新平均loss
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
            
       if (display) {    
       //一般而言都设置display=average_loss，这里可以看看FCN中是设置
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
             LOG_IF(INFO, Caffe::root_solver()) << 
       "Iteration " << iter_
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
                 << 
       ", loss = " << smoothed_loss_; 
       //输出平均loss
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
              
       const 
       vector*>& result = net_->output_blobs();
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
              
       int score_index = 
       0;
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
              
       for (
       int j = 
       0; j < result.size(); ++j) {
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
                
       const Dtype* result_vec = result[j]->cpu_data();
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
                
       const 
       string& output_name =
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
                   net_->blob_names()[net_->output_blob_indices()[j]];
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
                
       const Dtype loss_weight =
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
                   net_->blob_loss_weights()[net_->output_blob_indices()[j]];
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
                
       for (
       int k = 
       0; k < result[j]->count(); ++k) {
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
                  
       ostringstream loss_msg_stream;
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
                  
       if (loss_weight) {  
       //只有loss层的loss_weight=1，其他层都是0
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
                   loss_msg_stream << 
       " (* " << loss_weight
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
                                   << 
       " = " << loss_weight * result_vec[k] << 
       " loss)";
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
                 }
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
                 LOG_IF(INFO, Caffe::root_solver()) << 
       "    Train net output #"
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
                     << score_index++ << 
       ": " << output_name << 
       " = "
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
                     << result_vec[k] << loss_msg_stream.str(); 
       //输出单次迭代的loss值
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
               }
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
             }
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           }
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
            
       for (
       int i = 
       0; i < callbacks_.size(); ++i) {
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
             callbacks_[i]->on_gradients_ready();
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           }
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           ApplyUpdate();
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
            
       // Increment the internal iter_ counter -- its value should always indicate
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
            
       // the number of times the weights have been updated.
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           ++iter_;
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           SolverAction::Enum request = GetRequestedAction();
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
            
       // Save a snapshot if needed.
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
            
       if ((param_.snapshot()
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
                && iter_ % param_.snapshot() == 
       0
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
                && Caffe::root_solver()) ||
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
                (request == SolverAction::SNAPSHOT)) {
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
             Snapshot();
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           }
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
            
       if (SolverAction::STOP == request) {
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
             requested_early_exit_ = 
       true;
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
              
       // Break out of training loop.
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
              
       break;
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           }
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
         }
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       }

2.UpdateSmoothedLoss(Dtype loss, int start_iter, int average_loss) 函数


   
     
     
     
     
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       void Solver::UpdateSmoothedLoss(Dtype loss, 
       int start_iter,
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
            
       int average_loss) {
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
          
       if (losses_.size() < average_loss) {  
       //如果losses_中还未存储完average_loss次迭代输出的loss，则直接求平均
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           losses_.push_back(loss);
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
            
       int size = losses_.size();
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           smoothed_loss_ = (smoothed_loss_ * (size - 
       1) + loss) / size;  
       //求前size次迭代输出的loss的平均值
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
         } 
       else { 
       //如果losses_中已经存在average_loss次迭代输出的loss，则取离本次迭代最近的average_loss-1次迭代输出的loss与本次loss求平均
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
            
       int idx = (iter_ - start_iter) % average_loss;
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           smoothed_loss_ += (loss - losses_[idx]) / average_loss;
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           losses_[idx] = loss;  
       //将本次迭代输出的loss存入losses_中的相应位置
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
         }
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       }

3.修改后的solve.py文件如下（实现实时绘制loss-iter曲线）


   
     
     
     
     
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       #coding=utf-8
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       import sys  
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       sys.path.append(
       'D:/caffe/caffe-master/python')
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       import caffe
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       import surgery, score
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       import numpy 
       as np
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       import os
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       import sys
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       #plot 加载绘制图像所需要的python库
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       import matplotlib.pyplot 
       as plt
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       from matplotlib.patches 
       import Circle
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       import math
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       //根据上述UpdateSmoothedLoss()函数修改为python语言而来，目的就是更新平均loss
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       def UpdateSmLoss(loss,losses_,iterval,average_loss,sm_loss):
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
            sizel = len(losses_)
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
            listloss=loss.tolist()  
       #array转化为list
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
             
       if sizel < average_loss:
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
                losses_.append(listloss)
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
                sm_loss = (sm_loss*sizel+listloss)/(sizel+
       1)
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
             
       else:
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
                idx = iterval % average_loss
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
                sm_loss += (listloss-losses_[idx]) / average_loss
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
                losses_[idx] = listloss
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
             
       return sm_loss,losses_
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       try:
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
            
       import setproctitle
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           setproctitle.setproctitle(os.path.basename(os.getcwd()))
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       except:
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
            
       pass
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       vgg_weights = 
       'vgg16-fcn.caffemodel'
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       vgg_proto = 
       'vgg16_deploy.prototxt'
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       #weights = 'vgg16-fcn.caffemodel'
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       # init
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       #caffe.set_device(int(sys.argv[1]))
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       caffe.set_device(
       0)
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       caffe.set_mode_gpu()
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       #solver = caffe.SGDSolver('solver.prototxt')
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       #solver.net.copy_from(weights)
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       solver = caffe.SGDSolver(
       'solver.prototxt')
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       #parameter 实时绘制所需要的一些参数
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       niter = 
       100000   
       #对应solver.prototxt中的max_iter: 100000
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       display = 
       20   
       #对应solver.prototxt中的display: 20
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       snapshotnum = 
       4000  
       #对应solver.prototxt中的snapshot: 4000
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       ave_loss = 
       20   
       #对应solver.prototxt中的average_loss: 20
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       #losses_用于存储当前迭代次数的前average_loss次迭代所产生的loss
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       losses_ = []
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       sm_loss = 
       0  
       #平均loss
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       #train_loss 用于存储每次的sm_loss,以便画折线图
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       train_loss = np.zeros(np.ceil(niter * 
       1.0 / display))
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       vgg_net = caffe.Net(vgg_proto, vgg_weights, caffe.TRAIN)
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       surgery.transplant(solver.net, vgg_net)
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       del vgg_net
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       # surgeries
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       interp_layers = [k 
       for k 
       in solver.net.params.keys() 
       if 
       'up' 
       in k]
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       surgery.interp(solver.net, interp_layers)
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       # scoring
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       val = np.loadtxt(
       'D:/VOC2012/ImageSets/Segmentation/seg11valid.txt', dtype=str)
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       #for _ in range(25):
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
            
       #solver.step(4000)
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
            
       #score.seg_tests(solver, False, val, layer='score')
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
         
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       plt.close()  
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       fig=plt.figure()
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       ax=fig.add_subplot(
       1,
       1,
       1)
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       plt.grid(
       True) 
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       plt.ion()  
       #开启交互式绘图（实现实时绘图的关键语句）
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
       for it 
       in range(niter):    
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           solver.step(
       1)   
       #python下的step()函数，对应于上述Step()函数
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           _train_loss = solver.net.blobs[
       'loss'].data  
       #取出每次迭代输出的loss
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
           [sm_loss,losses_] = UpdateSmLoss(_train_loss,losses_,it,ave_loss,sm_loss) 
       #更新
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
            
       if it % display == 
       0 
       and it !=
       0:   
       #满足条件时展示平均loss
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
               ax.scatter(it,sm_loss,c = 
       'r',marker = 
       'o') 
       #绘制loss的散点图
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
               train_loss[it // display - 
       1] = sm_loss  
       #存储平均loss
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
                
       if it > display:
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
                   ax.plot([it
       -20,it],[train_loss[it // display - 
       2],train_loss[it // display - 
       1]],
       '-r') 
       #绘制折线图
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
               plt.pause(
       0.0001)
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
            
       if it % snapshotnum == 
       0 
       and it != 
       0:  
       #对应原solve.py文件中的最后两句代码，每snapshotnum次迭代进行一次测试
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
               score.seg_tests(solver, 
       False, val, layer=
       'score')
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
               losses_ = [] 
       #测试后需要清空losses_以及平均loss，对应于每次进入Step()函数都需要对这两者清空
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
               sm_loss = 
       0

效果图如下：

注：可以发现在训练过程中输出的本次单次迭代loss和多次迭代的平均loss是一样的，原因在于每次进入到Step()函数都需要对losses_ 和smoothed_loss清空导致每次进入Step()函数后losses_的大小总为0，也就只会进入if (losses_.size() < average_loss)这个条件里，导致两种loss相同。


   
     
     
     
     
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       I0611 
       22:
       08:
       17.291122  
       8428 solver.cpp:
       228] Iteration 
       160, loss = 
       63695.3
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       I0611 
       22:
       08:
       17.291122  
       8428 solver.cpp:
       244]     Train net output 
       #0: loss = 63695.3 (* 1 = 63695.3 loss)
      
        
        
        
        
     
       
       
       
       
      
      
      
      
     
       
       
       
       
      
        
        
        
        
     
       
       
       
       
     
       
       
       
       
      
        
        
        
        
         
         
         
         
       I0611 
       22:
       08:
       17.292124  
       8428 sgd_solver.cpp:
       106] Iteration 
       160, lr = 
       1e-010

机器学习与深度学习间关系与区别 ℒℴѵℯ心·动ꦿ໊ོ꫞ 人工智能学习深度学习 python
一、机器学习概述定义机器学习（MachineLearning,ML）是一种通过数据驱动的方法，利用统计学和计算算法来训练模型，使计算机能够从数据中学习并自动进行预测或决策。机器学习通过分析大量数据样本，识别其中的模式和规律，从而对新的数据进行判断。其核心在于通过训练过程，让模型不断优化和提升其预测准确性。主要类型1.监督学习（SupervisedLearning）监督学习是指在训练数据集中包含输入
JavaScript 中，深拷贝（Deep Copy）和浅拷贝（Shallow Copy）跳房子的前端前端面试 javascript 开发语言 ecmascript
在JavaScript中，深拷贝（DeepCopy）和浅拷贝（ShallowCopy）是用于复制对象或数组的两种不同方法。了解它们的区别和应用场景对于避免潜在的bugs和高效地处理数据非常重要。以下是对深拷贝和浅拷贝的详细解释，包括它们的概念、用途、优缺点以及实现方式。1.浅拷贝（ShallowCopy）概念定义：浅拷贝是指创建一个新的对象或数组，其中包含了原对象或数组的基本数据类型的值和对引用数
深度 Qlearning：在直播推荐系统中的应用 AGI通用人工智能之禅程序员提升自我硅基计算碳基计算认知计算生物计算深度学习神经网络大数据 AIGC AGI LLM Java Python 架构设计 Agent 程序员实现财富自由
深度Q-learning：在直播推荐系统中的应用关键词：深度Q-learning,强化学习,直播推荐系统,个性化推荐1.背景介绍1.1问题的由来随着互联网技术的飞速发展,直播平台如雨后春笋般涌现。面对海量的直播内容,用户很难快速找到自己感兴趣的内容。因此,个性化推荐系统在直播平台中扮演着越来越重要的角色。1.2研究现状目前,主流的个性化推荐算法包括协同过滤、基于内容的推荐等。这些方法在一定程度上缓
个人学习笔记7-6：动手学深度学习pytorch版-李沐浪子L 深度学习深度学习笔记计算机视觉 python 人工智能神经网络 pytorch
#人工智能##深度学习##语义分割##计算机视觉##神经网络#计算机视觉13.11全卷积网络全卷积网络（fullyconvolutionalnetwork，FCN）采用卷积神经网络实现了从图像像素到像素类别的变换。引入l转置卷积（transposedconvolution）实现的，输出的类别预测与输入图像在像素级别上具有一一对应关系：通道维的输出即该位置对应像素的类别预测。13.11.1构造模型下
深度学习-点击率预估-研究论文2024-09-14速读 sp_fyf_2024 深度学习人工智能
深度学习-点击率预估-研究论文2024-09-14速读1.DeepTargetSessionInterestNetworkforClick-ThroughRatePredictionHZhong,JMa,XDuan,SGu,JYao-2024InternationalJointConferenceonNeuralNetworks,2024深度目标会话兴趣网络用于点击率预测摘要：这篇文章提出了一种新
探索未来，大规模分布式深度强化学习——深入解析IMPALA架构汤萌妮Margaret
探索未来，大规模分布式深度强化学习——深入解析IMPALA架构scalable_agent项目地址:https://gitcode.com/gh_mirrors/sc/scalable_agent在当今的人工智能研究前沿，深度强化学习（DRL）因其在复杂任务中的卓越表现而备受瞩目。本文要介绍的是一个开源于GitHub的重量级项目：“ScalableDistributedDeep-RLwithImp
云服务业界动态简报-20180128 Captain7
一、青云青云QingCloud推出深度学习平台DeepLearningonQingCloud，包含了主流的深度学习框架及数据科学工具包，通过QingCloudAppCenter一键部署交付，可以让算法工程师和数据科学家快速构建深度学习开发环境，将更多的精力放在模型和算法调优。二、腾讯云1.腾讯云正式发布腾讯专有云TCE(TencentCloudEnterprise)矩阵，涵盖企业版、大数据版、AI
机器学习VS深度学习 nfgo 机器学习
机器学习（MachineLearning,ML）和深度学习（DeepLearning,DL）是人工智能（AI）的两个子领域，它们有许多相似之处，但在技术实现和应用范围上也有显著区别。下面从几个方面对两者进行区分：1.概念层面机器学习：是让计算机通过算法从数据中自动学习和改进的技术。它依赖于手动设计的特征和数学模型来进行学习，常用的模型有决策树、支持向量机、线性回归等。深度学习：是机器学习的一个子领
ResNet的半监督和半弱监督模型 Valar_Morghulis
Billion-scalesemi-supervisedlearningforimageclassificationhttps://arxiv.org/pdf/1905.00546.pdfhttps://github.com/facebookresearch/semi-supervised-ImageNet1K-models/权重在timm中也有：https://hub.fastgit.org/r
联邦学习 Federated learning Google I/O‘19 笔记努力搬砖的星期五笔记联邦学习机器学习机器学习 tensorflow
FederatedLearning:MachineLearningonDecentralizeddatahttps://www.youtube.com/watch?v=89BGjQYA0uE文章目录FederatedLearning:MachineLearningonDecentralizeddata1.DecentralizeddataEdgedevicesGboard:mobilekeyboa
PCL 怎样可视化深度图像 LeonDL168 PCL 计算机视觉人工智能视觉检测图像处理算法
本小节讲解如何可视化深度图像的两种方法，在3D视窗中以点云形式进行可视化（深度图像来源于点云），另一种是，将深度值映射为颜色，从而以彩色图像方式可视化深度图像。代码首先，在PCL（PointCloudLearning）中国协助发行的书提供光盘的第7章例2文件夹中，打开名为range_image_visualization.cpp的代码文件，同文件夹下可以找到相关的测试点云文件room_scan1.
el-dialog高度设置夏之小星星前端 vue.js elementui css
el-dialog高度设置::v-deep.el-dialog{height:78vh;overflow:auto;}
elementuiPlus取消el-input的边框 qq_39016177 elementui
elementuiPlus取消el-input的边框1.通常取消边框的方法设置border为none2.还有其他类似边框的例如outlinebox-shadow这两个属性都是会产生边框效果3.el-input需要更改的话–如下需要修改box-shadow为空即可上代码:deep(.el-input__wrapper){align-items:center;background-color:#F7F
【双语新闻】AGI安全与对齐，DeepMind近期工作曲奇人工智能安全 agi 安全 llama 人工智能
我们想与AF社区分享我们最近的工作总结。以下是关于我们正在做什么，为什么会这么做以及我们认为它的意义所在的一些详细信息。我们希望这能帮助人们从我们的工作基础上继续发展，并了解他们的工作如何与我们相关联。byRohinShah,SebFarquhar,AncaDragan21stAug2024AIAlignmentForumWewantedtosharearecapofourrecentoutput
Awesome TensorFlow weixin_30594001 人工智能移动开发大数据
AwesomeTensorFlowAcuratedlistofawesomeTensorFlowexperiments,libraries,andprojects.Inspiredbyawesome-machine-learning.WhatisTensorFlow?TensorFlowisanopensourcesoftwarelibraryfornumericalcomputationusin
【ShuQiHere】探索人工智能核心：机器学习的奥秘 ShuQiHere 人工智能机器学习
【ShuQiHere】什么是机器学习？机器学习（MachineLearning,ML）是人工智能（ArtificialIntelligence,AI）中最关键的组成部分之一。它使得计算机不仅能够处理数据，还能从数据中学习，从而做出预测和决策。无论是语音识别、自动驾驶还是推荐系统，背后都依赖于机器学习模型。机器学习与传统的编程不同，它不再依赖于人类编写的固定规则，而是通过数据自我改进模型，从而更灵活
综述论文“A Survey of Zero-Shot Learning: Settings, Methods, and Applications” 硅谷秋水机器学习机器学习神经网络深度学习
该零样本学习综述，发表于ACMTrans.Intell.Syst.Technol.10,2,Article13(January2019)摘要：大多数机器学习方法着重于对已经在训练中看到其类别的实例进行分类。实际上，许多应用程序需要对实例进行分类，而这些实例的类以前没有见过。零样本学习（Zero-ShotLearning）是一种强大而有前途的学习范例，其中训练实例涵盖的类别与想分类的类别是不相交的。
机器学习 VS 表示学习 VS 深度学习 Efred.D 人工智能机器学习深度学习人工智能
文章目录前言一、机器学习是什么?二、表示学习三、深度学习总结前言本文主要阐述机器学习,表示学习和深度学习的原理和区别.一、机器学习是什么?机器学习(machinelearning),是从有限的数据集中学习到一定的规律,再把学到的规律应用到一些相似的样本集中做预测.机器学习的历史可以追溯到20世纪40年代McCulloch提出的人工神经元网络,目前学界大致把机器学习分为传统机器学习和机器学习两个类别
端到端的自动驾驶论文与代码整理大别山伧父自动驾驶
LearningbyCheatinggithubcodearxivpaperconferenceonrobotlearning最新进展(May2021)Checkoutourlatestfollow-upwork:WorldonRails(2020)Checkoutoursubmissiontothe2020CARLAChallenge!pass
Lt-8 Multithreading yanlingyun0210 java
IntendedLearningOutcomesTounderstandtheconceptofconcurrency.Tounderstandthedifferenceofaprocessandathread.TodefineathreadusingtheThreadclassandRunnableinterface.TocontrolthreadswithvariousThreadmethod
如何使用Pytorch-Metric-Learning？鱼儿也有烦恼 PyTorch pytorch
文章目录如何使用Pytorch-Metric-Learning？1.Pytorch-Metric-Learning库9个模块的功能1.1Sampler模块1.2Miner模块1.3Loss模块1.4Reducer模块1.5Distance模块1.6Regularizer模块1.7Trainer模块1.8Tester模块1.9Utils模块2.如何使用PyTorchMetricLearning库中的
[Kaiming]Delving Deep into Rectifiers: Surpassing Human-Level Performance on ImageNet Classification MTandHJ neural networks
文章目录概主要内容PReLUKaiming初始化ForwardcaseBackwardcaseHeK,ZhangX,RenS,etal.DelvingDeepintoRectifiers:SurpassingHuman-LevelPerformanceonImageNetClassification[C].internationalconferenceoncomputervision,2015:1
深度神经网络详解：原理、架构与应用阿达C 活动 dnn 计算机网络人工智能神经网络机器学习深度学习
深度神经网络（DeepNeuralNetwork，DNN）是机器学习领域中最为重要和广泛应用的技术之一。它模仿人脑神经元的结构，通过多层神经元的连接和训练，能够处理复杂的非线性问题。在图像识别、自然语言处理、语音识别等领域，深度神经网络展示了强大的性能。本文将深入解析深度神经网络的基本原理、常见架构及其实际应用。一、深度神经网络的基本原理1.1神经元和感知器神经元是深度神经网络的基本组成单元。一个
前端开发需要了解的算法知识史努比的大头算法前端
手写深拷贝functiondeepClone(obj){//处理基础数据类型和函数if(obj===null||typeofobj!=='object'){returnobj;}//处理数组if(Array.isArray(obj)){returnobj.map(item=>deepClone(item));}//处理对象constclonedObj={};for(constkeyinobj){i
推荐开源项目：PyTorch-Metric-Learning 潘惟妍
推荐开源项目：PyTorch-Metric-Learningpytorch-metric-learningTheeasiestwaytousedeepmetriclearninginyourapplication.Modular,flexible,andextensible.WritteninPyTorch.项目地址:https://gitcode.com/gh_mirrors/py/pytorc
推荐：FastAPI驱动的稳定扩散LLMs演示项目褚知茉Jade
推荐：FastAPI驱动的稳定扩散LLMs演示项目FastAPI-for-Machine-Learning-Live-DemoThisrepositorycontainsthefilestobuildyourveryownAIimagegenerationwebapplication!OutlinedarethecorecomponentsoftheFastAPIwebframework,anda
【python】【Ray的概述】资源存储库 python 开发语言
Overview概述Rayisanopen-sourceunifiedframeworkforscalingAIandPythonapplicationslikemachinelearning.Itprovidesthecomputelayerforparallelprocessingsothatyoudon’tneedtobeadistributedsystemsexpert.Rayminimi
什么是监督学习（Supervised Learning）救救孩子把 AI AI 学习
一、监督学习概述监督学习（SupervisedLearning）是一种极具威力的机器学习方法，能够训练算法以识别数据中的模式，并据此进行精准的预测或分类。借助已有的标记数据，监督学习模型学会了从输入到输出的映射关系，进而在各类实际问题中实现自动化决策。无论是医疗诊断、金融市场分析、客户行为预测，还是提升生产效率以及个性化推荐系统等领域，监督学习都彰显出巨大的潜力与价值。随着技术的持续进步，监督学习
LLM系列(4)：通义千问7B在Swift/DeepSpeed上微调秘诀与实战陷阱避坑指南汀、人工智能 LLM工业级落地实践人工智能自然语言处理 prompt Swifi DeepSpeed 通义千问 Qwen
LLM系列(4)：通义千问7B在Swift/DeepSpeed上微调秘诀与实战陷阱避坑指南阿里云于2023年8月3日开源通义千问70亿参数模型，包括通用模型Qwen-7B以及对话模型Qwen-7B-Chat，这也是国内首个开源自家大模型的大厂。在诸多权威大模型能力测评基准上，如MMLU、C-Eval、GSM8K、HumanEval、WMT22，通义千问7B均取得了同参数级别开源模型中的最好表现，
使用3DUNet训练自己的数据集（pytorch）— 医疗影像分割编程日记✧ 智能医疗 pytorch 人工智能 python 计算机视觉图像处理深度学习健康医疗
代码：lee-zq/3DUNet-Pytorch:3DUNetimplementedwithpytorch(github.com)文章<cicek16miccai.pdf(uni-freiburg.de)3DU-Net:LearningDenseVolumetricSegmentation
矩阵求逆（JAVA）利用伴随矩阵 qiuwanchi 利用伴随矩阵求逆矩阵
package gaodai.matrix; import gaodai.determinant.DeterminantCalculation; import java.util.ArrayList; import java.util.List; import java.util.Scanner; /** * 矩阵求逆(利用伴随矩阵) * @author 邱万迟
单例（Singleton）模式 aoyouzi 单例模式 Singleton
3.1 概述如果要保证系统里一个类最多只能存在一个实例时，我们就需要单例模式。这种情况在我们应用中经常碰到，例如缓存池，数据库连接池，线程池，一些应用服务实例等。在多线程环境中，为了保证实例的唯一性其实并不简单，这章将和读者一起探讨如何实现单例模式。 3.2
[开源与自主研发]就算可以轻易获得外部技术支持,自己也必须研发 comsci 开源
现在国内有大量的信息技术产品，都是通过盗版，免费下载，开源，附送等方式从国外的开发者那里获得的。。。。。。虽然这种情况带来了国内信息产业的短暂繁荣，也促进了电子商务和互联网产业的快速发展，但是实际上，我们应该清醒的看到，这些产业的核心力量是被国外的
页面有两个frame,怎样点击一个的链接改变另一个的内容 Array_06 UI XHTML
<a src="地址" targets="这里写你要操作的Frame的名字" />搜索然后你点击连接以后你的新页面就会显示在你设置的Frame名字的框那里 targerts="",就是你要填写目标的显示页面位置 ===================== 例如： <frame src=&
Struts2实现单个/多个文件上传和下载 oloz 文件上传 struts
struts2单文件上传：步骤01:jsp页面  　　<form action="fileUplo
推荐10个在线logo设计网站 362217990 logo
在线设计Logo网站。 1、http://flickr.nosv.org（这个太简单） 2、http://www.logomaker.com/?source=1.5770.1 3、http://www.simwebsol.com/ImageTool 4、http://www.logogenerator.com/logo.php?nal=1&tpl_catlist[]=2 5、ht
jsp上传文件香水浓 jsp fileupload
1. jsp上传 Notice： 1. form表单 method 属性必须设置为 POST 方法，不能使用 GET 方法 2. form表单 enctype 属性需要设置为 multipart/form-data 3. form表单 action 属性需要设置为提交到后台处理文件上传的jsp文件地址或者servlet地址。例如 uploadFile.jsp 程序文件用来处理上传的文
我的架构经验系列文章 - 前端架构 agevs JavaScript Web 框架 UI jQuer
框架层面：近几年前端发展很快，前端之所以叫前端因为前端是已经可以独立成为一种职业了，js也不再是十年前的玩具了，以前富客户端RIA的应用可能会用flash/flex或是silverlight，现在可以使用js来完成大部分的功能，因此js作为一门前端的支撑语言也不仅仅是进行的简单的编码，越来越多框架性的东西出现了。越来越多的开发模式转变为后端只是吐json的数据源，而前端做所有UI的事情。MVCMV
android ksoap2 中把XML(DataSet) 当做参数传递 aijuans android
我的android app中需要发送webservice ，于是我使用了 ksop2 进行发送，在测试过程中不是很顺利,不能正常工作.我的web service 请求格式如下 [html] view plain copy <Envelope xmlns="http://schemas.
使用Spring进行统一日志管理 + 统一异常管理 baalwolf spring
统一日志和异常管理配置好后，SSH项目中，代码以往散落的log.info() 和 try..catch..finally 再也不见踪影！统一日志异常实现类： [java] view plain copy package com.pilelot.web.util; impor
Android SDK 国内镜像 BigBird2012 android sdk
一、镜像地址： 1、东软信息学院的 Android SDK 镜像，比配置代理下载快多了。配置地址， http://mirrors.neusoft.edu.cn/configurations.we#android 2、北京化工大学的： IPV4:ubuntu.buct.edu.cn IPV4:ubuntu.buct.cn IPV6:ubuntu.buct6.edu.cn
HTML无害化和Sanitize模块 bijian1013 JavaScript AngularJS Linky Sanitize
一.ng-bind-html、ng-bind-html-unsafe AngularJS非常注重安全方面的问题，它会尽一切可能把大多数攻击手段最小化。其中一个攻击手段是向你的web页面里注入不安全的HTML，然后利用它触发跨站攻击或者注入攻击。考虑这样一个例子，假设我们有一个变量存
[Maven学习笔记二]Maven命令 bit1129 maven
mvn compile compile编译命令将src/main/java和src/main/resources中的代码和配置文件编译到target/classes中，不会对src/test/java中的测试类进行编译 MVN编译使用 maven-resources-plugin:2.6:resources maven-compiler-plugin:2.5.1:compile &nbs
【Java命令二】jhat bit1129 Java命令
jhat用于分析使用jmap dump的文件，，可以将堆中的对象以html的形式显示出来，包括对象的数量，大小等等，并支持对象查询语言。 jhat默认开启监听端口7000的HTTP服务，jhat是Java Heap Analysis Tool的缩写 1. 用法： [hadoop@hadoop bin]$ jhat -help Usage: jhat [-stack <bool&g
JBoss 5.1.0 GA:Error installing to Instantiated: name=AttachmentStore state=Desc ronin47
进到类似目录 server/default/conf/bootstrap，打开文件 profile.xml找到： Xml代码<bean name="AttachmentStore" class="org.jboss.system.server.profileservice.repository.AbstractAtta
写给初学者的6条网页设计安全配色指南 brotherlamp UI ui自学 ui视频 ui教程 ui资料
网页设计中最基本的原则之一是，不管你花多长时间创造一个华丽的设计，其最终的角色都是这场秀中真正的明星——内容的衬托我仍然清楚地记得我最早的一次美术课，那时我还是一个小小的、对凡事都充满渴望的孩子，我摆放出一大堆漂亮的彩色颜料。我仍然记得当我第一次看到原色与另一种颜色混合变成第二种颜色时的那种兴奋，并且我想，既然两种颜色能创造出一种全新的美丽色彩，那所有颜色
有一个数组，每次从中间随机取一个，然后放回去，当所有的元素都被取过，返回总共的取的次数。写一个函数实现。复杂度是什么。 bylijinnan java 算法面试
import java.util.Random; import java.util.Set; import java.util.TreeSet; /** * http://weibo.com/1915548291/z7HtOF4sx * #面试题#有一个数组，每次从中间随机取一个，然后放回去，当所有的元素都被取过，返回总共的取的次数。 * 写一个函数实现。复杂度是什么
struts2获得request、session、application方式 chiangfai application
1、与Servlet API解耦的访问方式。 a.Struts2对HttpServletRequest、HttpSession、ServletContext进行了封装，构造了三个Map对象来替代这三种对象要获取这三个Map对象，使用ActionContext类。 -----> package pro.action; import java.util.Map; imp
改变python的默认语言设置 chenchao051 python
import sys sys.getdefaultencoding() 可以测试出默认语言，要改变的话，需要在python lib的site-packages文件夹下新建： sitecustomize.py，这个文件比较特殊，会在python启动时来加载，所以就可以在里面写上： import sys sys.setdefaultencoding('utf-8') &n
mysql导入数据load data infile用法 daizj mysql 导入数据
我们常常导入数据！mysql有一个高效导入方法，那就是load data infile 下面来看案例说明基本语法： load data [low_priority] [local] infile 'file_name txt' [replace | ignore] into table tbl_name [fields [terminated by't'] [OPTI
phpexcel导入excel表到数据库简单入门示例 dcj3sjt126com PHP Excel
跟导出相对应的，同一个数据表，也是将phpexcel类放在class目录下，将Excel表格中的内容读取出来放到数据库中 <?php error_reporting(E_ALL); set_time_limit(0); ?> <html> <head> <meta http-equiv="Content-Type"
22岁到72岁的男人对女人的要求 dcj3sjt126com
22岁男人对女人的要求是：一，美丽，二，性感，三，有份具品味的职业，四，极有耐性，善解人意，五，该聪明的时候聪明，六，作小鸟依人状时尽量自然，七，怎样穿都好看，八，懂得适当地撒娇，九，虽作惊喜反应，但看起来自然，十，上了床就是个无条件荡妇。 32岁的男人对女人的要求，略作修定，是：一，入得厨房，进得睡房，二，不必服侍皇太后，三，不介意浪漫蜡烛配盒饭，四，听多过说，五，不再傻笑，六，懂得独
Spring和HIbernate对DDM设计的支持 e200702084 DAO 设计模式 spring Hibernate 领域模型
A：数据访问对象 DAO和资源库在领域驱动设计中都很重要。DAO是关系型数据库和应用之间的契约。它封装了Web应用中的数据库CRUD操作细节。另一方面，资源库是一个独立的抽象，它与DAO进行交互，并提供到领域模型的“业务接口”。资源库使用领域的通用语言，处理所有必要的DAO，并使用领域理解的语言提供对领域模型的数据访问服务。
NoSql 数据库的特性比较 geeksun NoSQL
Redis 是一个开源的使用ANSI C语言编写、支持网络、可基于内存亦可持久化的日志型、Key-Value数据库，并提供多种语言的API。目前由VMware主持开发工作。 1. 数据模型作为Key-value型数据库，Redis也提供了键（Key）和值（Value）的映射关系。除了常规的数值或字符串，Redis的键值还可以是以下形式之一： Lists （列表） Sets
使用 Nginx Upload Module 实现上传文件功能 hongtoushizi nginx
转载自： http://www.tuicool.com/wx/aUrAzm 普通网站在实现文件上传功能的时候，一般是使用Python，Java等后端程序实现，比较麻烦。Nginx有一个Upload模块，可以非常简单的实现文件上传功能。此模块的原理是先把用户上传的文件保存到临时文件，然后在交由后台页面处理，并且把文件的原名，上传后的名称，文件类型，文件大小set到页面。下
spring-boot-web-ui及thymeleaf基本使用 jishiweili spring thymeleaf
视图控制层代码demo如下： @Controller @RequestMapping("/") public class MessageController { private final MessageRepository messageRepository; @Autowired public MessageController(Mes
数据源架构模式之活动记录 home198979 PHP 架构活动记录数据映射
hello!架构一、概念活动记录（Active Record）：一个对象，它包装数据库表或视图中某一行，封装数据库访问，并在这些数据上增加了领域逻辑。对象既有数据又有行为。活动记录使用直截了当的方法，把数据访问逻辑置于领域对象中。二、实现简单活动记录活动记录在php许多框架中都有应用，如cakephp。 <?php /** * 行数据入口类 *
Linux Shell脚本之自动修改IP pda158 linux centos Debian 脚本
作为一名 Linux SA，日常运维中很多地方都会用到脚本，而服务器的ip一般采用静态ip或者MAC绑定，当然后者比较操作起来相对繁琐，而前者我们可以设置主机名、ip信息、网关等配置。修改成特定的主机名在维护和管理方面也比较方便。如下脚本用途为：修改ip和主机名等相关信息，可以根据实际需求修改，举一反三！ #!/bin/sh #auto Change ip netmask ga
开发环境搭建独浮云 eclipse jdk tomcat
最近在开发过程中，经常出现MyEclipse内存溢出等错误，需要重启的情况，好麻烦。对于一般的JAVA+TOMCAT项目开发，其实没有必要使用重量级的MyEclipse，使用eclipse就足够了。尤其是开发机器硬件配置一般的人。 &n

FCN源码解读之solve.py

你可能感兴趣的:(Deep,Learning,FCN,caffe)