http://t.zoukankan.com/LXP-Never-p-13951578.html
detach():截断node反向传播的梯度流,将某个node变成不需要梯度的Varibale,因此当反向传播经过这个node时,梯度就不会从这个node往前面传播。