1赞

关于tensorflow softmax函数用法解析

作者：贴进你的心聆听你的世界 | 2022-02-22 09:23

这篇文章主要介绍了关于tensorflowsoftmax函数用法解析，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧

如下所示：

def softmax(logits, axis=None, name=None, dim=None):
 """Computes softmax activations.
 This function performs the equivalent of
  softmax = tf.exp(logits) / tf.reduce_sum(tf.exp(logits), axis)
 Args:
 logits: A non-empty `Tensor`. Must be one of the following types: `half`,
  `float32`, `float64`.
 axis: The dimension softmax would be performed on. The default is -1 which
  indicates the last dimension.
 name: A name for the operation (optional).
 dim: Deprecated alias for `axis`.
 Returns:
 A `Tensor`. Has the same type and shape as `logits`.
 Raises:
 InvalidArgumentError: if `logits` is empty or `axis` is beyond the last
  dimension of `logits`.
 """
 axis = deprecation.deprecated_argument_lookup("axis", axis, "dim", dim)
 if axis is None:
 axis = -1
 return _softmax(logits, gen_nn_ops.softmax, axis, name)

softmax函数的返回结果和输入的tensor有相同的shape，既然没有改变tensor的形状，那么softmax究竟对tensor做了什么？

答案就是softmax会以某一个轴的下标为索引，对这一轴上其他维度的值进行激活 + 归一化处理。

一般来说，这个索引轴都是表示类别的那个维度（tf.nn.softmax中默认为axis=-1,也就是最后一个维度）

举例：

def softmax(X, theta = 1.0, axis = None):
 """
 Compute the softmax of each element along an axis of X.
 Parameters
 ----------
 X: ND-Array. Probably should be floats.
 theta (optional): float parameter, used as a multiplier
  prior to exponentiation. Default = 1.0
 axis (optional): axis to compute values along. Default is the
  first non-singleton axis.
 Returns an array the same size as X. The result will sum to 1
 along the specified axis.
 """
 
 # make X at least 2d
 y = np.atleast_2d(X)
 
 # find axis
 if axis is None:
  axis = next(j[0] for j in enumerate(y.shape) if j[1] > 1)
 
 # multiply y against the theta parameter,
 y = y * float(theta)
 
 # subtract the max for numerical stability
 y = y - np.expand_dims(np.max(y, axis = axis), axis)
 
 # exponentiate y
 y = np.exp(y)
 
 # take the sum along the specified axis
 ax_sum = np.expand_dims(np.sum(y, axis = axis), axis)
 
 # finally: divide elementwise
 p = y / ax_sum
 
 # flatten if X was 1D
 if len(X.shape) == 1: p = p.flatten()
 
 return p
c = np.random.randn(2,3)
print(c)
# 假设第0维是类别，一共有里两种类别
cc = softmax(c,axis=0)
# 假设最后一维是类别，一共有3种类别
ccc = softmax(c,axis=-1)
print(cc)
print(ccc)

结果：

c:
[[-1.30022268 0.59127472 1.21384177]
 [ 0.1981082 -0.83686108 -1.54785864]]
cc:
[[0.1826746 0.80661068 0.94057075]
 [0.8173254 0.19338932 0.05942925]]
ccc:
[[0.0500392 0.33172426 0.61823654]
 [0.65371718 0.23222472 0.1140581 ]]

可以看到，对axis=0的轴做softmax时，输出结果在axis=0轴上和为1(eg: 0.1826746+0.8173254)，同理在axis=1轴上做的话结果的axis=1轴和也为1(eg: 0.0500392+0.33172426+0.61823654)。

这些值是怎么得到的呢？

以cc为例（沿着axis=0做softmax）：

以ccc为例（沿着axis=1做softmax）：

知道了计算方法，现在我们再来讨论一下这些值的实际意义：

cc[0,0]实际上表示这样一种概率： P( label = 0 | value = [-1.30022268 0.1981082] = c[*,0] ) = 0.1826746

cc[1,0]实际上表示这样一种概率： P( label = 1 | value = [-1.30022268 0.1981082] = c[*,0] ) = 0.8173254

ccc[0,0]实际上表示这样一种概率： P( label = 0 | value = [-1.30022268 0.59127472 1.21384177] = c[0]) = 0.0500392

ccc[0,1]实际上表示这样一种概率： P( label = 1 | value = [-1.30022268 0.59127472 1.21384177] = c[0]) = 0.33172426

ccc[0,2]实际上表示这样一种概率： P( label = 2 | value = [-1.30022268 0.59127472 1.21384177] = c[0]) = 0.61823654

将他们扩展到更多维的情况：假设c是一个[batch_size , timesteps, categories]的三维tensor

output = tf.nn.softmax(c,axis=-1)

那么 output[1, 2, 3] 则表示 P(label =3 | value = c[1,2] )

以上这篇关于tensorflow softmax函数用法解析就是小编分享给大家的全部内容了，希望能给大家一个参考，也希望大家多多支持。

推荐阅读

程序员
如何设置我的VS 2013 TypeScript项目来编译我的打字稿文件但排除我的node_modules？

如何解决《如何设置我的VS2013TypeScript项目来编译我的打字稿文件但排除我的node_modules？》经验，为你挑选了0个好方法。 ... [详细]
程序员
Spring Boot @ControllerAdvice异常处理程序没有触发

如何解决《SpringBoot@ControllerAdvice异常处理程序没有触发》经验，为你挑选了0个好方法。 ... [详细]
程序员
Python PIL - 寻找最近的颜色(圆角颜色)

如何解决《PythonPIL-寻找最近的颜色(圆角颜色)》经验，为你挑选了1个好方法。 ... [详细]
程序员
与visual studio一起使用angular2

如何解决《与visualstudio一起使用angular2》经验，为你挑选了1个好方法。 ... [详细]
程序员
是否必须在多线程环境中为long类型实例常量声明volatile？

如何解决《是否必须在多线程环境中为long类型实例常量声明volatile？》经验，为你挑选了1个好方法。 ... [详细]
程序员
如何使用rxandroid来监听gps位置更新

如何解决《如何使用rxandroid来监听gps位置更新》经验，为你挑选了1个好方法。 ... [详细]
程序员
逻辑错误,在Tic Tac Toe中检查获胜者

如何解决《逻辑错误,在TicTacToe中检查获胜者》经验，为你挑选了0个好方法。 ... [详细]
程序员
逐行打印python列表中的列表

如何解决《逐行打印python列表中的列表》经验，为你挑选了1个好方法。 ... [详细]
程序员
在GameScene中显示UIAlertController(SpriteKit/Swift)

如何解决《在GameScene中显示UIAlertController(SpriteKit/Swift)》经验，为你挑选了1个好方法。 ... [详细]
程序员
在Aurelia中将自定义元素替换为模板本身(而不是将其包含在自定义元素中)？

如何解决《在Aurelia中将自定义元素替换为模板本身(而不是将其包含在自定义元素中)？》经验，为你挑选了1个好方法。 ... [详细]
程序员
Spring Boot @autowired不起作用,类在不同的包中

如何解决《SpringBoot@autowired不起作用,类在不同的包中》经验，为你挑选了1个好方法。 ... [详细]
程序员
如何在C++中实现指向成员函数的指针？

如何解决《如何在C++中实现指向成员函数的指针？》经验，为你挑选了1个好方法。 ... [详细]
程序员
Java得到一个double的前2个十进制数字

如何解决《Java得到一个double的前2个十进制数字》经验，为你挑选了1个好方法。 ... [详细]
程序员
为什么jquery-ajax多次提交表单？

如何解决《为什么jquery-ajax多次提交表单？》经验，为你挑选了2个好方法。 ... [详细]
程序员
为什么我可以在不写可选标记的情况下声明变量？

如何解决《为什么我可以在不写可选标记的情况下声明变量？》经验，为你挑选了1个好方法。 ... [详细]
程序员
使用CMAKE构建GLFW3应用程序 - GLFW_LIBRARIES没有设置

如何解决《使用CMAKE构建GLFW3应用程序-GLFW_LIBRARIES没有设置》经验，为你挑选了1个好方法。 ... [详细]
程序员
Android - 尝试添加图像时会创建一个空白图像

如何解决《Android-尝试添加图像时会创建一个空白图像》经验，为你挑选了1个好方法。 ... [详细]
程序员
Fb.api('/我在哪里可以找到可用参数列表

如何解决《Fb.api('/我在哪里可以找到可用参数列表》经验，为你挑选了1个好方法。 ... [详细]
程序员
当目标与数组聚合时,完美转发失败

如何解决《当目标与数组聚合时,完美转发失败》经验，为你挑选了1个好方法。 ... [详细]
程序员
为什么EnumSet不是SortedSet

如何解决《为什么EnumSet不是SortedSet》经验，为你挑选了0个好方法。 ... [详细]

贴进你的心聆听你的世界

这个屌丝很懒，什么也没留下！

关注作者

Tags | 热门标签

RankList | 热门文章