深入理解Pytorch中的torch. matmul()

更新时间：2023年04月13日 10:15:11 作者：海轰Pro

这篇文章主要介绍了Pytorch中的torch. matmul()的相关资料,本文通过实例代码给大家介绍的非常详细，对大家的学习或工作具有一定的参考借鉴价值，需要的朋友可以参考下

torch.matmul()

语法

torch.matmul(input, other, *, out=None) → Tensor

作用

两个张量的矩阵乘积

行为取决于张量的维度，如下所示：

如果两个张量都是一维的，则返回点积（标量）。
如果两个参数都是二维的，则返回矩阵-矩阵乘积。
如果第一个参数是一维的，第二个参数是二维的，为了矩阵乘法的目的，在它的维数前面加上一个 1。在矩阵相乘之后，前置维度被移除。
如果第一个参数是二维的，第二个参数是一维的，则返回矩阵向量积。
如果两个参数至少为一维且至少一个参数为 N 维（其中 N > 2），则返回批处理矩阵乘法
- 如果第一个参数是一维的，则将 1 添加到其维度，以便批量矩阵相乘并在之后删除。如果第二个参数是一维的，则将 1 附加到其维度以用于批量矩阵倍数并在之后删除
- 非矩阵（即批次）维度是广播的（因此必须是可广播的）
- 例如，如果输入是( j × 1 × n × n ) (j \times 1 \times n \times n)(j×1×n×n) 张量
- 另一个是 ( k × n × n ) (k \times n \times n)(k×n×n)张量,
- out 将是一个 ( j × k × n × n ) (j \times k \times n \times n)(j×k×n×n) 张量

请注意，广播逻辑在确定输入是否可广播时仅查看批处理维度，而不是矩阵维度

例如

如果输入是 ( j × 1 × n × m ) (j \times 1 \times n \times m)(j×1×n×m) 张量
另一个是 ( k × m × p ) (k \times m \times p)(k×m×p) 张量
即使最后两个维度（即矩阵维度）不同，这些输入对于广播也是有效的
out 将是一个 ( j × k × n × p ) (j \times k \times n \times p)(j×k×n×p) 张量

该运算符支持 TensorFloat32。

在某些 ROCm 设备上，当使用 float16 输入时，此模块将使用不同的向后精度

举例

情形1: 一维 * 一维

如果两个张量都是一维的，则返回点积（标量）

tensor1 = torch.Tensor([1,2,3])
tensor2 =torch.Tensor([4,5,6])
ans = torch.matmul(tensor1, tensor2)

print('tensor1 : ', tensor1)
print('tensor2 : ', tensor2)
print('ans :', ans)
print('ans.size :', ans.size())

ans = 1 * 4 + 2 * 5 + 3 * 6 = 32

情形2: 二维 * 二维

如果两个参数都是二维的，则返回矩阵-矩阵乘积
也就是正常的矩阵乘法 (m * n) * (n * k) = (m * k)

tensor1 = torch.Tensor([[1,2,3],[1,2,3]])
tensor2 =torch.Tensor([[4,5],[4,5],[4,5]])
ans = torch.matmul(tensor1, tensor2)

print('tensor1 : ', tensor1)
print('tensor2 : ', tensor2)
print('ans :', ans)
print('ans.size :', ans.size())

情形3: 一维 * 二维

如果第一个参数是一维的，第二个参数是二维的，为了矩阵乘法的目的，在它的维数前面加上一个 1
在矩阵相乘之后，前置维度被移除

tensor1 = torch.Tensor([1,2,3]) # 注意这里是一维
tensor2 =torch.Tensor([[4,5],[4,5],[4,5]])
ans = torch.matmul(tensor1, tensor2)

print('tensor1 : ', tensor1)
print('tensor2 : ', tensor2)
print('ans :', ans)
print('ans.size :', ans.size())

tensor1 = torch.Tensor([1,2,3]) 修改为 tensor1 = torch.Tensor([[1,2,3]])

发现一个结果是[24., 30.] 一个是[[24., 30.]]

所以，当一维 * 二维时，开始变成 1 * m（一维的维度），也就是一个二维，再进行正常的矩阵运算，得到[[24., 30.]]，然后再去掉开始增加的一个维度，得到[24., 30.]

想象为二维 * 二维（前置维度为1），最后结果去掉一个维度即可

情形4: 二维 * 一维

如果第一个参数是二维的，第二个参数是一维的，则返回矩阵向量积

tensor1 =torch.Tensor([[4,5,6],[7,8,9]])
tensor2 = torch.Tensor([1,2,3])
ans = torch.matmul(tensor1, tensor2)

print('tensor1 : ', tensor1)
print('tensor2 : ', tensor2)
print('ans :', ans)
print('ans.size :', ans.size())

理解为：

把第一个二维中，想象为多个行向量
第二个一维想象为一个列向量
行向量与列向量进行矩阵乘法，得到一个标量
再按照行堆叠起来即可

情形5：两个参数至少为一维且至少一个参数为 N 维（其中 N > 2），则返回批处理矩阵乘法

第一个参数为N维，第二个参数为一维时

tensor1 = torch.randn(10, 3, 4)
tensor2 = torch.randn(4)
print(torch.matmul(tensor1, tensor2).size())

(4) 先添加一个维度 (4 * 1)
得到（10 * 3 * 4） *（ 4 * 1） = （10 * 3 * 1）
再删除最后一个维度（添加的那个）
得到结果(10 * 3)

tensor1 = torch.randn(10,2, 3, 4) # 
tensor2 = torch.randn(4)
print(torch.matmul(tensor1, tensor2).size())

(10 * 2 * 3 * 4) * (4 * 1) = (10 * 2 * 3) 【抵消4，删1】

第一个参数为一维，第二个参数为二维时

tensor1 = torch.randn(4)
tensor2 = torch.randn(10, 4, 3)
print(torch.matmul(tensor1, tensor2).size())

tensor2 中第一个10理解为批次， 10个(4 * 3)
(1 * 4）与每个(4 * 3) 相乘得到(1,3)，去除1，得到(3)
批次为10，得到(10,3)

tensor1 = torch.randn(4)
tensor2 = torch.randn(10,2, 4, 3)
print(torch.matmul(tensor1, tensor2).size())

这里批次理解为[10, 2]即可

tensor1 = torch.randn(4)
tensor2 = torch.randn(10,4, 2,4,1)
print(torch.matmul(tensor1, tensor2).size())

个人理解：当一个参数为一维时，它要去匹配另一个参数的最后两个维度（二维 * 二维）

比如上面的例子就是(1 * 4) 匹配 (4,1), 批次为（10，4，2）

高维 * 高维时

注：这不太好理解 … 感觉就是要找准批次，再进行乘法（靠感觉了哈哈离谱）

参考 https://pytorch.org/docs/stable/generated/torch.matmul.html#torch.matmul

到此这篇关于深入理解Pytorch中的torch. matmul()的文章就介绍到这了,更多相关Pytorch torch. matmul()内容请搜索脚本之家以前的文章或继续浏览下面的相关文章希望大家以后多多支持脚本之家！

您可能感兴趣的文章:

python config文件的读写操作示例
这篇文章主要介绍了python config文件的读写操作,结合简单示例形式分析了Python针对config文件的设置、读取、写入相关操作技巧,需要的朋友可以参考下
2019-09-09
python构建指数平滑预测模型示例
今天小编就为大家分享一篇python构建指数平滑预测模型示例，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧
2019-11-11
Python闭包装饰器使用方法汇总
这篇文章主要介绍了Python闭包装饰器使用方法汇总,文中通过示例代码介绍的非常详细，对大家的学习或者工作具有一定的参考学习价值,需要的朋友可以参考下
2020-06-06
基于Python __dict__与dir()的区别详解
下面小编就为大家带来一篇基于Python __dict__与dir()的区别详解。小编觉得挺不错的，现在就分享给大家，也给大家做个参考。一起跟随小编过来看看吧
2017-10-10
Python实现根据指定端口探测服务器/模块部署的方法
这篇文章主要介绍了Python根据指定端口探测服务器/模块部署的方法,非常具有实用价值,需要的朋友可以参考下
2014-08-08
利用Python创建位置生成器的示例详解
在这篇文章中，我们将探索如何利用Python在美国各地城市的地图数据和公共电动自行车订阅源上训练一个快速生成的对抗网络（GAN）模型，需要的可以参考一下
2022-06-06
Python实现堡垒机模式下远程命令执行操作示例
这篇文章主要介绍了Python实现堡垒机模式下远程命令执行操作,结合实例形式分析了Python堡垒机模式执行远程命令的原理与相关操作技巧,需要的朋友可以参考下
2019-05-05
关于pytorch中网络loss传播和参数更新的理解
今天小编就为大家分享一篇关于pytorch中网络loss传播和参数更新的理解，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧
2019-08-08
Python学习之if 条件判断语句
篇文章主要介绍了Python if 条件判断语句，文中通过示例代码介绍的非常详细，对大家的学习或者工作具有一定的参考学习价值，需要的朋友们下面随着小编来一起学习学习吧
2021-10-10
Python实现去除列表中重复元素的方法总结【7种方法】
今天小编就为大家分享一篇关于Python实现去除列表中重复元素的方法总结【7种方法】，小编觉得内容挺不错的，现在分享给大家，具有很好的参考价值，需要的朋友一起跟随小编来看看吧
2019-02-02