Python函数之iterrows(),iteritems(),itertuples()的区别说明

 更新时间:2022年05月12日 09:59:44   作者:lili安  
这篇文章主要介绍了Python函数之iterrows(),iteritems(),itertuples()的区别说明,具有很好的参考价值,希望对大家有所帮助。如有错误或未考虑完全的地方,望不吝赐教

iterrows(),iteritems(),itertuples()区别

Python函数之iterrows, iteritems, itertuples对dataframe进行遍历

  • iterrows(): 将DataFrame迭代为(insex, Series)对。
  • iteritems(): 将DataFrame迭代为(列名, Series)对
  • itertuples(): 将DataFrame迭代为元祖。

DataFrame数据遍历方式 iteritems iterrows itertuples

对Pandas对象进行基本迭代的行为取决于类型。在遍历一个Series时,它被视为类似数组,并且基本迭代产生这些值。其他数据结构(如DataFrame和Panel)遵循类似于字典的惯例,即迭代对象的 键 。

总之,基本的迭代产生

  • Series - 值
  • DataFrame - 列标签
  • Panel - 项目标签

迭代DataFrame

迭代DataFrame会给出列名称。让我们考虑下面的例子来理解相同的情况。

import pandas as pd
import numpy as np

N=20

df = pd.DataFrame({
    'A': pd.date_range(start='2021-01-01',periods=N,freq='D'),
    'x': np.linspace(0,stop=N-1,num=N),
    'y': np.random.rand(N),
    'C': np.random.choice(['Low','Medium','High'],N).tolist(),
    'D': np.random.normal(100, 10, size=(N)).tolist()
    })

for col in df:
   print(col)

其 输出 如下

A
C
D
x
y

要迭代DataFrame的行,我们可以使用以下函数 -

  • iteritems() - 遍历(键,值)对
  • iterrows() - 遍历行(索引,序列)对
  • itertuples() - 遍历 行为namedtuples

iteritems()

将每列作为关键字值进行迭代,并将标签作为键和列值作为Series对象进行迭代。

import pandas as pd
import numpy as np

df = pd.DataFrame(np.random.randn(4,3),columns=['col1','col2','col3'])
for key,value in df.iteritems():
   print(key,value)

其 输出 如下 :

col1 0    0.265778
1   -0.814620
2   -2.384911
3    0.525155
Name: col1, dtype: float64
col2 0    2.580894
1   -0.408090
2    0.641011
3    0.591557
Name: col2, dtype: float64
col3 0   -0.830860
1    0.413565
2   -2.251128
3   -0.392120
Name: col3, dtype: float64

请注意,每个列在Series中作为键值对单独迭代。

iterrows()

iterrows()返回产生每个索引值的迭代器以及包含每行数据的序列。

import pandas as pd
import numpy as np

df = pd.DataFrame(np.random.randn(4,3),columns = ['col1','col2','col3'])
for row_index,row in df.iterrows():
   print(row_index,row)

其 输出 如下

0 col1   -0.536180
col2   -0.422245
col3   -0.049302
Name: 0, dtype: float64
1 col1   -0.577882
col2    0.546570
col3    1.210293
Name: 1, dtype: float64
2 col1    0.593660
col2    0.621967
col3    0.456040
Name: 2, dtype: float64
3 col1    0.874323
col2    0.303070
col3   -0.107727
Name: 3, dtype: float64

注 - 由于 iterrows() 遍历行,因此它不会保留行中的数据类型。0,1,2是行索引,col1,col2,col3是列索引。

itertuples()

itertuples()方法将返回一个迭代器,为DataFrame中的每一行生成一个命名的元组。元组的第一个元素将是行的相应索引值,而其余值是行值。

import pandas as pd
import numpy as np

df = pd.DataFrame(np.random.randn(4,3),columns = ['col1','col2','col3'])
for row in df.itertuples():
    print(row)

其 输出 如下

Pandas(Index=0, col1=-0.4029137277161786, col2=1.3034737750584355, col3=0.8197109653411052)
Pandas(Index=1, col1=-0.43013422882386704, col2=-0.2536252662252256, col3=0.9102527012477817)
Pandas(Index=2, col1=0.25877683462048057, col2=-0.7725072659033637, col3=-0.013946376730006241)
Pandas(Index=3, col1=0.3611368595844501, col2=-0.2777909818571997, col3=0.9396027945103758)

注 : 不要在迭代时尝试修改任何对象。 迭代是为了读取而迭代器返回原始对象(视图)的副本,因此这些更改不会反映到原始对象上。

import pandas as pd
import numpy as np

df = pd.DataFrame(np.random.randn(4,3),columns = ['col1','col2','col3'])

for index, row in df.iterrows():
   row['a'] = 10
print(df)

其 输出 如下

       col1      col2      col3
0  0.579118  0.444899 -0.693009
1  0.479294  0.080658 -0.126600
2  0.095121 -1.870492  0.596165
3  1.885483 -0.122502 -1.531169

以上为个人经验,希望能给大家一个参考,也希望大家多多支持脚本之家。

相关文章

  • 利用Python实现文档批量重命名

    利用Python实现文档批量重命名

    日常工作中总会遇到一些需要收集文件的情况,但往往最后收集回来的文件名称会五花八门,下面小编就来为大家讲讲如何使用Python实现批量重命名操作吧
    2025-02-02
  • Python序列化与反序列化pickle用法实例

    Python序列化与反序列化pickle用法实例

    这篇文章主要介绍了Python序列化与反序列化pickle用法实例,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友可以参考下
    2019-11-11
  • 批标准化层 tf.keras.layers.Batchnormalization()解析

    批标准化层 tf.keras.layers.Batchnormalization()解析

    这篇文章主要介绍了批标准化层 tf.keras.layers.Batchnormalization(),具有很好的参考价值,希望对大家有所帮助。如有错误或未考虑完全的地方,望不吝赐教
    2023-02-02
  • 对python PLT中的image和skimage处理图片方法详解

    对python PLT中的image和skimage处理图片方法详解

    今天小编就为大家分享一篇对python PLT中的image和skimage处理图片方法详解,具有很好的参考价值,希望对大家有所帮助。一起跟随小编过来看看吧
    2019-01-01
  • 梯度下降法介绍及利用Python实现的方法示例

    梯度下降法介绍及利用Python实现的方法示例

    梯度下降算法是一个很基本的算法,在机器学习和优化中有着非常重要的作用,下面这篇文章主要给大家介绍了关于利用Python实现梯度下降法的相关资料,对大家具有一定的参考学习价值,需要的朋友们下面来一起看看吧。
    2017-07-07
  • python使用mysql数据库示例代码

    python使用mysql数据库示例代码

    本篇文章主要介绍了python使用mysql数据库示例代码,小编觉得挺不错的,现在分享给大家,也给大家做个参考。一起跟随小编过来看看吧
    2017-05-05
  • python sklearn库实现简单逻辑回归的实例代码

    python sklearn库实现简单逻辑回归的实例代码

    Scikit-learn(sklearn)是机器学习中常用的第三方模块,对常用的机器学习方法进行了封装,这篇文章主要介绍了python sklearn库实现简单逻辑回归的实例代码,需要的朋友可以参考下
    2019-07-07
  • python的dataframe和matrix的互换方法

    python的dataframe和matrix的互换方法

    下面小编就为大家分享一篇python的dataframe和matrix的互换方法,具有很好的参考价值,希望对大家有所帮助。一起跟随小编过来看看吧
    2018-04-04
  • Python利用ROI进行图像合成的问题小结

    Python利用ROI进行图像合成的问题小结

    图像的 ROI (region of interest) 是指图像中感兴趣区域、在 OpenCV 中图像设置图像 ROI 区域,实现只对 ROI 区域操作,本文给大家介绍Python利用ROI进行图像合成的问题小结,感兴趣的朋友一起看看吧
    2021-07-07
  • Python加密方法小结【md5,base64,sha1】

    Python加密方法小结【md5,base64,sha1】

    这篇文章主要介绍了Python加密方法,结合实例形式总结分析了md5,base64,sha1的简单加密方法,需要的朋友可以参考下
    2017-07-07

最新评论