python中的reduce内建函数使用方法指南

更新时间：2014年08月31日 09:22:44 投稿：hebedich

python中的reduce内建函数是一个二元操作函数，他用来将一个数据集合（链表，元组等）中的所有数据进行下列操作：用传给reduce中的函数 func()（必须是一个二元操作函数）先对集合中的第1，2个数据进行操作，得到的结果再与第三个数据用func()函数运算，最后得到一个结果

官方解释：

Apply function of two arguments cumulatively to the items of iterable, from left to right, so as to reduce the iterable to a single value. For example, reduce(lambda x, y: x+y, [1, 2, 3, 4, 5]) calculates ((((1+2)+3)+4)+5). The left argument, x, is the accumulated value and the right argument, y, is the update value from the iterable. If the optional initializer is present, it is placed before the items of the iterable in the calculation, and serves as a default when the iterable is empty. If initializer is not given and iterable contains only one item, the first item is returned. Roughly equivalent to：

意思就是说：将一个可迭代的对象应用到一个带有两个参数的方法上，我们称之为appFun,遍历这个可迭代对象，将其中的元素依次作为appFun的参数，但这个函数有两个参数，作为哪个参数呢？有这样的规则，看一下下面reduce方法的实现，有三个参数，第一个参数就是上面说的appFun，第二个参数就是那个可迭代的对象，而第三个呢？当调用reduce方法的时候给出了initializer这个参数，那么第一次调用appFun的时候这个参数值就作为第一个参数，而可迭代对象的元素依次作为appFun的第二个参数；如果调用reduce的时候没有给出initializer这个参数，那么第一次调用appFun的时候，可迭代对象的第一个元素就作为appFun的第一个元素，而可迭代器的从第二个元素到最后依次作为appFun的第二个参数，除第一次调用之外，appFun的第一个参数就是appFun的返回值了。例如reduce(lambda x, y: x+y, [1, 2, 3, 4, 5])，计算1到5的和，因为没有给定initializer参数，所以第一次调用x+y时，x=1,即列表的第一个元素，y=2,即列表的第二个元素，之后返回的1+2的结果作为第二次调用x+y中的x,即上一次的结果,y=2,即第二个元素，依次类推，知道得到1+2+3+4+5的结果。

这样看来，其实下面的代码定义是有一点问题，我们在程序中调用这段代码reduce(lambda x, y: x+y, [1, 2, 3, 4, 5])，得到的结果为16,而正确的结果为15，问题在于如果集合不是以0开始，那么按照如下代码，第一次调用x=1,即第一个元素，y也是等于1，也是第一个元素，而正确的y应该是2。所以真正的reduce方法应该和下面的例子是有差别的。

def reduce(function, iterable, initializer=None): 
  it = iter(iterable) 
  if initializer is None: 
    try: 
      initializer = next(it) 
    except StopIteration: 
      raise TypeError('reduce() of empty sequence with no initial value') 
  accum_value = initializer 
  for x in iterable: 
    accum_value = function(accum_value, x) 
  return accum_value

那么reduce函数能做什么,什么情况下要用reduce呢，看下面的例子：

例如上面的例子，实现一个整形集合的累加。假设lst = [1,2,3,4,5],实现累加的方式有很多：

第一种：用sum函数。

sum(lst)

第二种：循环方式。

def customer_sum(lst): 
  result = 0 
  for x in lst: 
    result+=x 
  return result 
 
#或者 
def customer_sum(lst): 
  result = 0 
  while lst: 
      temp = lst.pop(0) 
      result+=temp 
  return result 
 
if __name__=="__main__": 
  lst = [1,2,3,4,5] 
  print customer_sum(lst)

第三种：递推求和

def add(lst,result): 
  if lst: 
    temp = lst.pop(0) 
    temp+=result 
    return add(lst,temp) 
  else: 
    return result 
 
if __name__=="__main__": 
  lst = [1,2,3,4,5] 
  print add(lst,0)

第四种：reduce方式

lst = [1,2,3,4,5] 
print reduce(lambda x,y:x+y,lst) 
#这种方式用lambda表示当做参数，因为没有提供reduce的第三个参数，所以第一次执行时x=1,y=2,第二次x=1+2,y=3,即列表的第三个元素 
 
 
#或者 
lst = [1,2,3,4,5] 
print reduce(lambda x,y:x+y,lst,0) 
#这种方式用lambda表示当做参数，因为指定了reduce的第三个参数为0，所以第一次执行时x=0,y=1,第二次x=0+1,y=2,即列表的第二个元素， 
假定指定reduce的第三个参数为100，那么第一次执行x=100,y仍然是遍历列表的元素，最后得到的结果为115 
 
 
 
#或者 
def add(x,y): 
  return x+y 
 
print reduce(add, lst) 
#与方式1相同，只不过把lambda表达式换成了自定义函数 
 
#或者 
def add(x,y): 
  return x+y 
 
print reduce(add, lst,0) 
#与方式2相同，只不过把lambda表达式换成了自定义函数

再举一个例子：有一个序列集合，例如[1,1,2,3,2,3,3,5,6,7,7,6,5,5,5],统计这个集合所有键的重复个数，例如1出现了两次，2出现了两次等。大致的思路就是用字典存储，元素就是字典的key,出现的次数就是字典的value。方法依然很多

第一种：for循环判断

def statistics(lst): 
  dic = {} 
  for k in lst: 
    if not k in dic: 
      dic[k] = 1 
    else: 
      dic[k] +=1 
  return dic 
 
lst = [1,1,2,3,2,3,3,5,6,7,7,6,5,5,5] 
print(statistics(lst))

第二种：比较取巧的，先把列表用set方式去重，然后用列表的count方法

def statistics2(lst): 
  m = set(lst) 
  dic = {} 
  for x in m: 
    dic[x] = lst.count(x) 
 
  return dic 
 
lst = [1,1,2,3,2,3,3,5,6,7,7,6,5,5,5] 
print statistics2(lst)

第三种：用reduce方式

def statistics(dic,k): 
  if not k in dic: 
    dic[k] = 1 
  else: 
    dic[k] +=1 
  return dic 
 
lst = [1,1,2,3,2,3,3,5,6,7,7,6,5,5,5] 
print reduce(statistics,lst,{})  
#提供第三个参数，第一次，初始字典为空，作为statistics的第一个参数，然后遍历lst,作为第二个参数，然后将返回的字典集合作为下一次的第一个参数 
 
或者 
d = {} 
d.extend(lst) 
print reduce(statistics,d) 
#不提供第三个参数，但是要在保证集合的第一个元素是一个字典对象，作为statistics的第一个参数，遍历集合依次作为第二个参数

通过上面的例子发现,凡是要对一个集合进行操作的，并且要有一个统计结果的，能够用循环或者递归方式解决的问题，一般情况下都可以用reduce方式实现。

reduce函数真是“一位好同志啊”！

您可能感兴趣的文章:

Python os模块中的isfile()和isdir()函数均返回false问题解决方法
这篇文章主要介绍了Python os模块中的isfile()和isdir()函数均返回false问题解决方法,返回false的原因是路径使用了相对路径,使用绝对路径就可以解决这个问题,需要的朋友可以参考下
2015-02-02
python爬取足球直播吧五大联赛积分榜
这篇文章主要为大家详细介绍了python爬取足球直播吧五大联赛积分榜，具有一定的参考价值，感兴趣的小伙伴们可以参考一下
2018-06-06
Python开发工具PyCharm的下载与安装步骤图文教程
这篇文章主要为大家介绍了Python开发工具PyCharm的下载与安装步骤图文教程，有需要的朋友可以借鉴参考下，希望能够有所帮助，祝大家多多进步，早日升职加薪
2023-07-07
django-rest-swagger对API接口注释的方法
今天小编就为大家分享一篇django-rest-swagger对API接口注释的方法，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧
2019-08-08
Python数据结构之递归可视化详解
递归函数是直接调用自己或通过一系列语句间接调用自己的函数。递归在程序设计有着举足轻重的作用，在很多情况下，借助递归可以优雅的解决问题。本文主要介绍了如何利用可视化方式来了解递归函数的执行步骤，需要的可以参考一下
2022-04-04
用Django实现一个可运行的区块链应用
这篇文章主要介绍了用Django实现一个可运行的区块链应用,需要的朋友可以参考下
2018-03-03
tensorflow 1.X迁移至tensorflow2 的代码写法
本文主要介绍了tensorflow 1.X迁移至tensorflow2 的代码写法，文中通过示例代码介绍的非常详细，具有一定的参考价值，感兴趣的小伙伴们可以参考一下
2021-12-12
python 默认参数问题的陷阱
本文给大家讲述的是python 默认参数问题的陷阱，有需要的小伙伴可以参考下
2016-02-02
详解Python中xlsxwriter库的基本操作
xlsxwriter是一个用于创建和修改Excel文件（.xlsx）的Python库,它提供了丰富的功能,可以创建复杂的Excel工作簿,本文为大家介绍了它的一些基本操作,希望对大家有所帮助
2023-11-11
如何利用python获取鼠标点击的实时位置案例
这篇文章主要给大家介绍了关于如何利用python获取鼠标点击的实时位置,并展示了如何安装和使用该库,文中通过代码介绍的非常详细,需要的朋友可以参考下
2024-12-12

python中的reduce内建函数使用方法指南

相关文章

最新评论

大家感兴趣的内容

最近更新的内容

常用在线小工具