Pandas探索之高性能函数eval和query解析

更新时间：2017年10月28日 11:13:32 作者：饭粒儿

这篇文章主要介绍了Pandas探索之高性能函数eval和query解析，小编觉得还是挺不错的，这里分享给大家，供需要的朋友参考。

Python Data Analysis Library 或 pandas 是基于NumPy 的一种工具，该工具是为了解决数据分析任务而创建的。Pandas 纳入了大量库和一些标准的数据模型，提供了高效地操作大型数据集所需的工具。pandas提供了大量能使我们快速便捷地处理数据的函数和方法。你很快就会发现，它是使Python成为强大而高效的数据分析环境的重要因素之一。

相较于 Python 的内置函数， Pandas 库为我们提供了一系列性能更高的数据处理函数，本节将向大家介绍 Pandas 库中的高性能函数 eval 与 query：

在 Python 中，我们可以用很多种的方法来实现同样的目标，例如实现两个数组的相加：

import numpy as np 
rng = np.random.RandomState(42) 
x = rng.rand(1E6) 
y = rng.rand(1E6) 
%timeit x + y 
100 loops, best of 3: 3.39 ms per loop

利用 Numpy 中的 fromiter 函数我们可以得到相同的一维数组，然而我们发现，这个语句的性能并不比内置的数组加法好。

%timeit np.fromiter((xi + yi for xi, yi in zip(x, y)), 
dtype=x.dtype, count=len(x)) 
1 loop, best of 3: 266 ms per loop

再比如，进行某一项条件的判断：

mask = (x > 0.5) & (y < 0.5) 
tmp1 = (x > 0.5) 
tmp2 = (y < 0.5) 
mask = tmp1 & tmp2

Numpy 库中的函数 allclose 用于判断两个数组是否相等，我们可以看到，使用 numexpr 库中的 evaluate 函数同样可以实现 mask 中的条件判断。

import numexpr 
mask_numexpr = numexpr.evaluate('(x > 0.5) & (y < 0.5)') 
np.allclose(mask, mask_numexpr) 
True

面对同样的问题，Pandas 库为我们提供了更高性能的解决方案， eval 函数能够将特定形式的字符串转换为对应含义的逻辑判断或运算，比 Python 的内置函数具有更好的算法效率：

import pandas as pd 
nrows, ncols = 100000, 100 
rng = np.random.RandomState(42) 
df1, df2, df3, df4 = (pd.DataFrame(rng.rand(nrows, ncols)) 
for i in range(4)) 
%timeit df1 + df2 + df3 + df4 
10 loops, best of 3: 87.1 ms per loop 
%timeit pd.eval('df1 + df2 + df3 + df4') 
10 loops, best of 3: 42.2 ms per loop 
np.allclose(df1 + df2 + df3 + df4, 
pd.eval('df1 + df2 + df3 + df4')) 
True

可以看到，eval 函数实现了等价的计算，并且具有更高的性能。除了加法运算，Pandas 的函数 eval 还能帮助我们实现其他多种复杂的逻辑判断或计算：

总结

以上就是本文关于Pandas探索之高性能函数eval和query解析的全部内容，希望对大家有所帮助。感兴趣的朋友可以继续参阅本站：Python探索之URL Dispatcher实例详解、Python编程之Re模块下的函数介绍等，如有不足之处，欢迎留言指出。感谢朋友们对本站的支持！

您可能感兴趣的文章:

python连接mongodb密码认证实例
今天小编就为大家分享一篇python连接mongodb密码认证实例，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧
2018-10-10
使用python加密自己的密码
本文给大家分享的是使用python加密自己的密码的思路和代码，非常的简单实用，有需要的小伙伴可以参考下。
2015-08-08
教你使用Python连接oracle
今天教各位小伙伴怎么用Python连接oracle,文中附带非常详细的图文示例,对正在学习的小伙伴们很有帮助哟,需要的朋友可以参考下
2021-05-05
python和shell获取文本内容的方法
今天小编就为大家分享一篇python和shell获取文本内容的方法，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧
2018-06-06
Python通过Socket手动实现HTTP协议
这篇文章主要为大家详细介绍了Python如何通过Socket手动实现HTTP协议,文中的示例代码讲解详细,感兴趣的小伙伴可以跟随小编一起学习一
2024-03-03
python中tf.boolean_mask()函数的使用方法详解
这篇文章主要介绍了python中tf.boolean_mask()函数的使用方法详解, tf.boolean_mask() 函数的作用是通过布尔值对指定的列的元素进行过滤,需要的朋友可以参考下
2023-11-11
python 下划线的不同用法
在本文中，我们将介绍 Python 中 _ 字符的不同用法。就像 Python 中的许多其他内容一样，我们会看到 “_” 的不同用法主要是惯例问题。这里我们将介绍几种不同的情况。
2020-10-10
Django ModelForm组件使用方法详解
这篇文章主要介绍了Django ModelForm组件使用方法详解,文中通过示例代码介绍的非常详细，对大家的学习或者工作具有一定的参考学习价值,需要的朋友可以参考下
2019-07-07
win10下python2和python3共存问题解决方法
在本篇文章里小编给大家整理了关于win10下python2和python3共存问题解决方法，有兴趣的朋友们参考下。
2019-12-12
Python实现用户名和密码登录
这篇文章主要为大家详细介绍了Python实现用户名和密码登录，文中示例代码介绍的非常详细，具有一定的参考价值，感兴趣的小伙伴们可以参考一下
2022-02-02

Pandas探索之高性能函数eval和query解析

相关文章

最新评论

大家感兴趣的内容

最近更新的内容

常用在线小工具