时间:2021-05-22
在Pandas中 求差集没有专门的函数。处理办法就是将两个DataFrame追加合并,然后去重。
divident.append(hasThisYearDivident)noHasThisYearDivident = divident.drop_duplicates(subset='ts_code', keep=False, inplace=True, ignore_index=True)具体函数用法:
https://pandas.pydata.org/pandas-docs/stable/reference/api/pandas.DataFrame.append.html#pandas.DataFrame.append
https://pandas.pydata.org/pandas-docs/stable/reference/api/pandas.DataFrame.drop_duplicates.html#pandas.DataFrame.drop_duplicates
在pandas中,两个DataFrame的差集并没有直接的库内置方法,现在我们希望有一种方法,就像python中set内置的求差集一样,来找到两个DataFrame的差集。
上面代码片段是对set的内置求差集方法的回顾,现在我们希望能有类似的方法来找两个DataFrame的差集。
解决思路是这样的:
对于有同样Index的a,b两个DataFrame,如果现在要求a对b的差集,那么可以(1)连续两次扩充a,使用append方法(2)然后使用drop_duplicates方法对a进行去重,并且参数keep=False。原理很简单,也很巧妙,连续扩充2次a,那么新扩充完后的DataFrame中来自b的row肯定是重复的,去重时候,b全部被删除,与此同时,a中跟b重复的row也会顺带着被删除。
代码实现:
>>> import pandas as pd>>> data_a={'state':[1,1,2],'pop':['a','b','c']}>>> data_b={'state':[1,2,3],'pop':['b','c','d']}>>> a=pd.DataFrame(data_a)>>> b=pd.DataFrame(data_b)>>> a state pop0 1 a1 1 b2 2 c>>> b state pop0 1 b1 2 c2 3 d>>> a=a.append(b)>>> a=a.append(b)>>> a state pop0 1 a1 1 b2 2 c0 1 b1 2 c2 3 d0 1 b1 2 c2 3 d>>> a.drop_duplicates(subset=['state','pop'],keep=False) state pop0 1 a到此这篇关于Pandas DataFrame求差集的示例代码的文章就介绍到这了,更多相关Pandas DataFrame求差集内容请搜索以前的文章或继续浏览下面的相关文章希望大家以后多多支持!
声明:本页内容来源网络,仅供用户参考;我单位不保证亦不表示资料全面及准确无误,也不保证亦不表示这些资料为最新信息,如因任何原因,本网内容或者用户因倚赖本网内容造成任何损失或损害,我单位将不会负任何法律责任。如涉及版权问题,请提交至online#300.cn邮箱联系删除。
query()函数简介pandas的query()方法是基于DataFrame列的计算代数式,对于按照某列的规则进行过滤的操作,可以使用query方法。代码示例
pandas代码如下:importpandasaspdimportnumpyasnpsalaries=pd.DataFrame({'name':['BOSS',
通过?pandas.DataFrame.shift命令查看帮助文档Signature:pandas.DataFrame.shift(self,perio
对于pandas的dataframe,绘制直方图方法如下://pdf是pandas的dataframe,delta_time是其中一列//xlim是x轴的范围,
pandas.DataFrame.rename使用函数:DataFrame.rename(mapper=None,index=None,columns=None