溫馨提示×

溫馨提示×

您好，登錄后才能下訂單哦！

密碼登錄×

忘記密碼？

登錄注冊×

獲取短信驗證碼

其他方式登錄

點擊登錄注冊即表示同意《億速云用戶服務條款》

用戶登錄×

賬戶密碼登錄

請使用微信掃描上方二維碼

使用幫助

請求超時！

請點擊重新獲取二維碼

如何在Pandas中利用DataFrame求差集

發布時間：2020-12-14 14:27:39 來源：億速云閱讀：3309 作者：Leah 欄目：開發技術

本篇文章為大家展示了如何在Pandas中利用DataFrame求差集，內容簡明扼要并且容易理解，絕對能使你眼前一亮，通過這篇文章的詳細介紹希望你能有所收獲。

在Pandas中求差集沒有專門的函數。處理辦法就是將兩個DataFrame追加合并，然后去重。

divident.append(hasThisYearDivident)
noHasThisYearDivident = divident.drop_duplicates(subset='ts_code', keep=False, inplace=True, ignore_index=True)

具體函數用法：

如何在Pandas中利用DataFrame求差集

https://pandas.pydata.org/pandas-docs/stable/reference/api/pandas.DataFrame.append.html#pandas.DataFrame.append

如何在Pandas中利用DataFrame求差集

在pandas中，兩個DataFrame的差集并沒有直接的庫內置方法，現在我們希望有一種方法，就像python中set內置的求差集一樣，來找到兩個DataFrame的差集。

>>> a=set((1,2,3))
>>> a
{1, 2, 3}
>>> b=set((2,3,4))
>>> b
{2, 3, 4}
>>> a-b
{1}

上面代碼片段是對set的內置求差集方法的回顧，現在我們希望能有類似的方法來找兩個DataFrame的差集。

解決思路是這樣的：

對于有同樣Index的a,b兩個DataFrame，如果現在要求a對b的差集，那么可以（1)連續兩次擴充a，使用append方法（2）然后使用drop_duplicates方法對a進行去重，并且參數keep=False。原理很簡單，也很巧妙，連續擴充2次a，那么新擴充完后的DataFrame中來自b的row肯定是重復的，去重時候，b全部被刪除，與此同時，a中跟b重復的row也會順帶著被刪除。

代碼實現：

>>> import pandas as pd
>>> data_a={'state':[1,1,2],'pop':['a','b','c']}
>>> data_b={'state':[1,2,3],'pop':['b','c','d']}
>>> a=pd.DataFrame(data_a)
>>> b=pd.DataFrame(data_b)
>>> a
  state pop
0   1  a
1   1  b
2   2  c
>>> b
  state pop
0   1  b
1   2  c
2   3  d
>>> a=a.append(b)
>>> a=a.append(b)
>>> a
  state pop
0   1  a
1   1  b
2   2  c
0   1  b
1   2  c
2   3  d
0   1  b
1   2  c
2   3  d
>>> a.drop_duplicates(subset=['state','pop'],keep=False)
  state pop
0   1  a

上述內容就是如何在Pandas中利用DataFrame求差集，你們學到知識或技能了嗎？如果還想學到更多技能或者豐富自己的知識儲備，歡迎關注億速云行業資訊頻道。

向AI問一下細節

推薦閱讀：

免責聲明：本站發布的內容（圖片、視頻和文字）以原創、轉載和分享為主，文章觀點不代表本網站立場，如果涉及侵權請聯系站長郵箱：is@yisu.com進行舉報，并提供相關證據，一經查實，將立刻刪除涉嫌侵權內容。

上一篇新聞：
利用JavaScript怎么實現一個滾動條自動滾動功能
下一篇新聞：
利用pandas怎么對指定列值對應的行進行篩選

猜你喜歡

AI
助
手

產品服務

地區劃分

專題活動

幫助支持

關于我們

售后咨詢

7*24小時在線電話：400-100-2938

7*24小時在線 QQ：800811969

關注億速云

億速云公眾號

手機網站二維碼

亚洲午夜精品一区二区_中文无码日韩欧免_久久香蕉精品视频_欧美主播一区二区三区美女