2.0.1 版本更新 (2023 年 4 月 24 日)#
這是 pandas 2.0.1 版本中的更改。有關包括其他 pandas 版本在內的完整變更日誌,請參閱 發行說明。
修復的迴歸#
修復了從字典構建子類 Series 時出現的迴歸問題 (GH 52445)
修復了
SeriesGroupBy.agg()中當按分類資料分組、多重分組、as_index=False以及聚合列表時出現的迴歸問題 (GH 52760)修復了
DataFrame.resample()在 DataFrame 沒有列時引發錯誤的迴歸問題 (GH 52484)修復了
DataFrame.sort_values()中當 DataFrame 已排序且ignore_index=True時未重置索引的迴歸問題 (GH 52553)修復了
MultiIndex.isin()對Generator引發TypeError的迴歸問題 (GH 52568)修復了
Series.describe()在具有一個元素的擴充套件 dtypeSeries時顯示RuntimeWarning的迴歸問題 (GH 52515)修復了當向一個
DataFrame新增新列時,如果DataFrame.columns是RangeIndex且新鍵是可雜湊但非標量時出現的迴歸問題 (GH 52652)
Bug 修復#
修復了
Series.dt.days中導致int32天數溢位的錯誤 (GH 52391)修復了
arrays.DatetimeArray建構函式在接收非納秒級 numpy datetime 陣列時返回錯誤單位的錯誤 (GH 52555)修復了
ArrowExtensionArray在使用包含 numpyNaT的資料構造時,duration dtype 溢位的錯誤 (GH 52843)修復了
Series.dt.round()在傳入頻率freq與 Series 解析度相等或更高時引發ZeroDivisionError的錯誤 (GH 52761)修復了
Series.median()在使用ArrowDtype時返回近似中位數的錯誤 (GH 52679)修復了
api.interchange.from_dataframe()在處理分類 dtype 時不必要地引發錯誤的錯誤 (GH 49889)修復了
api.interchange.from_dataframe()在處理大型字串 dtype 時不必要地引發錯誤的錯誤 (GH 52795)修復了
pandas.testing.assert_series_equal()中check_dtype=False仍然會對解析度不同的 datetime 或 timedelta 型別引發錯誤的 bug (GH 52449)修復了
read_csv()在dtype_backend="pyarrow"和parse_dates設定時,將 PyArrow datetimes 轉換為 NumPy 導致效能瓶頸的錯誤 (GH 52546)修復了
to_datetime()和to_timedelta()在嘗試轉換帶有ArrowDtype的數值資料時的錯誤 (GH 52425)修復了
to_numeric()在errors='coerce'、dtype_backend='pyarrow'以及ArrowDtype資料時的錯誤 (GH 52588)修復了
ArrowDtype.__from_arrow__()未尊重是否顯式指定 dtype 的錯誤 (GH 52533)修復了
DataFrame.describe()在include和exclude引數中未正確處理ArrowDtype的錯誤 (GH 52570)修復了
DataFrame.max()及相關操作將不同Timestamp解析度始終強制轉換為納秒的錯誤 (GH 52524)修復了
Series.describe()在使用ArrowDtype和pyarrow.float64型別以及數值資料時未返回結果的錯誤 (GH 52427)修復了
Series.dt.tz_localize()在使用ArrowDtype時錯誤本地化時間戳的錯誤 (GH 52677)修復了
np.datetime64和np.timedelta64NaT標量之間的算術運算,無論單位如何,總是返回納秒解析度的錯誤 (GH 52295)修復了
ArrowDtype與 numpy 掩碼型別(例如"boolean")之間的邏輯和比較運算錯誤 (GH 52625)修復了
merge()在一側使用ArrowDtype另一側使用 NumPy dtype 進行合併時的 bug (GH 52406)修復了
Series.to_numpy()使用null[pyarrow]dtype 時出現的 segfault 錯誤 (GH 52443)
其他#
從空字典建立的
DataFrame的columns的 dtype 為object。現在是RangeIndex(GH 52404)從空字典建立的
Series的index的 dtype 為object。現在是RangeIndex(GH 52404)為
pyarrow.string的ArrowDtype實現了Series.str.split()和Series.str.rsplit()(GH 52401)為
pyarrow.string的ArrowDtype實現了大部分str訪問器方法 (GH 52401)為
RangeIndex.get_loc()提供一個測試api.types.is_scalar()為False的非整數可雜湊鍵,現在會像Index.get_loc()一樣引發KeyError。之前會引發InvalidIndexError(GH 52652)。
貢獻者#
共有 20 位貢獻者為此版本貢獻了補丁。名字旁有“+”號的人是首次貢獻補丁。
Alex Malins +
Chris Carini +
Dea María Léon
Joris Van den Bossche
Luke Manley
Marc Garcia
Marco Edward Gorelli
MarcoGorelli
Matthew Roeschke
MeeseeksMachine
Natalia Mokeeva
Nirav +
Pandas Development Team
Patrick Hoefler
Richard Shadrach
Stefanie Molin
Terji Petersen
Thomas +
Thomas Li
yonashub