版本 0.5.0 (2011 年 10 月 24 日)#

新功能#

  • 添加了 帶有標準連線選項的 DataFrame.align 方法

  • 添加了 read_csvread_table 方法的 parse_dates 選項,以可選地嘗試解析索引列中的日期

  • 添加了 read_csvread_table 方法的 nrowschunksizeiterator 引數。後兩者返回一個新的 TextParser 類,能夠惰性地迭代扁平檔案的塊(GH 242

  • 添加了DataFrame.join 中按多列進行連線的能力(GH 214

  • Index 添加了私有 _get_duplicates 函式,以便更輕鬆地識別重複值(ENH5c

  • 添加了 DataFrame 的列屬性訪問。

  • 添加了 DataFrame 列的 Python 標籤補全鉤子。(GH 233GH 230

  • 實現了 包含物件的 Series 的 Series.describeGH 241

  • 添加了 在使用鍵進行 DataFrame.join 時使用內連線選項(GH 248

  • 實現了 透過將列表傳遞給 __getitem__ 來選擇 DataFrame 列(GH 253

  • 實現了 & 和 | 分別用於交集/並集 Index 物件(GH 261

  • pandas 名稱空間中添加了 pivot_table 便利函式(GH 234

  • 實現了 Panel.rename_axis 函式(GH 243

  • DataFrame 將在控制檯輸出中顯示索引級別名稱(GH 334

  • 實現了 Panel.take

  • 添加了 set_eng_float_format 用於 DataFrame 浮點數字符串的備用格式化(ENH61

  • 添加了 用於從現有列建立 DataFrame 索引的便利 set_index 函式

  • 實現了 groupby 分層索引級別名稱(GH 223

  • 添加了DataFrame.to_csv 中不同分隔符的支援(GH 244

效能增強#

  • VBENCH 檔案解析函式 read_csvread_table 的主要效能改進

  • VBENCH 添加了 Cython 函式,用於將元組非常快速地轉換為 ndarray。加速了許多 MultiIndex 相關的操作

  • VBENCH 將合併/連線程式碼重構為一個整潔的類,並停用了浮點/物件情況下的不必要計算,從而獲得了約 10% 的效能提升(GH 211

  • VBENCH 混合型別 DataFrame 物件的 DataFrame.xs 速度提高了約 5 倍,這是自 0.3.0 以來的迴歸(GH 215

  • VBENCH 藉助新的 DataFrame.align 方法,將具有不同索引的 DataFrame 物件之間的二元操作速度提高了 10-25%。

  • VBENCH 顯著加快了將巢狀字典轉換為 DataFrame 的速度(GH 212

  • VBENCH 顯著加速了大型混合型別 DataFrame 物件的 DataFrame __repr__count

貢獻者#

共有 9 人為此發行版貢獻了補丁。名字旁有“+”的人是首次貢獻補丁。

  • Aman Thakral +

  • Luca Beltrame +

  • Nick Pentreath +

  • Skipper Seabold

  • Thomas Kluyver +

  • Wes McKinney

  • Yaroslav Halchenko +

  • lodagro +

  • unknown +