版本 0.6.0 (2011年11月25日)#

新功能#

  • 新增melt 函式到 pandas.core.reshape

  • 新增level 引數,用於在 Series 和 DataFrame 的描述性統計中按級別分組 (GH 313)

  • 新增了 Series 的 headtail 方法,與 DataFrame 類似 (GH 296)

  • 新增Series.isin 函式,用於檢查每個值是否包含在傳入的序列中 (GH 289)

  • 新增float_format 選項到 Series.to_string

  • 新增skip_footer (GH 291) 和 converters (GH 343) 選項到 read_csvread_table

  • 新增drop_duplicatesduplicated 函式,分別用於刪除重複的 DataFrame 行和檢查重複的行 (GH 319)

  • 實現了 DataFrame 上的運算子 ‘&’, ‘|’, ‘^’, ‘-’ (GH 347)

  • 新增Series.mad,平均絕對偏差

  • 新增QuarterEnd DateOffset (GH 321)

  • 新增了 DataFrame 的 dot (GH 65)

  • 添加了 Panel.from_dictorient 選項 (GH 359, GH 301)

  • 新增DataFrame.from_dictorient 選項

  • 新增了將元組列表或列表列表傳遞給 DataFrame.from_records (GH 357)

  • 新增了多個級別到 groupby (GH 103)

  • 允許DataFrame.sort_indexby 引數中使用多個列 (GH 92, GH 362)

  • 新增了 DataFrame 的快速 get_valueput_value 方法 (GH 360)

  • 為 Series 和 DataFrame 添加了 cov 例項方法 (GH 194, GH 362)

  • 新增DataFrame.plotkind='bar' 選項 (GH 348)

  • 新增了 Series 和 DataFrame 的 idxminidxmax (GH 286)

  • 新增read_clipboard 函式,用於從剪貼簿解析 DataFrame (GH 300)

  • 新增了 Series 的 nunique 函式,用於計算唯一元素 (GH 297)

  • 使 DataFrame 建構函式在未傳遞 columns 時使用 Series 的名稱 (GH 373)

  • 支援在 read_table/read_csv 中使用正則表示式 (GH 364)

  • 新增DataFrame.to_html,用於將 DataFrame 寫入 HTML (GH 387)

  • 新增了對 DataFrame 中 MaskedArray 資料的支援,掩碼值轉換為 NaN (GH 396)

  • 新增DataFrame.boxplot 函式 (GH 368)

  • 可以將額外的 args, kwds 傳遞給 DataFrame.apply (GH 376)

  • 實現了具有向量 on 引數的 DataFrame.join (GH 312)

  • 新增legend 布林標誌到 DataFrame.plot (GH 324)

  • 可以將多個級別傳遞給 stackunstack (GH 370)

  • 可以將多個值列傳遞給 pivot_table (GH 381)

  • 使用 GroupBy 中的 Series 名稱作為結果索引 (GH 363)

  • 新增raw 選項到 DataFrame.apply,當只需要 ndarray 時可以提高效能 (GH 309)

  • 添加了對標準和麵板 OLS 的正確、經過測試的加權最小二乘法 (GH 303)

效能增強#

  • VBENCH Cython 化了 cache_readonly,從而在整個程式碼庫中實現了顯著的微效能提升 (GH 361)

  • VBENCH 特殊 Cython 矩陣迭代器,用於應用任意歸約操作,效能比 np.apply_along_axis 快 3-5 倍 (GH 309)

  • VBENCH 提高了 MultiIndex.from_tuples 的效能

  • VBENCH 特殊 Cython 矩陣迭代器,用於應用任意歸約操作

  • VBENCH + DOCUMENT 添加了 DataFrame.applyraw 選項,以獲得更好的效能

  • VBENCH 更快的 Cython 化 Series 和 DataFrame 按級別計數 (GH 341)

  • VBENCH? 顯著提高了 GroupBy 在具有許多“空”組合的多鍵情況下的效能

  • VBENCH 新的 Cython 向量化函式 map_infer 顯著加速了 Series.applySeries.map,當傳入逐個元素的 Python 函式時,其靈感來源於 (GH 355)

  • VBENCH 顯著提高了 Series.order 的效能,這也使得在 Series 上呼叫 np.unique 更快 (GH 327)

  • VBENCH 大幅提高了在具有 MultiIndex 的軸上 GroupBy 的效能 (GH 299)

貢獻者#

共有 8 人為此次釋出貢獻了補丁。名字旁有“+”號的人是首次貢獻補丁。

  • Adam Klein +

  • Chang She +

  • Dieter Vandenbussche

  • Jeff Hammerbacher +

  • Nathan Pinger +

  • Thomas Kluyver

  • Wes McKinney

  • Wouter Overmeire +