GroupBy#

pandas.api.typing.DataFrameGroupBypandas.api.typing.SeriesGroupBy 实例分别由 groupby 调用 pandas.DataFrame.groupby()pandas.Series.groupby() 返回。

索引、迭代#

DataFrameGroupBy.__iter__()

Groupby 迭代器。

SeriesGroupBy.__iter__()

Groupby 迭代器。

DataFrameGroupBy.groups

字典 {组名 -> 组标签}。

SeriesGroupBy.groups

字典 {组名 -> 组标签}。

DataFrameGroupBy.indices

字典 {组名 -> 组索引}。

SeriesGroupBy.indices

字典 {组名 -> 组索引}。

DataFrameGroupBy.get_group(name)

使用提供的名称从组中构造 DataFrame。

SeriesGroupBy.get_group(name)

使用提供的名称从组中构造 DataFrame。

Grouper(*args, **kwargs)

Grouper 允许用户为对象指定 groupby 指令。

函数应用助手#

NamedAgg(column, aggfunc, *args, **kwargs)

用于控制输出列名称的特定列聚合的助手。

函数应用#

SeriesGroupBy.apply(func, *args, **kwargs)

按组应用函数 func 并合并结果。

DataFrameGroupBy.apply(func, *args[, ...])

按组应用函数 func 并合并结果。

SeriesGroupBy.agg([func, engine, engine_kwargs])

使用一个或多个操作进行聚合。

DataFrameGroupBy.agg([func, engine, ...])

使用一个或多个操作进行聚合。

SeriesGroupBy.aggregate([func, engine, ...])

使用一个或多个操作进行聚合。

DataFrameGroupBy.aggregate([func, engine, ...])

使用一个或多个操作进行聚合。

SeriesGroupBy.transform(func, *args[, ...])

对每个组调用生成相同索引的 Series 的函数。

DataFrameGroupBy.transform(func, *args[, ...])

对每个组调用生成相同索引的 DataFrame 的函数。

SeriesGroupBy.pipe(func, *args, **kwargs)

将带有参数的 func 应用于此 GroupBy 对象并返回其结果。

DataFrameGroupBy.pipe(func, *args, **kwargs)

将带有参数的 func 应用于此 GroupBy 对象并返回其结果。

DataFrameGroupBy.filter(func[, dropna])

过滤掉不满足标准的组的元素。

SeriesGroupBy.filter(func[, dropna])

过滤掉不满足标准的组的元素。

DataFrameGroupBy 计算 / 描述性统计#

DataFrameGroupBy.all([skipna])

如果组中的所有值都为真,则返回 True,否则返回 False。

DataFrameGroupBy.any([skipna])

如果组中的任何值都为真,则返回 True,否则返回 False。

DataFrameGroupBy.bfill([limit])

向后填充值。

DataFrameGroupBy.corr([method, min_periods, ...])

计算列的成对相关性,排除 NA/null 值。

DataFrameGroupBy.corrwith(other[, drop, ...])

(已弃用) 计算成对相关性。

DataFrameGroupBy.count()

计算组的计数,排除缺失值。

DataFrameGroupBy.cov([min_periods, ddof, ...])

计算列的成对协方差,排除 NA/null 值。

DataFrameGroupBy.cumcount([ascending])

为组中的每个项目从 0 编号到该组的长度减 1。

DataFrameGroupBy.cummax([numeric_only])

每个组的累积最大值。

DataFrameGroupBy.cummin([numeric_only])

每个组的累积最小值。

DataFrameGroupBy.cumprod([numeric_only])

每个组的累积乘积。

DataFrameGroupBy.cumsum([numeric_only])

每个组的累积和。

DataFrameGroupBy.describe([percentiles, ...])

生成描述性统计信息。

DataFrameGroupBy.diff([periods])

元素的离散差值。

DataFrameGroupBy.ewm([com, span, halflife, ...])

返回一个 ewm grouper,为每个组提供 ewm 功能。

DataFrameGroupBy.expanding([min_periods, method])

返回一个 expanding grouper,为每个组提供 expanding 功能。

DataFrameGroupBy.ffill([limit])

向前填充值。

DataFrameGroupBy.first([numeric_only, ...])

计算每个组内每列的第一个条目。

DataFrameGroupBy.head([n])

返回每个组的前 n 行。

DataFrameGroupBy.idxmax([skipna, numeric_only])

返回每个组中最大值的第一个出现索引。

DataFrameGroupBy.idxmin([skipna, numeric_only])

返回每个组中最小值第一个出现索引。

DataFrameGroupBy.last([numeric_only, ...])

计算每个组内每列的最后一个条目。

DataFrameGroupBy.max([numeric_only, ...])

计算组值的最大值。

DataFrameGroupBy.mean([numeric_only, ...])

计算组的平均值,排除缺失值。

DataFrameGroupBy.median([numeric_only, skipna])

计算组的中位数,排除缺失值。

DataFrameGroupBy.min([numeric_only, ...])

计算组值的最小值。

DataFrameGroupBy.ngroup([ascending])

将每个组从 0 编号到组数减 1。

DataFrameGroupBy.nth

如果 n 是整数,则取每组的第 n 行;否则,取行的子集。

DataFrameGroupBy.nunique([dropna])

返回 DataFrame,其中包含每列中唯一元素的计数。

DataFrameGroupBy.ohlc()

计算组的开盘、最高、最低和收盘值,排除缺失值。

DataFrameGroupBy.pct_change([periods, ...])

计算组中每个值与前一个条目的百分比变化。

DataFrameGroupBy.prod([numeric_only, ...])

计算组值的乘积。

DataFrameGroupBy.quantile([q, ...])

根据给定的分位数返回组值,类似于 numpy.percentile。

DataFrameGroupBy.rank([method, ascending, ...])

提供每个组内值的排名。

DataFrameGroupBy.resample(rule, *args[, ...])

使用 TimeGrouper 时提供重采样。

DataFrameGroupBy.rolling(window[, ...])

返回一个 rolling grouper,为每个组提供 rolling 功能。

DataFrameGroupBy.sample([n, frac, replace, ...])

从每个组中返回随机样本。

DataFrameGroupBy.sem([ddof, numeric_only, ...])

计算组的标准误差,排除缺失值。

DataFrameGroupBy.shift([periods, freq, ...])

将每个组移动 periods 个观测值。

DataFrameGroupBy.size()

计算组的大小。

DataFrameGroupBy.skew([skipna, numeric_only])

返回组内的无偏偏度。

DataFrameGroupBy.kurt([skipna, numeric_only])

返回组内的无偏峰度。

DataFrameGroupBy.std([ddof, engine, ...])

计算组的标准差,排除缺失值。

DataFrameGroupBy.sum([numeric_only, ...])

计算组值的总和。

DataFrameGroupBy.var([ddof, engine, ...])

计算组的方差,排除缺失值。

DataFrameGroupBy.tail([n])

返回每个组的最后 n 行。

DataFrameGroupBy.take(indices, **kwargs)

返回每个组中指定位置索引的元素。

DataFrameGroupBy.value_counts([subset, ...])

返回一个包含唯一行计数的 Series 或 DataFrame。

SeriesGroupBy 计算 / 描述性统计#

SeriesGroupBy.all([skipna])

如果组中的所有值都为真,则返回 True,否则返回 False。

SeriesGroupBy.any([skipna])

如果组中的任何值都为真,则返回 True,否则返回 False。

SeriesGroupBy.bfill([limit])

向后填充值。

SeriesGroupBy.corr(other[, method, min_periods])

计算每个组与其他 Series 之间的相关性。

SeriesGroupBy.count()

计算组的计数,排除缺失值。

SeriesGroupBy.cov(other[, min_periods, ddof])

计算每个组与其他 Series 之间的协方差。

SeriesGroupBy.cumcount([ascending])

为组中的每个项目从 0 编号到该组的长度减 1。

SeriesGroupBy.cummax([numeric_only])

每个组的累积最大值。

SeriesGroupBy.cummin([numeric_only])

每个组的累积最小值。

SeriesGroupBy.cumprod([numeric_only])

每个组的累积乘积。

SeriesGroupBy.cumsum([numeric_only])

每个组的累积和。

SeriesGroupBy.describe([percentiles, ...])

生成描述性统计信息。

SeriesGroupBy.diff([periods])

元素的离散差值。

SeriesGroupBy.ewm([com, span, halflife, ...])

返回一个 ewm grouper,为每个组提供 ewm 功能。

SeriesGroupBy.expanding([min_periods, method])

返回一个 expanding grouper,为每个组提供 expanding 功能。

SeriesGroupBy.ffill([limit])

向前填充值。

SeriesGroupBy.first([numeric_only, ...])

计算每个组内每列的第一个条目。

SeriesGroupBy.head([n])

返回每个组的前 n 行。

SeriesGroupBy.last([numeric_only, ...])

计算每个组内每列的最后一个条目。

SeriesGroupBy.idxmax([skipna])

返回最大值的行标签。

SeriesGroupBy.idxmin([skipna])

返回最小值行标签。

SeriesGroupBy.is_monotonic_increasing

返回每个组的值是否单调递增。

SeriesGroupBy.is_monotonic_decreasing

返回每个组的值是否单调递减。

SeriesGroupBy.max([numeric_only, min_count, ...])

计算组值的最大值。

SeriesGroupBy.mean([numeric_only, skipna, ...])

计算组的平均值,排除缺失值。

SeriesGroupBy.median([numeric_only, skipna])

计算组的中位数,排除缺失值。

SeriesGroupBy.min([numeric_only, min_count, ...])

计算组值的最小值。

SeriesGroupBy.ngroup([ascending])

将每个组从 0 编号到组数减 1。

SeriesGroupBy.nlargest([n, keep])

返回最大的 n 个元素。

SeriesGroupBy.nsmallest([n, keep])

返回最小的 n 个元素。

SeriesGroupBy.nth

如果 n 是整数,则取每组的第 n 行;否则,取行的子集。

SeriesGroupBy.nunique([dropna])

返回组中唯一元素的数量。

SeriesGroupBy.unique()

返回每个组的唯一值。

SeriesGroupBy.ohlc()

计算组的开盘、最高、最低和收盘值,排除缺失值。

SeriesGroupBy.pct_change([periods, ...])

计算组中每个值与前一个条目的百分比变化。

SeriesGroupBy.prod([numeric_only, ...])

计算组值的乘积。

SeriesGroupBy.quantile([q, interpolation, ...])

根据给定的分位数返回组值,类似于 numpy.percentile。

SeriesGroupBy.rank([method, ascending, ...])

提供每个组内值的排名。

SeriesGroupBy.resample(rule, *args[, ...])

使用 TimeGrouper 时提供重采样。

SeriesGroupBy.rolling(window[, min_periods, ...])

返回一个 rolling grouper,为每个组提供 rolling 功能。

SeriesGroupBy.sample([n, frac, replace, ...])

从每个组中返回随机样本。

SeriesGroupBy.sem([ddof, numeric_only, skipna])

计算组的标准误差,排除缺失值。

SeriesGroupBy.shift([periods, freq, ...])

将每个组移动 periods 个观测值。

SeriesGroupBy.size()

计算组的大小。

SeriesGroupBy.skew([skipna, numeric_only])

返回组内的无偏偏度。

SeriesGroupBy.kurt([skipna, numeric_only])

返回组内的无偏峰度。

SeriesGroupBy.std([ddof, engine, ...])

计算组的标准差,排除缺失值。

SeriesGroupBy.sum([numeric_only, min_count, ...])

计算组值的总和。

SeriesGroupBy.var([ddof, engine, ...])

计算组的方差,排除缺失值。

SeriesGroupBy.tail([n])

返回每个组的最后 n 行。

SeriesGroupBy.take(indices, **kwargs)

返回每个组中指定位置索引的元素。

SeriesGroupBy.value_counts([normalize, ...])

返回一个包含唯一行计数的 Series 或 DataFrame。

绘图与可视化#

DataFrameGroupBy.boxplot([subplots, column, ...])

从DataFrameGroupBy数据创建箱线图。

DataFrameGroupBy.hist([column, by, grid, ...])

绘制 DataFrame 列的直方图。

SeriesGroupBy.hist([by, ax, grid, ...])

使用Series.hist() API绘制每个组值的直方图。

DataFrameGroupBy.plot

从DataFrame绘制组图。

SeriesGroupBy.plot

从Series绘制组图。