按组随机抽取行样本,直到达到最大行数。
创始人
2024-09-03 05:00:10
0

以下是一个示例代码,用于按组随机抽取行样本,直到达到最大行数:

import pandas as pd
import random

def random_sample_groups(data, group_column, max_rows):
    grouped_data = data.groupby(group_column)
    sampled_data = pd.DataFrame(columns=data.columns)

    for group, group_data in grouped_data:
        num_rows = group_data.shape[0]
        if num_rows <= max_rows:
            sampled_data = sampled_data.append(group_data)
        else:
            sampled_rows = random.sample(range(num_rows), max_rows)
            sampled_group_data = group_data.iloc[sampled_rows]
            sampled_data = sampled_data.append(sampled_group_data)

    return sampled_data

# 示例用法
# 创建一个示例数据框
data = pd.DataFrame({
    'Group': ['A', 'A', 'A', 'B', 'B', 'C', 'C', 'C'],
    'Value': [1, 2, 3, 4, 5, 6, 7, 8]
})

# 按照 'Group' 列进行分组抽取,每组最多抽取2行样本
sampled_data = random_sample_groups(data, 'Group', 2)
print(sampled_data)

输出结果可能为:

  Group Value
0     A     1
1     A     2
3     B     4
4     B     5
5     C     6
7     C     8

在这个示例中,我们首先根据 'Group' 列对数据进行分组,然后对每个组进行抽样。如果组的行数小于等于最大行数,则将整个组的数据加入到抽样数据框中。否则,我们使用 random.sample() 函数从组中随机选择最大行数的样本,并将这些样本添加到抽样数据框中。最后,返回抽样数据框作为结果。

相关内容

热门资讯

七分钟辅助!丽水茶苑苹果手机辅... 七分钟辅助!丽水茶苑苹果手机辅助,本来是真的有辅助教程(有挂方式)1、实时丽水茶苑苹果手机辅助透视辅...
第一分钟辅助!闲来辅助神器下载... 第一分钟辅助!闲来辅助神器下载2022,好像真的有辅助方法(有挂教程)1、不需要AI权限,帮助你快速...
九分钟辅助!丽水都莱辅助工具试... 九分钟辅助!丽水都莱辅助工具试用,确实存在有辅助神器(有挂方法)九分钟辅助!丽水都莱辅助工具试用,确...
第一分钟辅助!蛮王辅助器,好像... 第一分钟辅助!蛮王辅助器,好像是有辅助方法(有挂教学)1、首先打开蛮王辅助器辅助器下载最新版本,在蛮...
第六分钟辅助!潮汕汇挂,一贯真... 第六分钟辅助!潮汕汇挂,一贯真的是有辅助插件(有挂辅助)1、这是跨平台的潮汕汇挂轻量版有透视,在线的...
六分钟辅助!微信开心泉州辅助器... 六分钟辅助!微信开心泉州辅助器,一直有辅助器(有挂教学)1、下载好微信开心泉州辅助器透视辅助下载之后...
第3分钟辅助!佛手十三道破解版... 第3分钟辅助!佛手十三道破解版安卓,竟然真的有辅助攻略(有挂存在)1、让任何用户在无需佛手十三道破解...
2分钟辅助!sohoo竞技联盟... 2分钟辅助!sohoo竞技联盟辅助,切实真的有辅助脚本(有挂技术)1.sohoo竞技联盟辅助 选牌创...
第8分钟辅助!心悦手游辅助器,... 第8分钟辅助!心悦手游辅助器,原来真的是有辅助技巧(确实有挂);1、每一步都需要思考,不同水平的挑战...
第十分钟辅助!广东雀神祈福真的... 第十分钟辅助!广东雀神祈福真的有用吗,都是是有辅助技巧(有挂方略)1、下载好广东雀神祈福真的有用吗透...