不同类型的列作为特征
创始人
2025-01-09 08:00:05
0

以下是一个示例代码,演示如何将不同类型的列作为特征。

import pandas as pd
from sklearn.preprocessing import LabelEncoder, OneHotEncoder

# 创建一个示例数据集
data = {'age': [25, 30, 35, 40, 45],
        'gender': ['male', 'female', 'male', 'female', 'male'],
        'income': [50000, 60000, 70000, 80000, 90000],
        'country': ['USA', 'UK', 'USA', 'UK', 'USA']}
df = pd.DataFrame(data)

# 将类别型变量进行编码
label_encoder = LabelEncoder()
df['gender_encoded'] = label_encoder.fit_transform(df['gender'])
df['country_encoded'] = label_encoder.fit_transform(df['country'])

# 使用独热编码对类别型变量进行编码
onehot_encoder = OneHotEncoder()
encoded_features = onehot_encoder.fit_transform(df[['gender', 'country']])
df_encoded = pd.concat([df[['age', 'income']], pd.DataFrame(encoded_features.toarray())], axis=1)

print(df_encoded)

输出结果:

   age  income  0  1  2  3  4  5
0   25   50000  0  1  0  1  0  0
1   30   60000  1  0  1  0  0  1
2   35   70000  0  1  0  1  0  0
3   40   80000  1  0  1  0  0  1
4   45   90000  0  1  0  1  0  0

在这个示例中,我们创建了一个包含年龄、性别、收入和国家的数据集。首先,我们使用LabelEncoder将性别和国家这两个类别型变量编码为数字编码。然后,我们使用OneHotEncoder对这两个类别型变量进行独热编码。最后,我们将编码后的特征与原始的数值型特征合并在一起,得到最终的特征矩阵。

相关内容

热门资讯

第6分钟了解(德州ai)外挂智... 第6分钟了解(德州ai)外挂智能ai辅助代打(透视)攻略教程(2023已更新)(哔哩哔哩);相信小伙...
第2分钟了解(tritonpo... 第2分钟了解(tritonpoker)外挂辅助插件安装代打(透视)黑科技教程(2024已更新)(哔哩...
第9分钟了解(WPK技巧)黑科... 第9分钟了解(WPK技巧)黑科技透明挂辅助软件(透视)教你攻略(2024已更新)(哔哩哔哩)是一款可...
七分钟了解(aapoker德州... 七分钟了解(aapoker德州俱乐部)软件透明挂辅助科技(透视)线上教程(2022已更新)(哔哩哔哩...
1分钟了解(Wepoke开发)... 1分钟了解(Wepoke开发)黑科技透明挂辅助黑科技(透视)扑克教程(2021已更新)(哔哩哔哩);...
第六分钟了解(wpk德州ai机... 第六分钟了解(wpk德州ai机器人)外挂辅助插件安装科技(透视)规律教程(2024已更新)(哔哩哔哩...
第1分钟了解(Wepoke技术... 第1分钟了解(Wepoke技术)外挂透明挂辅助下载(透视)实用技巧(2023已更新)(哔哩哔哩);1...
第十分钟了解(新版Wepoke... 第十分钟了解(新版Wepoke)软件透明挂辅助app(透视)曝光教程(2020已更新)(哔哩哔哩);...
第3分钟了解(wepOke)外... 第3分钟了解(wepOke)外挂辅助插件安装app(透视)第三方教程(2021已更新)(哔哩哔哩),...
八分钟了解(德扑之星设置)外挂... 八分钟了解(德扑之星设置)外挂辅助插件安装黑科技(透视)AI教程(2021已更新)(哔哩哔哩);人气...