python特征生成中字符类型有哪些?

377次阅读
没有评论

python特征生成中字符类型有哪些?

python特征生成中字符类型有截取、字符长度和频次。

一、python特征生成中字符类型

1、截取

当字符类型的值过多,通常可对字符类型变量做截取,以减少模型过拟合。如具体的家庭住址,可以截取字符串到城市级的粒度。

2、字符长度

统计字符串长度。如转账场景中,转账留言的字数某些程度可以刻画这笔转账的类型。

3、频次

二、python特征类型中字符使用

1、截取第一位字符串

df['I1_0'] = df['I1'].map(lambda x:str(x)[:1])

2、字符长度

df['I1_len'] = df['I1'].apply(lambda x:len(str(x)))

display(df.head())

3、字符串频次

df['I1'].value_counts()
神龙|纯净稳定代理IP免费测试>>>>>>>>天启|企业级代理IP免费测试>>>>>>>>IPIPGO|全球住宅代理IP免费测试

相关文章:

版权声明:wuyou2021-05-05发表,共计381字。
新手QQ群:570568346,欢迎进群讨论 Python51学习