python特征生成中字符类型有截取、字符长度和频次。
一、python特征生成中字符类型
1、截取
当字符类型的值过多,通常可对字符类型变量做截取,以减少模型过拟合。如具体的家庭住址,可以截取字符串到城市级的粒度。
2、字符长度
统计字符串长度。如转账场景中,转账留言的字数某些程度可以刻画这笔转账的类型。
3、频次
二、python特征类型中字符使用
1、截取第一位字符串
1 |
|
2、字符长度
1 2 3 |
|
3、字符串频次
1 |
|
python特征生成中字符类型有截取、字符长度和频次。
一、python特征生成中字符类型
1、截取
当字符类型的值过多,通常可对字符类型变量做截取,以减少模型过拟合。如具体的家庭住址,可以截取字符串到城市级的粒度。
2、字符长度
统计字符串长度。如转账场景中,转账留言的字数某些程度可以刻画这笔转账的类型。
3、频次
二、python特征类型中字符使用
1、截取第一位字符串
1 |
|
2、字符长度
1 2 3 |
|
3、字符串频次
1 |
|
© 2021 Python学习网 苏ICP备2021003149号-1