python特征生成中字符类型有哪些?
python特征生成中字符类型有截取、字符长度和频次。
一、python特征生成中字符类型
1、截取
当字符类型的值过多,通常可对字符类型变量做截取,以减少模型过拟合。如具体的家庭住址,可以截取字符串到城市级的粒度。
2、字符长度
统计字符串长度。如转账场景中,转账留言的字数某些程度可以刻画这笔转账的类型。
3、频次
二、python特征类型中字符使用
1、截取第一位字符串
df['I1_0']=df['I1'].map(lambdax:str(x)[:1])
2、字符长度
df['I1_len']=df['I1'].apply(lambdax:len(str(x)))
display(df.head())
3、字符串频次
df['I1'].value_counts()
以上就是python特征生成中字符类型有哪些?希望能对大家有所帮助,更多Python学习教程请关注IT培训机构:千锋教育。
猜你喜欢LIKE
相关推荐HOT
更多>>python调用dll
在python中调用dll文件中的接口比较简单,实例代码如下:如我们有一个test.dll文件,内部定义如下:extern"C"{int__stdcalltest(void*p,intlen)...详情>>
2023-11-08 23:31:04pythonpathlib模块的用法有哪些?
python中pathlib模块的用法有哪些?在这个世界上,人们每天都在用Python完成着不同的工作。而文件操作,则是大家最常需要解决的任务之一。使用Py...详情>>
2023-11-08 18:37:21pythonPyramid框架是什么?
python中Pyramid框架是什么?本文教程操作环境:windows7系统、Python3.9.1,DELLG3电脑。1、说明Pyramid以其高效率和快节奏的开发能力而出名。P...详情>>
2023-11-08 08:56:32pythongil是什么
pythongil是什么1、说明是全局解释器锁,每个线程在执行时候都需要先获取GIL,保证同一时刻只有一个线程可以执行代码,即同一时刻只有一个线程...详情>>
2023-11-08 05:44:47