python特征生成中字符类型有哪些?
- 更新时间:2021-12-02 12:05:17
- 编辑:储昊乾
我们帮大家精选了相关的编程文章,网友饶阳德根据主题投稿了本篇教程内容,涉及到Python相关内容,已被244网友关注,相关难点技巧可以阅读下方的电子资料。
参考资料
- 《OpenCV 4计算机视觉:Python语言实现(原书第3版)》配图源码 配套资源 / 266.5 MB / [加]约瑟夫·豪斯(Joseph Howse),[爱]乔·米尼奇诺(Joe Minichino) 推荐度:
- 你也能看得懂的Python算法书 PDF 电子书 / 54 KB / 王硕 推荐度:
- Python3 标准库 PDF 电子书 / 148.9 MB / 道格·赫尔曼 推荐度:
- Python机器学习(第2版) PDF 电子书 / 59.6 MB / 塞巴斯蒂安·拉施 推荐度:
- 我的Python世界(Minecraft我的世界) PDF 电子书 / 73 MB / 程晨 推荐度:
正文内容
给大家整理一篇不错的python文章,感觉很有用处,改了一下错误代码,希望大家能有所收获。
python特征生成中字符类型有截取、字符长度和频次。
一、python特征生成中字符类型
1、截取
当字符类型的值过多,通常可对字符类型变量做截取,以减少模型过拟合。如具体的家庭住址,可以截取字符串到城市级的粒度。
2、字符长度
统计字符串长度。如转账场景中,转账留言的字数某些程度可以刻画这笔转账的类型。
3、频次
二、python特征类型中字符使用
1、截取第一位字符串
df['I1_0'] = df['I1'].map(lambda x:str(x)[:1])
2、字符长度
df['I1_len'] = df['I1'].apply(lambda x:len(str(x))) display(df.head())
3、字符串频次
df['I1'].value_counts()
相关教程
-
micropython适合开发吗
MicroPython是基于Python3实现的嵌入式开发工具,通过对比发现MicroPython是很适合嵌入式的开发的,MicroPython的操作难度很低,程序结构易理解,程序语言易读。
发布时间:2019-06-27
-
解决Python报错问题[SSL: SSLV3_ALERT_HANDSHAKE_FAILURE]
这篇文章主要介绍了解决Python报错问题[SSL: SSLV3_ALERT_HANDSHAKE_FAILURE],具有很好的参考价值,希望对大家有所帮助。如有错误或未考虑完全的地方,望不吝赐教
发布时间:2019-07-23