今天小编就为大家分享一篇python处理两种分隔符的数据集方法,具有很好的参考价值,希望对大家有所帮助。一起跟随小编过来看看吧

在做机器学习的时候,遇到这样一个数据集...

一共399行10列,

1-9列是用不定长度的空格分割,

第9-10列之间用'\t'分割,

前九列都是数值类型,其中第三列有若干个'?'填充的缺失值...

第十列是字符串类型,..

部分数据截图:

之前我是用python强写的...很麻烦,代码如下:

至此,可以已平均值,填充缺失值...

今天再回顾此数据库;决定用pandas库来试试;

1,导包,用pandas.read_table导入数据集,

2,数据处理

最后输出如下:

以上这篇python处理两种分隔符的数据集方法就是小编分享给大家的全部内容了,希望能给大家一个参考,也希望大家多多支持爱安网。

最新资讯
李在镕:三星所有人都会珍惜李健熙的记忆

李在镕:三星所有人都会

李在镕表示,“我们三星的所有人都会珍惜他的记忆,并感谢
三星会长李健熙去世 三星发声明:他的遗产将是永恒的

三星会长李健熙去世

三星的一份声明说,李健熙周日去世时,他的家人,包括他的儿
三星会长李健熙去世 继承人或将面临76亿美元遗产税

三星会长李健熙去世

李健熙去世之后,他的继承人或将面临76亿美元的遗产税。
三星会长李健熙去世:此前被指控逃税和侵吞公司资产118亿韩元

三星会长李健熙去世:此

此前李健熙被控逃税和侵吞公司资产总价值超过118亿韩
特斯拉官方回应“共享特斯拉”:与公司无关

特斯拉官方回应“共享

特斯拉中国内部人士对此回应表示,目前在国内不存在此类
三星会长李健熙去世:财富达173亿美元 为韩国最大富豪

三星会长李健熙去世:财

三星会长李健熙财富居首,达173亿美元;其儿子,即三星副会
最新文章
在pycharm中为项目导入anacodna环境的操作方法

在pycharm中为项目导

这篇文章主要介绍了在pycharm中为项目导入anacodna环
tensorflow的ckpt及pb模型持久化方式及转化详解

tensorflow的ckpt及pb

今天小编就为大家分享一篇tensorflow的ckpt及pb模型持
PyTorch笔记之scatter()函数的使用

PyTorch笔记之scatter

这篇文章主要介绍了PyTorch笔记之scatter()函数的使用
python3实现网页版raspberry pi(树莓派)小车控制

python3实现网页版ras

这篇文章主要为大家详细介绍了python3实现网页版raspb
完美解决pycharm导入自己写的py文件爆红问题

完美解决pycharm导入

今天小编就为大家分享一篇完美解决pycharm导入自己写
pycharm内无法import已安装的模块问题解决

pycharm内无法import

今天小编就为大家分享一篇pycharm内无法import已安装