python处理两种分隔符的数据集方法

(编辑:jimmy 日期: 2024/11/17 浏览:2)

在做机器学习的时候,遇到这样一个数据集...

一共399行10列,

1-9列是用不定长度的空格分割,

第9-10列之间用'\t'分割,

前九列都是数值类型,其中第三列有若干个'"text-align: center">python处理两种分隔符的数据集方法

之前我是用python强写的...很麻烦,代码如下:

python处理两种分隔符的数据集方法

python处理两种分隔符的数据集方法

至此,可以已平均值,填充缺失值...

今天再回顾此数据库;决定用pandas库来试试;

1,导包,用pandas.read_table导入数据集,

python处理两种分隔符的数据集方法

2,数据处理

python处理两种分隔符的数据集方法

最后输出如下:

python处理两种分隔符的数据集方法

以上这篇python处理两种分隔符的数据集方法就是小编分享给大家的全部内容了,希望能给大家一个参考,也希望大家多多支持。

一句话新闻
Windows上运行安卓你用过了吗
在去年的5月23日,借助Intel Bridge Technology以及Intel Celadon两项技术的驱动,Intel为PC用户带来了Android On Windows(AOW)平台,并携手国内软件公司腾讯共同推出了腾讯应用宝电脑版,将Windows与安卓两大生态进行了融合,PC的使用体验随即被带入到了一个全新的阶段。