python处理两种分隔符的数据集方法

Eranthe ·
更新时间:2024-11-13
· 853 次阅读

在做机器学习的时候,遇到这样一个数据集...

一共399行10列,

1-9列是用不定长度的空格分割,

第9-10列之间用'\t'分割,

前九列都是数值类型,其中第三列有若干个'?'填充的缺失值...

第十列是字符串类型,..

部分数据截图:

python处理分隔符的数据集

之前我是用python强写的...很麻烦,代码如下:

python处理分隔符的数据集

python处理分隔符的数据集

至此,可以已平均值,填充缺失值...

今天再回顾此数据库;决定用pandas库来试试;

1,导包,用pandas.read_table导入数据集,

python处理分隔符的数据集

2,数据处理

python处理分隔符的数据集

最后输出如下:

python处理分隔符的数据集

以上这篇python处理两种分隔符的数据集方法就是小编分享给大家的全部内容了,希望能给大家一个参考,也希望大家多多支持软件开发网。

您可能感兴趣的文章:python处理两种分隔符的数据集方法对python制作自己的数据集实例讲解python 划分数据集为训练集和测试集的方法Python sklearn KFold 生成交叉验证数据集的方法对python中数据集划分函数StratifiedShuffleSplit的使用详解Python数据集切分实例python 实现对数据集的归一化的方法(0-1之间)Python读取数据集并消除数据中的空行方法python 筛选数据集中列中value长度大于20的数据集方法python:pandas合并csv文件的方法(图书数据集成)python merge、concat合并数据集的实例讲解



方法 数据集 数据 分隔符 Python

需要 登录 后方可回复, 如果你还没有账号请 注册新账号