脚本专栏 
首页 > 脚本专栏 > 浏览文章

python处理两种分隔符的数据集方法

(编辑:jimmy 日期: 2025/7/5 浏览:3 次 )

在做机器学习的时候,遇到这样一个数据集...

一共399行10列,

1-9列是用不定长度的空格分割,

第9-10列之间用'\t'分割,

前九列都是数值类型,其中第三列有若干个'"text-align: center">python处理两种分隔符的数据集方法

之前我是用python强写的...很麻烦,代码如下:

python处理两种分隔符的数据集方法

python处理两种分隔符的数据集方法

至此,可以已平均值,填充缺失值...

今天再回顾此数据库;决定用pandas库来试试;

1,导包,用pandas.read_table导入数据集,

python处理两种分隔符的数据集方法

2,数据处理

python处理两种分隔符的数据集方法

最后输出如下:

python处理两种分隔符的数据集方法

以上这篇python处理两种分隔符的数据集方法就是小编分享给大家的全部内容了,希望能给大家一个参考,也希望大家多多支持。

上一篇:在python中pandas读文件,有中文字符的方法
下一篇:Python3爬虫学习之MySQL数据库存储爬取的信息详解
一句话新闻
微软与英特尔等合作伙伴联合定义“AI PC”:键盘需配有Copilot物理按键
几个月来,英特尔、微软、AMD和其它厂商都在共同推动“AI PC”的想法,朝着更多的AI功能迈进。在近日,英特尔在台北举行的开发者活动中,也宣布了关于AI PC加速计划、新的PC开发者计划和独立硬件供应商计划。
在此次发布会上,英特尔还发布了全新的全新的酷睿Ultra Meteor Lake NUC开发套件,以及联合微软等合作伙伴联合定义“AI PC”的定义标准。