导航：首页 > 开发技术 >

Pandas如何实现数据的存储

发表于：2024-11-18 作者：千家信息网编辑

千家信息网最后更新 2024年11月18日，这篇文章给大家分享的是有关Pandas如何实现数据的存储的内容。小编觉得挺实用的，因此分享给大家做个参考，一起跟随小编过来看看吧。数据的存储数据可以有两种类型-连续的和离散的，这取决于我们的分析要求。

千家信息网最后更新 2024年11月18日Pandas如何实现数据的存储

这篇文章给大家分享的是有关Pandas如何实现数据的存储的内容。小编觉得挺实用的，因此分享给大家做个参考，一起跟随小编过来看看吧。

数据的存储

数据可以有两种类型-连续的和离散的，这取决于我们的分析要求。有时我们不需要连续变量中的精确值，但需要它所属的群体。

例如，你的数据中有一个连续变量，年龄。但你需要一个年龄组来进行分析，比如儿童、青少年、成人、老年人。实际上，Binning非常适合解决我们这里的问题。

为了执行Binning，我们使用cut()函数。这对于从连续变量到离散变量非常有用。

import pandas as pddf = pd.read_csv('titanic.csv')from sklearn.utils import shuffle# 随机化df = shuffle(df, random_state = 42)df.head()bins = [0,4,17,65,99]labels =['Toddler','Child','Adult','Elderly']category = pd.cut(df['Age'], bins = bins, labels = labels)df.insert(2, 'Age Group', category)df.head()df['Age Group'].value_counts()df.isnull().sum()

感谢各位的阅读！关于"Pandas如何实现数据的存储"这篇文章就分享到这里了，希望以上内容可以对大家有一定的帮助，让大家可以学到更多知识，如果觉得文章不错，可以把它分享出去让更多的人看到吧！

很赞哦！