数据概念

数据比对

在此,我们使用灵活的比较技术对不同的DataFrame进行比较

import pandas as pd
import random

random.seed(123)
list1 = [['A']*3,['B']*5,['C']*7]
charlist = [x for sublist in list1 for x in sublist]
random.shuffle(charlist)
ser1 = pd.Series(charlist)

random.seed(123)
ser2 = pd.Series(random.sample(range(10, 100), 15))

prodDf1 = pd.concat([ser1,ser2],axis=1)
prodDf1.columns=['Product','Sales']

random.seed(321)
list1 = [['A']*2,['B']*8,['C']*5]
charlist = [x for sublist in list1 for x in sublist]
random.shuffle(charlist)
ser3 = pd.Series(charlist)

random.seed(321)
ser4 = pd.Series(random.sample(range(10, 100), 15))

prodDf2 = pd.concat([ser3,ser4],axis=1)
prodDf2.columns=['Product','Sales']
...

比较两商店销售数据

数据结构

使用数据结构简析GDP

数据输入输出

SQL数据分析(使用季度客户和订单列表)

数据类型

优化内存(使用汽车评估数据集)

数据选择

从列创建多索引(使用蘑菇分类数据集)

确定人口增长(使用人口数据集)

生物环数分析雌雄性样本(鲍鱼牡蛎数据集)