0

0

PythonPandas数据分析进阶教程_时间序列与透视表实践

舞姬之光

舞姬之光

发布时间:2025-12-30 21:29:02

|

758人浏览过

|

来源于php中文网

原创

时间序列需用to_datetime转换并设索引后resample聚合,透视表用pivot_table实现多维交叉统计,二者结合滚动窗口与Grouper可分析动态趋势;须注意数据类型、空值及频率对齐。

pythonpandas数据分析进阶教程_时间序列与透视表实践

时间序列和透视表是Pandas中处理结构化时序数据与多维汇总分析的核心工具。掌握它们,才能真正从原始数据中提炼出业务洞察。

时间序列:用to_datetime和resample做精准切片

真实数据的时间列常以字符串形式存在,直接计算会出错。必须先用pd.to_datetime()统一转换,并设为索引:

  • df['date'] = pd.to_datetime(df['date']) # 转换列
  • df = df.set_index('date') # 设为行索引
  • df_daily = df.resample('D').sum() # 按天聚合(求和)
  • df_monthly = df.resample('M').mean() # 按月末频率取均值

注意:resample的频率代码如'D'(日)、'W'(周)、'M'(月末)、'MS'(月初),不是字符串拼写错误;若想按自然月对齐,优先选'MS'再shift(1)更可控。

透视表:pivot_table比groupby更直观地看多维关系

当需要同时按多个维度交叉统计(比如“每个城市每月销售额”),pivot_table比嵌套groupby更简洁、可读性更强:

立即学习Python免费学习笔记(深入)”;

  • pd.pivot_table(df, values='sales', index='city', columns='month', aggfunc='sum')
  • 支持多index/columns:index=['region', 'city'],columns=['year', 'quarter']
  • 缺失值默认填NaN,可用fill_value=0补零
  • 想看占比?加 margins=True 自动加行/列总计,再除一下就得到百分比

小技巧:如果原始数据有重复组合(如同一城市同月多条记录),pivot_table默认用mean聚合,记得显式指定aggfunc避免误算。

Google Antigravity
Google Antigravity

谷歌推出的AI原生IDE,AI智能体协作开发

下载

时间+透视组合:滚动窗口+动态分组才是实战关键

单纯静态透视不够——业务常问“最近3个月各渠道转化率趋势?”这时要联动使用:

  • 先用rolling(3).mean()在时间索引上计算移动平均
  • 再用pivot_table按渠道和月份展开,观察变化轨迹
  • 或用Grouper(key='date', freq='M')替代简单列分组,确保按真实日历月切分
  • 结合query筛选特定时段(如df.query("date >= '2023-01-01'"))再透视,避免全量计算拖慢速度

记住:时间列必须是datetime类型且设为索引,否则resample/Grouper无法识别频率;透视前先检查dtypes和null值,能省掉80%的报错调试时间。

常见陷阱与绕过方法

实际跑代码时容易卡在几个地方:

  • 时间列含非法值(如'NULL'、空格、20230013)→ 用errors='coerce'转成NaT,再dropna()
  • pivot_table报“DataError: No numeric types to aggregate”→ 检查values列是否被识别为object,用astype(float)强转
  • resample后结果为空→ 确认索引是DatetimeIndex(type(df.index)),不是普通Index
  • 透视表列名带空格或中文导致后续操作报错→ 设置dropna=False + rename(columns=str.strip)预处理

不复杂但容易忽略:每次生成新时间索引或透视结果后,用head()和info()快速确认结构是否符合预期,比盲目往下写更高效。

相关专题

更多
Python 时间序列分析与预测
Python 时间序列分析与预测

本专题专注讲解 Python 在时间序列数据处理与预测建模中的实战技巧,涵盖时间索引处理、周期性与趋势分解、平稳性检测、ARIMA/SARIMA 模型构建、预测误差评估,以及基于实际业务场景的时间序列项目实操,帮助学习者掌握从数据预处理到模型预测的完整时序分析能力。

49

2025.12.04

数据类型有哪几种
数据类型有哪几种

数据类型有整型、浮点型、字符型、字符串型、布尔型、数组、结构体和枚举等。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

296

2023.10.31

php数据类型
php数据类型

本专题整合了php数据类型相关内容,阅读专题下面的文章了解更多详细内容。

216

2025.10.31

css中float用法
css中float用法

css中float属性允许元素脱离文档流并沿其父元素边缘排列,用于创建并排列、对齐文本图像、浮动菜单边栏和重叠元素。想了解更多float的相关内容,可以阅读本专题下面的文章。

552

2024.04.28

C++中int、float和double的区别
C++中int、float和double的区别

本专题整合了c++中int和double的区别,阅读专题下面的文章了解更多详细内容。

94

2025.10.23

c语言中null和NULL的区别
c语言中null和NULL的区别

c语言中null和NULL的区别是:null是C语言中的一个宏定义,通常用来表示一个空指针,可以用于初始化指针变量,或者在条件语句中判断指针是否为空;NULL是C语言中的一个预定义常量,通常用来表示一个空值,用于表示一个空的指针、空的指针数组或者空的结构体指针。

229

2023.09.22

java中null的用法
java中null的用法

在Java中,null表示一个引用类型的变量不指向任何对象。可以将null赋值给任何引用类型的变量,包括类、接口、数组、字符串等。想了解更多null的相关内容,可以阅读本专题下面的文章。

433

2024.03.01

js 字符串转数组
js 字符串转数组

js字符串转数组的方法:1、使用“split()”方法;2、使用“Array.from()”方法;3、使用for循环遍历;4、使用“Array.split()”方法。本专题为大家提供js字符串转数组的相关的文章、下载、课程内容,供大家免费下载体验。

248

2023.08.03

桌面文件位置介绍
桌面文件位置介绍

本专题整合了桌面文件相关教程,阅读专题下面的文章了解更多内容。

0

2025.12.30

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
最新Python教程 从入门到精通
最新Python教程 从入门到精通

共4课时 | 0.6万人学习

Django 教程
Django 教程

共28课时 | 2.6万人学习

SciPy 教程
SciPy 教程

共10课时 | 0.9万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2025 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号