0

0

如何在Python Pandas中按时间间隔分组数据?

PHPz

PHPz

发布时间:2023-08-29 14:13:02

|

1308人浏览过

|

来源于tutorialspoint

转载

如何在python pandas中按时间间隔分组数据?

数据分析日益成为每个行业的重要方面。许多组织高度依赖信息、制定战略决策、预测趋势并了解消费者行为。在这样的环境下,Python 的 Pandas 库作为一个强大的设备应运而生,提供了不同范围的功能来成功地控制、分解和想象信息。这些强大的功能之一包括按时间间隔对数据进行分组。

本文将重点介绍如何使用Pandas按时间间隔对数据进行分组。我们将探讨语法、易于理解的算法、两种不同的方法以及基于这些方法的两个完全可执行的实际代码。

语法

我们将重点关注的方法是Pandas的groupby()函数,特别是它的重采样方法。语法如下:

df.groupby(pd.Grouper(key='date', freq='T')).sum()

在语法中:

立即学习Python免费学习笔记(深入)”;

  • df − 您的DataFrame。

  • groupby(pd.Grouper()) − 用于分组数据的函数。

  • key − 您想要按照的列进行分组。在这里,它是 'date' 列。

  • freq − 时间间隔的频率。('T'代表分钟,'H'代表小时,'D'代表天,等等。)

  • sum() - 聚合函数。

算法

这是按时间间隔对数据进行分组的分步算法 -

  • 导入必要的库,即 Pandas。

  • 加载或创建您的DataFrame。

  • <li><p>将日期列转换为datetime对象,如果尚未转换。</p></li>
  • 使用pd.Grouper在日期列上应用groupby()函数,使用所需的频率。

  • 应用 sum()、mean() 等聚合函数

    AI小聚
    AI小聚

    一站式多功能AIGC创作平台,支持AI绘画、AI视频、AI聊天、AI音乐

    下载
  • 打印或存储结果。

方法

我们将考虑两种不同的方法 −

方法一:按日频率分组

在这个例子中,我们创建了一个包含一系列日期和值的DataFrame。然后,我们按照每天的频率对数据进行分组,并对每天的值进行求和。

示例

# Import pandas
import pandas as pd

# Create a dataframe
df = pd.DataFrame({
   'date': pd.date_range(start='1/1/2022', periods=100, freq='H'),
   'value': range(100)
})

# Convert 'date' to datetime object, if not already
df['date'] = pd.to_datetime(df['date'])

# Group by daily frequency
daily_df = df.groupby(pd.Grouper(key='date', freq='D')).sum()

print(daily_df)

输出

            value
date             
2022-01-01    276
2022-01-02    852
2022-01-03   1428
2022-01-04   2004
2022-01-05    390

说明

引入 Pandas 库是任何数据操作工作的绝对要求,也是我们在此代码中真正要做的主要事情。利用 pd.DataFrame() 策略是构建 DataFrame 期间的后续阶段。 “日期”和“值”部分组成了此数据帧。 pd.date_range() 函数用于在“日期”列中创建一系列每小时时间戳,而“值”部分仅包含整数范围。 “日期”列是此交互的结果。

尽管我们的“日期”列目前处理日期时间对象的方式不同,但我们逐渐使用 pd.to_datetime() 函数来确保它被更改。此步骤至关重要,因为收集活动的进度取决于该段是否具有日期时间对象的信息类型。

在此之后,为了按每日('D')频率对数据进行分组,我们使用groupby()函数与pd.Grouper()函数相结合。在进行分组后,我们使用sum()函数将属于同一天的所有'value'元素合并为一个总数。

最后,分组的 DataFrame 被写出,显示每天值的总计。

方法 2:按自定义频率分组,例如 15 分钟间隔

示例

# Import pandas
import pandas as pd

# Create a dataframe
df = pd.DataFrame({
   'date': pd.date_range(start='1/1/2022', periods=100, freq='T'),
   'value': range(100)
})

# Convert 'date' to datetime object, if not already
df['date'] = pd.to_datetime(df['date'])

# Group by 15-minute frequency
custom_df = df.groupby(pd.Grouper(key='date', freq='15T')).sum()

print(custom_df)

输出

                     value
date                      
2022-01-01 00:00:00    105
2022-01-01 00:15:00    330
2022-01-01 00:30:00    555
2022-01-01 00:45:00    780
2022-01-01 01:00:00   1005
2022-01-01 01:15:00   1230
2022-01-01 01:30:00    945

说明

下一种技术从与第一种相似的Pandas库的导入开始,然后创建一个DataFrame。这个DataFrame与之前模型中使用的相同;唯一的区别是 'date' 列现在包含以分钟为单位的时间戳。

'date'列应该是一个datetime对象,以使收集活动能够正常工作,而pd.to_datetime()函数确保会发生这种情况。

在本节中,我们使用位于 groupby() 方法内部的 pd.Grouper() 函数,利用 15 分钟(“15T”)的专门频率来执行分组操作。为了聚合每个 15 分钟时间间隔的“值”条目,我们使用 sum() 函数,这与第一种方法中使用的方法相同。

通过显示新分组的DataFrame完成了代码,该DataFrame显示了每个15分钟时间间隔内'value'列的总和。

结论

Pandas的强大功能包括各种数据操作,其中之一是按时间间隔对数据进行分组。通过使用groupby()函数结合pd.Grouper,我们可以根据每日频率或自定义频率有效地对数据进行分段,从而实现高效、灵活的数据分析。

按时间间隔对数据进行分组的功能使分析师和企业能够从数据中提取有意义的见解。无论是计算每天的销售额总和、获取每小时的平均温度,还是计算每 15 分钟的网站点击量,按时间间隔对数据进行分组可以让我们更好地了解数据中随时间变化的趋势、模式和异常值。

请记住,Python 的 Pandas 库是一个强大的数据分析工具。学习如何使用其功能(例如 groupby 方法)可以帮助您成为更高效、更熟练的数据分析师或数据科学家。

python速学教程(入门到精通)
python速学教程(入门到精通)

python怎么学习?python怎么入门?python在哪学?python怎么学才快?不用担心,这里为大家提供了python速学教程(入门到精通),有需要的小伙伴保存下载就能学习啦!

下载

本站声明:本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

热门AI工具

更多
DeepSeek
DeepSeek

幻方量化公司旗下的开源大模型平台

豆包大模型
豆包大模型

字节跳动自主研发的一系列大型语言模型

WorkBuddy
WorkBuddy

腾讯云推出的AI原生桌面智能体工作台

腾讯元宝
腾讯元宝

腾讯混元平台推出的AI助手

文心一言
文心一言

文心一言是百度开发的AI聊天机器人,通过对话可以生成各种形式的内容。

讯飞写作
讯飞写作

基于讯飞星火大模型的AI写作工具,可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

即梦AI
即梦AI

一站式AI创作平台,免费AI图片和视频生成。

ChatGPT
ChatGPT

最最强大的AI聊天机器人程序,ChatGPT不单是聊天机器人,还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

相关专题

更多
C# ASP.NET Core微服务架构与API网关实践
C# ASP.NET Core微服务架构与API网关实践

本专题围绕 C# 在现代后端架构中的微服务实践展开,系统讲解基于 ASP.NET Core 构建可扩展服务体系的核心方法。内容涵盖服务拆分策略、RESTful API 设计、服务间通信、API 网关统一入口管理以及服务治理机制。通过真实项目案例,帮助开发者掌握构建高可用微服务系统的关键技术,提高系统的可扩展性与维护效率。

76

2026.03.11

Go高并发任务调度与Goroutine池化实践
Go高并发任务调度与Goroutine池化实践

本专题围绕 Go 语言在高并发任务处理场景中的实践展开,系统讲解 Goroutine 调度模型、Channel 通信机制以及并发控制策略。内容包括任务队列设计、Goroutine 池化管理、资源限制控制以及并发任务的性能优化方法。通过实际案例演示,帮助开发者构建稳定高效的 Go 并发任务处理系统,提高系统在高负载环境下的处理能力与稳定性。

38

2026.03.10

Kotlin Android模块化架构与组件化开发实践
Kotlin Android模块化架构与组件化开发实践

本专题围绕 Kotlin 在 Android 应用开发中的架构实践展开,重点讲解模块化设计与组件化开发的实现思路。内容包括项目模块拆分策略、公共组件封装、依赖管理优化、路由通信机制以及大型项目的工程化管理方法。通过真实项目案例分析,帮助开发者构建结构清晰、易扩展且维护成本低的 Android 应用架构体系,提升团队协作效率与项目迭代速度。

83

2026.03.09

JavaScript浏览器渲染机制与前端性能优化实践
JavaScript浏览器渲染机制与前端性能优化实践

本专题围绕 JavaScript 在浏览器中的执行与渲染机制展开,系统讲解 DOM 构建、CSSOM 解析、重排与重绘原理,以及关键渲染路径优化方法。内容涵盖事件循环机制、异步任务调度、资源加载优化、代码拆分与懒加载等性能优化策略。通过真实前端项目案例,帮助开发者理解浏览器底层工作原理,并掌握提升网页加载速度与交互体验的实用技巧。

97

2026.03.06

Rust内存安全机制与所有权模型深度实践
Rust内存安全机制与所有权模型深度实践

本专题围绕 Rust 语言核心特性展开,深入讲解所有权机制、借用规则、生命周期管理以及智能指针等关键概念。通过系统级开发案例,分析内存安全保障原理与零成本抽象优势,并结合并发场景讲解 Send 与 Sync 特性实现机制。帮助开发者真正理解 Rust 的设计哲学,掌握在高性能与安全性并重场景中的工程实践能力。

223

2026.03.05

PHP高性能API设计与Laravel服务架构实践
PHP高性能API设计与Laravel服务架构实践

本专题围绕 PHP 在现代 Web 后端开发中的高性能实践展开,重点讲解基于 Laravel 框架构建可扩展 API 服务的核心方法。内容涵盖路由与中间件机制、服务容器与依赖注入、接口版本管理、缓存策略设计以及队列异步处理方案。同时结合高并发场景,深入分析性能瓶颈定位与优化思路,帮助开发者构建稳定、高效、易维护的 PHP 后端服务体系。

458

2026.03.04

AI安装教程大全
AI安装教程大全

2026最全AI工具安装教程专题:包含各版本AI绘图、AI视频、智能办公软件的本地化部署手册。全篇零基础友好,附带最新模型下载地址、一键安装脚本及常见报错修复方案。每日更新,收藏这一篇就够了,让AI安装不再报错!

169

2026.03.04

Swift iOS架构设计与MVVM模式实战
Swift iOS架构设计与MVVM模式实战

本专题聚焦 Swift 在 iOS 应用架构设计中的实践,系统讲解 MVVM 模式的核心思想、数据绑定机制、模块拆分策略以及组件化开发方法。内容涵盖网络层封装、状态管理、依赖注入与性能优化技巧。通过完整项目案例,帮助开发者构建结构清晰、可维护性强的 iOS 应用架构体系。

246

2026.03.03

C++高性能网络编程与Reactor模型实践
C++高性能网络编程与Reactor模型实践

本专题围绕 C++ 在高性能网络服务开发中的应用展开,深入讲解 Socket 编程、多路复用机制、Reactor 模型设计原理以及线程池协作策略。内容涵盖 epoll 实现机制、内存管理优化、连接管理策略与高并发场景下的性能调优方法。通过构建高并发网络服务器实战案例,帮助开发者掌握 C++ 在底层系统与网络通信领域的核心技术。

34

2026.03.03

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号