0

0

如何按年份和地区分组计算均值并为多边形构建生成循环索引

花韻仙語

花韻仙語

发布时间:2026-02-02 12:23:06

|

635人浏览过

|

来源于php中文网

原创

如何按年份和地区分组计算均值并为多边形构建生成循环索引

本文介绍如何在 pandas 中对时间-区域分组数据计算每组 `var` 的平均值,并按特定顺序(lower 升序、upper 降序)为每组分配循环编号,以支持后续多边形坐标连接(如绘制上下包络线)。

在地理可视化或统计图表(如带状图、置信区间填充多边形)中,常需将成对的“下界”和“上界”数据点按空间/时间逻辑首尾相连构成闭合多边形。本教程解决两个核心任务:

  1. 按 year 和 region 分组计算 var 的均值,并广播至每行;
  2. 为每组(同一 region)内所有记录分配 loop 编号,使其排序后形成 lower→lower→upper→upper 的“Z 字形”连接顺序(即:先按年份升序排 lower,再按年份降序排 upper),从而自然构成闭合环路(0→1→2→3→0)。

以下为完整实现步骤:

✅ 步骤 1:构造示例数据

import pandas as pd

mydict = {
    'year': [2010, 2010, 2011, 2011, 2010, 2010, 2011, 2011],
    'region': [1, 1, 1, 1, 2, 2, 2, 2],
    'group': ['lower', 'upper', 'lower', 'upper', 'lower', 'upper', 'lower', 'upper'],
    'var': [10, 20, 30, 40, 50, 60, 70, 80]
}
df = pd.DataFrame(mydict)

✅ 步骤 2:添加 average 列(组内均值)

使用 transform('mean') 确保结果与原始 DataFrame 行数对齐:

df['average'] = df.groupby(['year', 'region'])['var'].transform('mean')

✅ 步骤 3:生成 loop 列(多边形顶点序号)

关键在于自定义排序逻辑

  • 所有 'lower' 行按 year 升序排列(即 var 自然升序,因题设 lower
  • 所有 'upper' 行按 year 降序排列(即 var 降序 → 可通过取负值实现统一升序排序)。

实现方式如下:

稿定AI文案
稿定AI文案

小红书笔记、公众号、周报总结、视频脚本等智能文案生成平台

下载
df['loop'] = (
    df.assign(var=df['var'].mask(df['group'] == 'upper', -df['var']))
      .sort_values(by=['group', 'var'])
      .groupby('region').cumcount()
)

✅ 解析:

  • df.assign(...) 临时将 upper 组的 var 替换为负值,使排序时 upper 行按原 year 降序呈现;
  • sort_values(['group', 'var']) 先按 'lower'/'upper' 分组,再按(修正后)var 排序 → 实现 lower(2010)→lower(2011)→upper(2011)→upper(2010);
  • groupby('region').cumcount() 对每个 region 内排序后的行从 0 开始编号,完美匹配目标 loop 序列。

✅ 最终结果验证

print(df.sort_values(['region', 'year', 'group']).reset_index(drop=True))

输出符合预期:

   year  region  group  var  average  loop
0  2010       1  lower   10     15.0     0
1  2010       1  upper   20     15.0     3
2  2011       1  lower   30     35.0     1
3  2011       1  upper   40     35.0     2
4  2010       2  lower   50     55.0     0
5  2010       2  upper   60     55.0     3
6  2011       2  lower   70     75.0     1
7  2011       2  upper   80     75.0     2

⚠️ 注意事项

  • 该方法依赖题设前提:同一年份-地区内,lower 的 var 值恒小于 upper。若数据不满足,需改用显式 year 列排序(如 sort_values(['region', 'group', 'year'], key=lambda x: x if x.name != 'year' or x.name == 'group' else (-x if x.name=='year' and df['group']=='upper' else x)));
  • loop 列本质是每 region 内的局部序号,若需全局唯一 ID,可叠加 region 编码(如 df['region']*100 + df['loop']);
  • 此序号可直接用于 matplotlib.patches.Polygon 或 geopandas.GeoDataFrame 构建闭合面,例如:按 loop 升序提取 (var, year) 坐标列表,首尾自动闭合。

通过以上方法,你即可高效生成兼具统计意义与几何结构的结构化数据,为动态区间可视化打下坚实基础。

热门AI工具

更多
DeepSeek
DeepSeek

幻方量化公司旗下的开源大模型平台

豆包大模型
豆包大模型

字节跳动自主研发的一系列大型语言模型

通义千问
通义千问

阿里巴巴推出的全能AI助手

腾讯元宝
腾讯元宝

腾讯混元平台推出的AI助手

文心一言
文心一言

文心一言是百度开发的AI聊天机器人,通过对话可以生成各种形式的内容。

讯飞写作
讯飞写作

基于讯飞星火大模型的AI写作工具,可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

即梦AI
即梦AI

一站式AI创作平台,免费AI图片和视频生成。

ChatGPT
ChatGPT

最最强大的AI聊天机器人程序,ChatGPT不单是聊天机器人,还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

相关专题

更多
Python 时间序列分析与预测
Python 时间序列分析与预测

本专题专注讲解 Python 在时间序列数据处理与预测建模中的实战技巧,涵盖时间索引处理、周期性与趋势分解、平稳性检测、ARIMA/SARIMA 模型构建、预测误差评估,以及基于实际业务场景的时间序列项目实操,帮助学习者掌握从数据预处理到模型预测的完整时序分析能力。

71

2025.12.04

Python 数据清洗与预处理实战
Python 数据清洗与预处理实战

本专题系统讲解 Python 在数据清洗与预处理中的核心技术,包括使用 Pandas 进行缺失值处理、异常值检测、数据格式化、特征工程与数据转换,结合 NumPy 高效处理大规模数据。通过实战案例,帮助学习者掌握 如何处理混乱、不完整数据,为后续数据分析与机器学习模型训练打下坚实基础。

1

2026.01.31

if什么意思
if什么意思

if的意思是“如果”的条件。它是一个用于引导条件语句的关键词,用于根据特定条件的真假情况来执行不同的代码块。本专题提供if什么意思的相关文章,供大家免费阅读。

786

2023.08.22

lambda表达式
lambda表达式

Lambda表达式是一种匿名函数的简洁表示方式,它可以在需要函数作为参数的地方使用,并提供了一种更简洁、更灵活的编码方式,其语法为“lambda 参数列表: 表达式”,参数列表是函数的参数,可以包含一个或多个参数,用逗号分隔,表达式是函数的执行体,用于定义函数的具体操作。本专题为大家提供lambda表达式相关的文章、下载、课程内容,供大家免费下载体验。

208

2023.09.15

python lambda函数
python lambda函数

本专题整合了python lambda函数用法详解,阅读专题下面的文章了解更多详细内容。

191

2025.11.08

Python lambda详解
Python lambda详解

本专题整合了Python lambda函数相关教程,阅读下面的文章了解更多详细内容。

56

2026.01.05

AO3官网入口与中文阅读设置 AO3网页版使用与访问
AO3官网入口与中文阅读设置 AO3网页版使用与访问

本专题围绕 Archive of Our Own(AO3)官网入口展开,系统整理 AO3 最新可用官网地址、网页版访问方式、正确打开链接的方法,并详细讲解 AO3 中文界面设置、阅读语言切换及基础使用流程,帮助用户稳定访问 AO3 官网,高效完成中文阅读与作品浏览。

10

2026.02.02

主流快递单号查询入口 实时物流进度一站式追踪专题
主流快递单号查询入口 实时物流进度一站式追踪专题

本专题聚合极兔快递、京东快递、中通快递、圆通快递、韵达快递等主流物流平台的单号查询与运单追踪内容,重点解决单号查询、手机号查物流、官网入口直达、包裹进度实时追踪等高频问题,帮助用户快速获取最新物流状态,提升查件效率与使用体验。

5

2026.02.02

Golang WebAssembly(WASM)开发入门
Golang WebAssembly(WASM)开发入门

本专题系统讲解 Golang 在 WebAssembly(WASM)开发中的实践方法,涵盖 WASM 基础原理、Go 编译到 WASM 的流程、与 JavaScript 的交互方式、性能与体积优化,以及典型应用场景(如前端计算、跨平台模块)。帮助开发者掌握 Go 在新一代 Web 技术栈中的应用能力。

1

2026.02.02

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
Go 教程
Go 教程

共32课时 | 4.5万人学习

Go语言实战之 GraphQL
Go语言实战之 GraphQL

共10课时 | 0.8万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号