0

0

Python Pandas 常见报错解析

舞姬之光

舞姬之光

发布时间:2026-03-05 21:30:40

|

930人浏览过

|

来源于php中文网

原创

python pandas 常见报错解析

KeyError:列名不存在

这是最常遇到的错误,比如写 df['age'] 但实际列名是 'Age''age_group'。Pandas 区分大小写,且空格、下划线、中英文标点都会导致不匹配。

排查建议:

  • df.columns.tolist() 查看真实列名,注意前后空格——可加 .str.strip() 清洗
  • df.columns.str.contains('age', case=False) 模糊搜索相关列
  • 读取 CSV 时加 skipinitialspace=True 避免列名开头空格

SettingWithCopyWarning:链式赋值警告

当你写类似 df[df['score'] > 80]['grade'] = 'A' 时,Pandas 不确定你是在修改原 DataFrame 还是副本,于是发出警告,后续可能赋值失败。

正确做法:

立即学习Python免费学习笔记(深入)”;

  • .loc 显式定位:df.loc[df['score'] > 80, 'grade'] = 'A'
  • 确认操作对象是否为视图(view)或副本(copy),可用 df._is_copy(仅调试用,不推荐依赖)
  • 必要时主动复制:df2 = df.copy(),再对 df2 操作

ValueError:长度不匹配(如 cannot set using a list-like indexer with a different length)

常见于赋值时左右两边长度不一致。例如用布尔索引选了 120 行,却试图赋一个长度为 100 的列表。

Spacely AI
Spacely AI

为您的房间提供AI室内设计解决方案,寻找无限的创意

下载

典型场景和解决方式:

  • 赋值前检查长度:len(df[mask]) == len(values)
  • 用标量赋值(如 df.loc[mask, 'col'] = 0)最安全,Pandas 会自动广播
  • 避免直接对 df[mask]['col'] = ... 赋值——改用 .loc.iloc

TypeError:无法对不可比较类型执行操作

比如对含字符串和 NaN 的列调用 .sum() 或比较 > 5,或日期列被读成 object 类型后做算术运算。

快速修复步骤:

  • 查数据类型:df.dtypes,重点关注报错列
  • 转类型:数值列用 pd.to_numeric(col, errors='coerce');日期列用 pd.to_datetime(col, errors='coerce')
  • 处理缺失值:转换后 NaN 自动产生,再用 .dropna().fillna() 统一处理

MemoryError 或运行极慢

读大文件或执行 groupby/merge 时容易触发,本质是数据量超出内存承载或算法复杂度高。

轻量级优化方案:

  • 读取时限制列:pd.read_csv(file, usecols=['a','b','c'])
  • 指定低精度类型:dtype={'user_id': 'category', 'score': 'int32'}
  • 分块处理:for chunk in pd.read_csv(file, chunksize=10000): process(chunk)
  • 替代 groupby:对超大集合,先 df.sort_values().groupby(..., sort=False) 可提速

热门AI工具

更多
DeepSeek
DeepSeek

幻方量化公司旗下的开源大模型平台

豆包大模型
豆包大模型

字节跳动自主研发的一系列大型语言模型

通义千问
通义千问

阿里巴巴推出的全能AI助手

腾讯元宝
腾讯元宝

腾讯混元平台推出的AI助手

文心一言
文心一言

文心一言是百度开发的AI聊天机器人,通过对话可以生成各种形式的内容。

讯飞写作
讯飞写作

基于讯飞星火大模型的AI写作工具,可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

即梦AI
即梦AI

一站式AI创作平台,免费AI图片和视频生成。

ChatGPT
ChatGPT

最最强大的AI聊天机器人程序,ChatGPT不单是聊天机器人,还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

相关专题

更多
Python 时间序列分析与预测
Python 时间序列分析与预测

本专题专注讲解 Python 在时间序列数据处理与预测建模中的实战技巧,涵盖时间索引处理、周期性与趋势分解、平稳性检测、ARIMA/SARIMA 模型构建、预测误差评估,以及基于实际业务场景的时间序列项目实操,帮助学习者掌握从数据预处理到模型预测的完整时序分析能力。

76

2025.12.04

Python 数据清洗与预处理实战
Python 数据清洗与预处理实战

本专题系统讲解 Python 在数据清洗与预处理中的核心技术,包括使用 Pandas 进行缺失值处理、异常值检测、数据格式化、特征工程与数据转换,结合 NumPy 高效处理大规模数据。通过实战案例,帮助学习者掌握 如何处理混乱、不完整数据,为后续数据分析与机器学习模型训练打下坚实基础。

12

2026.01.31

数据类型有哪几种
数据类型有哪几种

数据类型有整型、浮点型、字符型、字符串型、布尔型、数组、结构体和枚举等。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

333

2023.10.31

php数据类型
php数据类型

本专题整合了php数据类型相关内容,阅读专题下面的文章了解更多详细内容。

223

2025.10.31

c语言 数据类型
c语言 数据类型

本专题整合了c语言数据类型相关内容,阅读专题下面的文章了解更多详细内容。

138

2026.02.12

sort排序函数用法
sort排序函数用法

sort排序函数的用法:1、对列表进行排序,默认情况下,sort函数按升序排序,因此最终输出的结果是按从小到大的顺序排列的;2、对元组进行排序,默认情况下,sort函数按元素的大小进行排序,因此最终输出的结果是按从小到大的顺序排列的;3、对字典进行排序,由于字典是无序的,因此排序后的结果仍然是原来的字典,使用一个lambda表达式作为key参数的值,用于指定排序的依据。

408

2023.09.04

js 字符串转数组
js 字符串转数组

js字符串转数组的方法:1、使用“split()”方法;2、使用“Array.from()”方法;3、使用for循环遍历;4、使用“Array.split()”方法。本专题为大家提供js字符串转数组的相关的文章、下载、课程内容,供大家免费下载体验。

718

2023.08.03

js截取字符串的方法
js截取字符串的方法

js截取字符串的方法有substring()方法、substr()方法、slice()方法、split()方法和slice()方法。本专题为大家提供字符串相关的文章、下载、课程内容,供大家免费下载体验。

219

2023.09.04

Rust内存安全机制与所有权模型深度实践
Rust内存安全机制与所有权模型深度实践

本专题围绕 Rust 语言核心特性展开,深入讲解所有权机制、借用规则、生命周期管理以及智能指针等关键概念。通过系统级开发案例,分析内存安全保障原理与零成本抽象优势,并结合并发场景讲解 Send 与 Sync 特性实现机制。帮助开发者真正理解 Rust 的设计哲学,掌握在高性能与安全性并重场景中的工程实践能力。

4

2026.03.05

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
最新Python教程 从入门到精通
最新Python教程 从入门到精通

共4课时 | 22.5万人学习

Django 教程
Django 教程

共28课时 | 4.8万人学习

SciPy 教程
SciPy 教程

共10课时 | 1.8万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号