0

0

如何正确还原 NumPy 数组的各种数学变换结果

心靈之曲

心靈之曲

发布时间:2026-03-19 13:58:03

|

518人浏览过

|

来源于php中文网

原创

如何正确还原 NumPy 数组的各种数学变换结果

本文系统讲解 log、sqrt、reciprocal、power、box-cox 等常用 numpy 变换的逆向还原方法,提供可直接复用的代码示例与关键注意事项,帮助你在数据预处理与模型预测后精准恢复原始尺度。

本文系统讲解 log、sqrt、reciprocal、power、box-cox 等常用 numpy 变换的逆向还原方法,提供可直接复用的代码示例与关键注意事项,帮助你在数据预处理与模型预测后精准恢复原始尺度。

在机器学习与统计建模中,对目标变量(如 y)施加非线性变换(如对数、开方、幂函数等)是提升模型拟合效果、稳定方差或满足正态性假设的常见手段。但模型训练/预测完成后,若需将输出结果解释为原始量纲(例如预测销售额、温度、浓度等),就必须严格、无损地执行逆变换(inverse transformation)。以下按变换类型逐一说明其数学原理与 NumPy 实现。

一、基础可逆变换:显式解析逆函数

这些变换具有明确、一一对应的解析逆函数,还原过程简洁可靠:

变换(正向) NumPy 写法 逆变换 还原代码示例
自然对数 np.log(y) 指数函数 y_orig = np.exp(y_t)
平方根 np.sqrt(y) 平方 y_orig = np.square(y_t1) 或 y_t1 ** 2
倒数 np.reciprocal(y) 倒数(自反) y_orig = np.reciprocal(y_t2)
幂函数(指数 α) np.power(y, α) 幂函数(指数 1/α) y_orig = np.power(y_t3, 1/α)

✅ 示例代码(含验证):

import numpy as np

y = np.array([1.0, 4.0, 9.0, 16.0])
alpha = 0.1

# 正向变换
y_log = np.log(y)
y_sqrt = np.sqrt(y)
y_recip = np.reciprocal(y)
y_power = np.power(y, alpha)

# 逆向还原(逐个验证)
y_log_orig = np.exp(y_log)      # ≈ [1., 4., 9., 16.]
y_sqrt_orig = y_sqrt ** 2       # ≈ [1., 4., 9., 16.]
y_recip_orig = np.reciprocal(y_recip)  # ≈ [1., 4., 9., 16.]
y_power_orig = np.power(y_power, 1/alpha)  # ≈ [1., 4., 9., 16.]

print(np.allclose(y, y_log_orig), 
      np.allclose(y, y_sqrt_orig),
      np.allclose(y, y_recip_orig),
      np.allclose(y, y_power_orig))  # 输出: True True True True

⚠️ 注意:np.power(y, α) 要求 y ≥ 0(当 α 非整数时),且 α ≠ 0;逆变换 1/α 同样需避免除零。

二、Box-Cox 变换:需保存 λ 参数

Box-Cox 是一族参数化变换,定义为: [ y^{(\lambda)} = \begin{cases} \frac{y^\lambda - 1}{\lambda}, & \lambda \neq 0 \ \log(y), & \lambda = 0 \end{cases} ] 其逆变换依赖于估计出的最优 λ 值(通常通过 scipy.stats.boxcox 或 sklearn.preprocessing.PowerTransformer 获取):

✅ 使用 scipy 的完整流程:

靠岸学术
靠岸学术

一款集翻译,阅读,文献管理于一体的英文文献阅读器

下载
from scipy import stats
import numpy as np

y = np.array([1.5, 2.0, 3.2, 5.1, 8.0])

# 正向变换 + 获取 λ
y_bc, fitted_lambda = stats.boxcox(y)
print(f"Estimated λ = {fitted_lambda:.4f}")

# 逆变换(必须传入同一 λ!)
y_bc_orig = stats.inv_boxcox(y_bc, fitted_lambda)
print(np.allclose(y, y_bc_orig))  # True

✅ 使用 sklearn(推荐用于 pipeline):

from sklearn.preprocessing import PowerTransformer
import numpy as np

pt = PowerTransformer(method='box-cox', standardize=True)
y = np.array([[1.5], [2.0], [3.2], [5.1], [8.0]])  # 2D required

y_pt = pt.fit_transform(y)        # 正向
y_pt_orig = pt.inverse_transform(y_pt)  # 逆向(自动使用内置 λ)

print(np.allclose(y, y_pt_orig))  # True

⚠️ 关键提醒:Box-Cox 要求输入 y > 0;若含零或负值,应改用 Yeo-Johnson(PowerTransformer(method='yeo-johnson')),其支持全实数域,且 inverse_transform 同样可用。

三、重要实践建议:避免“逆变换陷阱”

  • 优先缓存原始数据:在生产系统中,强烈建议在预处理前保存原始 y 的副本(如 y_original = y.copy()),而非依赖数值逆变换——尤其当涉及浮点精度损失、边界截断(如 log(0))、或自定义非解析变换时。
  • 统一管理变换器对象:使用 sklearn 的 Transformer 类(如 PowerTransformer, FunctionTransformer)封装正/逆逻辑,确保 pipeline 中可复现、可序列化(joblib.dump)。
  • 避免链式变换后盲目逆序:如先 log 再 sqrt,逆序必须严格为 exp → square,顺序错误将导致错误结果。
  • ? 验证还原精度:始终用 np.allclose(y, y_recovered, atol=1e-8) 检查数值一致性,警惕 inf/nan 传播。

掌握这些逆变换方法,你不仅能准确还原预测结果,更能构建鲁棒、可解释、符合工程规范的数据流水线。

相关标签:

本站声明:本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

热门AI工具

更多
DeepSeek
DeepSeek

幻方量化公司旗下的开源大模型平台

豆包大模型
豆包大模型

字节跳动自主研发的一系列大型语言模型

WorkBuddy
WorkBuddy

腾讯云推出的AI原生桌面智能体工作台

腾讯元宝
腾讯元宝

腾讯混元平台推出的AI助手

文心一言
文心一言

文心一言是百度开发的AI聊天机器人,通过对话可以生成各种形式的内容。

讯飞写作
讯飞写作

基于讯飞星火大模型的AI写作工具,可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

即梦AI
即梦AI

一站式AI创作平台,免费AI图片和视频生成。

ChatGPT
ChatGPT

最最强大的AI聊天机器人程序,ChatGPT不单是聊天机器人,还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

相关专题

更多
python开发工具
python开发工具

php中文网为大家提供各种python开发工具,好的开发工具,可帮助开发者攻克编程学习中的基础障碍,理解每一行源代码在程序执行时在计算机中的过程。php中文网还为大家带来python相关课程以及相关文章等内容,供大家免费下载使用。

781

2023.06.15

python打包成可执行文件
python打包成可执行文件

本专题为大家带来python打包成可执行文件相关的文章,大家可以免费的下载体验。

697

2023.07.20

python能做什么
python能做什么

python能做的有:可用于开发基于控制台的应用程序、多媒体部分开发、用于开发基于Web的应用程序、使用python处理数据、系统编程等等。本专题为大家提供python相关的各种文章、以及下载和课程。

784

2023.07.25

format在python中的用法
format在python中的用法

Python中的format是一种字符串格式化方法,用于将变量或值插入到字符串中的占位符位置。通过format方法,我们可以动态地构建字符串,使其包含不同值。php中文网给大家带来了相关的教程以及文章,欢迎大家前来阅读学习。

890

2023.07.31

python教程
python教程

Python已成为一门网红语言,即使是在非编程开发者当中,也掀起了一股学习的热潮。本专题为大家带来python教程的相关文章,大家可以免费体验学习。

1564

2023.08.03

python环境变量的配置
python环境变量的配置

Python是一种流行的编程语言,被广泛用于软件开发、数据分析和科学计算等领域。在安装Python之后,我们需要配置环境变量,以便在任何位置都能够访问Python的可执行文件。php中文网给大家带来了相关的教程以及文章,欢迎大家前来学习阅读。

598

2023.08.04

python eval
python eval

eval函数是Python中一个非常强大的函数,它可以将字符串作为Python代码进行执行,实现动态编程的效果。然而,由于其潜在的安全风险和性能问题,需要谨慎使用。php中文网给大家带来了相关的教程以及文章,欢迎大家前来学习阅读。

591

2023.08.04

scratch和python区别
scratch和python区别

scratch和python的区别:1、scratch是一种专为初学者设计的图形化编程语言,python是一种文本编程语言;2、scratch使用的是基于积木的编程语法,python采用更加传统的文本编程语法等等。本专题为大家提供scratch和python相关的文章、下载、课程内容,供大家免费下载体验。

759

2023.08.11

Go Web框架Gin接口开发与中间件设计实践
Go Web框架Gin接口开发与中间件设计实践

本专题围绕 Go 在 Web 后端开发中的主流框架 Gin 展开,系统讲解高性能接口开发与中间件机制设计。内容涵盖路由分组、请求绑定、参数校验、统一响应封装、日志与鉴权中间件实现,以及接口限流与异常处理策略。通过实战项目案例,帮助开发者构建结构清晰、性能优良的 Go Web 服务体系,提升接口开发效率与系统可维护性。

7

2026.03.19

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号