面板数据熵值法
本文主要是讲解熵值法的处理过程和代码实现。
建立指标体系和指标评价时有可能用到熵值法(熵权法),但以往的经验来看,熵值法常用于时序数据或者是截面数据。实际上,熵值法在面板数据的应用也是十分常见,但很多时候在数据的处理上各种论文的做法有所不同。本文提供一种常用的面板数据熵值法,给大家提供参考。
一、原始数据设定
- 假设数据为
d个年度(year)m个省份(prov)的n个指标。 - 显然数据是
(d, m, n)三维数组,但.csv存储数据一般是二维表,因此实际取得的数据是(d*m, n)的二维数组 - XθijX_{\theta i j}Xθij 表示第 θ\thetaθ 年省份 iii 的第 jjj 个指标值。
二、数据标准化
-
这里采用的是极差标准化,注意这里的最值取的是某一指标下所有年度所有省份的最值。
-
正向指标和负向指标采用的方法有所不同:
Xθij′={ Xθij−min(Xθij)max(Xθij)−min(Xθij)第j个指标为正向指标max(Xθij)−Xθijmax(Xθij)−min(Xθij)第j个指标为负向指标 X'_{\theta i j} = \left\{\begin{matrix} \frac{X_{\theta i j} - \min(X_{\theta i j})} {\max(X_{\theta i j}) - \min(X_{\theta i j})} & 第j个指标为正向指标 \\ \frac{\max(X_{\theta i j}) - X_{\theta i j}} {\max(X_{\theta i j}) - \min(X_{\theta i j})} & 第j个指标为负向指标 \end{matrix}\right. Xθij′={ max(Xθij)−min(Xθij)Xθij−min(Xθij)max(Xθij)−min(Xθij)max(Xθij)−

本文详细介绍了面板数据熵值法的处理步骤,包括数据标准化、几率计算、信息熵计算、权重计算和综合得分计算,并提供了相应的Python代码实现。适用于经济、金融等领域对多维数据的综合评价。

3万+

被折叠的 条评论
为什么被折叠?



