1. 项目背景与核心价值
这个地级市共同富裕指数数据集覆盖了2008-2023年长达15年的时间跨度,是目前国内少有的系统化、结构化区域发展评估工具。作为长期跟踪区域经济均衡发展的研究者,我发现这类高质量的面板数据在实际研究中往往面临三个痛点:一是原始数据分散在各类统计年鉴中,收集整理耗时耗力;二是现有指数构建方法差异较大,缺乏统一标准;三是数据处理代码不公开,研究结果难以复现。
这个项目恰好解决了这三个核心问题。它不仅提供了清洗好的结构化数据,还开放了完整的Stata处理代码和参考文献,相当于把一篇规范学术论文的数据附录、方法章节和文献综述都打包好了。对于区域经济学、公共政策等领域的研究者来说,这种"开箱即用"的数据产品能节省至少80%的前期数据准备时间。
需要模型API调用? 免费领10W Token,多模型网关一键接入 Claude、DeepSeek 等主流模型。
2. 数据构建方法论解析
2.1 指标体系设计框架
该指数采用了"三级指标体系"构建方法:
- 一级维度:包含经济发展、社会公平、生态环境3个核心支柱
- 二级指标:下设9个分类指标(如人均GDP、基尼系数、空气质量等)
- 三级变量:最终由27个具体统计指标合成
特别注意:所有原始数据均来自《中国城市统计年鉴》《各省统计年鉴》等权威来源,缺失值采用移动平均法和空间插值法补全,这在代码中有详细注释。
2.2 数据处理关键技术点
数据集的核心价值在于其规范化的处理流程:
- 标准化处理:对逆向指标(如失业率)采用倒数标准化,确保方向一致性
- 权重确定:使用熵值法自动计算指标权重,避免主观偏差
- 合成方法:采用线性加权综合法,公式为:
code复制I = Σ(w_i * x_i'), 其中w_i为权重,x_i'为标准化值
在Stata代码中,这些步骤通过egen、xtset等命令实现,特别适合面板数据分析。我实测发现,代码中关于滞后变量处理和稳健性检验的部分写得非常专业,可以直接套用到其他类似研究中。
3. 典型应用场景实操
3.1 区域差异的时空分析
使用该数据可以快速生成像这样的分析:
stata复制xtreg co_index i.year, fe
margins year, atmeans
这段代码能提取共同富裕指数的时间趋势,我的复
