CHARLS数据库的数据结构解读

官方
阅读 107 0 收藏 0 2025-04-25 19:03:00

引言
 
 
 
 

CHARLS(中国健康与养老追踪调查)是一项大型跨学科研究项目,旨在收集代表中国45岁及以上中老年人家庭和个人的高质量微观数据,以推动人口老龄化与健康问题的跨学科研究,为制定和完善我国相关政策提供科学基础。

 

CHARLS数据库包含中国45岁及以上人群的多维度信息,涵盖个人基本信息、家庭结构、健康状况、医疗服务利用、工作、退休、养老金、收入、消费、资产等,堪称中老年健康数据的"满汉全席":

◆ 主菜:45岁+人群的健康体检、疾病史、用药情况
◆ 配菜:家庭关系、经济状况、医疗保障
◆ 调料:心理状态、认知功能、生活方式
◆ 甜点:社区环境、养老安排、甚至代际支持(连"子女给不给零花钱"都记录!)
◆ 点缀:血检数据、生存数据
 
 
CHARLS数据库的数据结构解读
 
 
 1.数据层级结构(像洋葱一样有层次)
数据下载如下:
数据编码参考书如下:
 2.核心模块清单 
 3.时间维度结构 

CHARLS的追踪数据就像连续剧,目前已播出"五季":

▪ wave1: 2011年全国基线调查

▪ wave2: 2012年两省追踪调查、2013年全国追踪调查 

▪ wave3: 2015年全国追踪调查

▪ wave4: 2018年全国追踪调查

▪ wave5: 2020年全国追踪调查

重要提醒:各wave变量名可能变化!建议使用官方《数据编码参考书》跨wave追踪。

 

你的CHARLS通关秘籍
 
 

现在是不是觉得CHARLS的"数据迷宫"突然变清晰了?

记住这个万能公式:选对模块 + 理清层级 + 跨wave匹配 = 高质量论文原材料


评论列表

发表评论