1、CHARLS数据下载
登录官网,注册账号,打开CHARLS数据库的
官方网站:https://charls.pku.edu.cn/,点击右上角数据用户注册的按钮。

填写注册用户信息,尽可能都填写真实的信息,填写完成后,点击注册;

注册后会立即有一封确认邮件发至注册的邮箱中,点击确认邮箱并激活账号,点击申请数据,等待审核即可。

2、R语言数据提取以及合并(以2011第一波数据为例)
-
载入所需要的包
-
自定义函数合并数据
-
将下载下来的数据按需合并好数据
-
根据数据使用手册将自己需要的字段整理到label表中
-
将合并好的数据和整理好的字段表进行匹配,将所需的数据提取出来

代码文本:
library(haven)
library(tidyverse)
##数据合并自定义函数
multmerge <- function(mypath){
filenames=list.files(path=mypath, pattern = ".dta",full.names=TRUE)
datalist = lapply(filenames, function(x){read_dta(file=x)})
Reduce(function(x,y) {full_join(x,y)}, datalist)
}
path <- "2011data" #2011第一波数据存放路径
mergedata <- multmerge(path) #合并2011年人口、健康状况以及血检数据
var <- readxl::read_excel("label.xlsx") #将自己需要的变量整理到表格中
data <- mergedata[,colnames(mergedata) %in% var$字段] #将合并好的数据和字段表进行匹配,将自己需要的数据提取出来
colnames(data)





评论列表