Stata:断点回归分析设计

2022-08-08 20:49:57

  Thistlethwaite、Campbell于1960岁首度提出利用断点回归计划研讨措置效应, 正在该文中他们的目标是研讨奖学金对付改日学业的影响, 学生是否得回奖学金取决于考查的分数。因为奖学金由进修收获肯定,故收获恰好抵达获奖轨范与差一点抵达的学生具有可比性。即使考查分数大于获奖轨范分数, 则进入措置组;即使考查分数小于获奖轨范分数, 则进入左右组。以是措置变量正在获奖轨范分数处变成了一个断点, 该研讨计划的厉重思思是可能诈骗贴近这一断点相近的样原本有用猜度措置效应。

  Angrist and Lavy(1999)正在研讨班级范畴对收获的影响时,诈骗以色列培育体例的一项轨制举行断点回归;该轨制限制班级范畴的上限为40名学生,一朝跨越40名学生(比方41名学生),则该班级被一分为二。

  从此30年, 该措施并未惹起学术界的着重,直到1990年今后, 断点回归计划劈头被操纵于各式范畴,而且近年来成为因果阐明和计谋评估范畴最紧张的研讨措施。

  断点回归计划是一种准自然尝试, 其基础思思是存正在一个联贯变量, 该变量能肯定个别正在某一临界点两侧经受计谋干涉的概率, 因为X正在该临界点两侧是联贯的,以是个别针对X的取值落入该临界点大肆一侧是随机爆发的, 即不存正在人工操控使得个别落入某一侧的概率更大, 则正在临界值相近组成了一个准自然尝试。寻常将该联贯变量X称为分组变量 (assignment variable)

  断点回归的基础号令是rd,别的,再有少少其他号令,比如rdrobust、rdlocrand、rddensity等等。本文厉重先容rdrobust。

  设定众项式拟应时的核函数,kernelfn可能有三种遴选:三角核函数 triangular、Epanechnikov核函数、矩形核函数 uniform,默以为三角核。

  h(hvalueL hvalueR)指定厉重带宽h,辨别用正在断点的左边和右边。即使只指定一个值,则对该值利用支配双方。即使没有指定,则由相应的号令rdbwselect预备带宽h。

  b(bvalueL bvalueR)指定正在断点左侧和右侧辨别利用的偏向调动带宽b。即使只指定一个值,则对该值利用两边。即使没有指定,则由相应的号令rdbwselect预备带宽b。

  rho(rhovalue)指定的值,使得偏置带宽b等于b=h/rho。即使指定了h而没有指定b,那么默认值是(1)。

  all呈现顺序rdrobust讲演三个分歧的顺序:i)用古代方差猜度举行旧例RD猜度;ii)利用古代方差猜度器举行偏向校正的RD猜度;和iii)带有稳重方差猜度的偏向校正RD猜度。

  h(hvalueL hvalueR)指定厉重带宽h,辨别用正在断点的左边和右边。即使只指定一个值,则该值正在双方都利用。即使指定了两个带宽,则第一个带宽用于断点左侧的带宽,第二个带宽用于断点右侧的数据。即使没有指定,则遴选它来跨数据的一齐赞成。

  nbins(##)设定划分的区间数,供应两个数值,则辨别为支配的区间数;供应一个数值,则断点支配利用协同的区间数。

  ci( bilevel)可能凭据设定的ci-level画出每个区间拟合点的置信区间,选加 shade置信区间用暗影呈现。

  p(pvalue)指定用来构制点猜度器的局限众项式的式子。默认值是p(1)(局限线性回归)。

  q(qvalue)指定用于构制偏向校正的局限众项式的阶数。默认值是q(2)(局限二次回归)。

  deriv(dvalue)指定要猜度的回归函数导数的按次。默认值是deriv(0)(即使指定了fuzzy,则为sharp RD或fuzzy RD)。默以为0,即断点回归,取1则为弯折回归计划

  fuzzy(fuzzyvar [sharpbw])指定用于杀青吞吐RD猜度的措置形态变量(即使指定了deriv(1),则为吞吐断点。默认值是sharp RD 计划。即使设立了sharpbw选项,则利用sharp RD模子的带宽遴选历程来奉行吞吐RD猜度。

  kernel(kernelfn)指定用来构制局限众项式猜度的内核函数。kernelfn可能是三角形、epanechnikov或匀称的。默认值是内核(三角形)。

  mserd指定一个常睹的均方差错(MSE)——用于RD措置结果猜度的最优带宽遴选器。这是默认设立。

  cersum为回归猜度值的和指定了一个通用的ceri -optimal带宽遴选器(与之相对)。