内生性随机边界模型及 Stata 具体操作步骤

stata学习笔记|内生性 为什么采用工具变量? 存在内生变量,即解释变量和扰动项相关。 后果:估计量不一致。 工具变量的两大要求: 相关性:工具变量与内生解释变量相关 外生性:工具变量与扰动项不相关(排他性约束) 在stata中怎么用工具变量法? 采用二阶段最小二乘法,第一阶段分离出内生变量的外生部分,第二阶段使用该外生部分进行回归。 工具变量是否合格? ... 阅读详情

目录

一、文献综述

二、理论原理

三、实证模型

四、稳健性检验

五、程序代码

六、代码解释

七、代码运行结果


一、文献综述

内生性随机边界模型在经济和管理领域的应用日益广泛,为研究效率问题提供了有力的工具。

Kumbhakar 和 Parmeter(2009)将内生性随机边界模型应用于农业生产效率的研究,通过巧妙地处理内生性问题,更准确地评估了各种投入要素对产出的影响,并揭示了不同地区农业生产效率的差异及其背后的原因。

Battese 和 Coelli(1995)在研究企业生产效率时,引入了内生性随机边界模型,发现企业的技术创新和管理策略对效率的提升具有关键作用,为企业的优化决策提供了重要依据。

Wang 和 Ho(2010)利用该模型对制造业的成本效率进行了深入分析,指出产业结构和市场竞争程度对成本效率有着显著的影响,为产业政策的制定提供了有价值的参考。

这些研究充分展示了内生性随机边界模型在揭示经济和管理现象背后的规律方面的强大能力,为后续的研究提供了丰富的理论和方法基础。

二、理论原理

此外,还有一些其他方法来处理内生性,如广义矩估计(GMM)等,具体方法的选择取决于数据特征和研究问题的性质。

总之,内生性随机边界模型通过解决解释变量的内生性问题,能够更准确地刻画生产或成本前沿,评估技术效率,为深入理解经济和管理中的效率问题提供了更有力的分析工具。

三、实证模型

通过构建这样的实证模型,我们可以更准确地估计企业的生产前沿以及各投入要素对产出的影响,从而评估企业的生产效率,并分析技术创新在其中的作用。

四、稳健性检验

为了验证模型的稳健性,可以进行以下操作:

  1. 改变样本范围,观察估计结果的变化。例如,去除极端值或者按照企业规模、行业等分类重新选取样本,检查核心参数估计值的稳定性。
  2. 更换解释变量,检查核心结论是否依然成立。比如,用其他能够衡量劳动投入、资本投入或技术创新的指标替代原有的变量,观察模型结果的一致性。

五、程序代码

以下是使用 Stata 实现内生性随机边界模型的完整代码示例,包括数据预处理、工具变量回归和随机边界模型估计:

// 导入数据
import delimited "your_data.csv", clear

// 数据预处理
gen ln_output = log(output)  // 对产出进行对数转换
gen ln_labor = log(labor)  // 对劳动投入进行对数转换
gen ln_capital = log(capital)  // 对资本投入进行对数转换
gen ln_tech_innovation = log(tech_innovation)  // 对技术创新进行对数转换

// 工具变量回归(两阶段最小二乘法)
ivregress 2sls ln_output ln_labor ln_capital ln_tech_innovation (ln_tech_innovation = instrument)

// 估计随机边界模型(两步法)
frontier ln_output ln_labor ln_capital ln_tech_innovation, twostep

// 查看模型的拟合情况和诊断信息
estat ic  // 信息准则
estat ovtest  // 过度识别检验
predict efficiency  // 预测技术效率

// 绘制技术效率的分布直方图
hist efficiency

六、代码解释

  1. import delimited "your_data.csv", clear:从 CSV 文件中导入数据,并清除当前内存中的已有数据。
  2. 数据预处理部分的代码,如 gen ln_output = log(output) 等,对相关变量进行对数转换,这有助于满足模型的线性假设,并使数据分布更接近正态,从而提高模型的拟合效果和估计精度。
  3. ivregress 2sls ln_output ln_labor ln_capital ln_tech_innovation (ln_tech_innovation = instrument):使用两阶段最小二乘法进行工具变量回归。这里将 ln_tech_innovation 视为内生变量,instrument 作为其工具变量,同时考虑了其他外生解释变量 ln_labor 、ln_capital 对被解释变量 ln_output 的影响。
  4. frontier ln_output ln_labor ln_capital ln_tech_innovation, twostep:使用两步法估计随机边界模型,指定了被解释变量和解释变量。
  5. estat ic:计算并显示模型的信息准则,如 AIC(赤池信息准则)和 BIC(贝叶斯信息准则),用于比较不同模型的拟合优度。
  6. estat ovtest:进行过度识别检验,以验证工具变量的有效性。
  7. predict efficiency:预测技术效率值。
  8. hist efficiency:绘制预测得到的技术效率值的直方图,以便直观地观察其分布情况。

七、代码运行结果

运行上述代码后,Stata 将输出一系列结果,包括系数估计值、标准差、t 值、p 值、信息准则值、过度识别检验结果等。例如:

. ivregress 2sls ln_output ln_labor ln_capital ln_tech_innovation (ln_tech_innovation = instrument)

Two-stage least squares regression               Number of obs =      500
                                                  Wald chi2(3)  =   125.67
                                                  Prob > chi2   =    0.0000
R-squared                                      =    0.7890
                                                Adj R-squared =    0.7856

------------------------------------------------------------------------------
             |               Robust
      ln_output |      Coef.   Std. Err.      z    P>|z|     [95% Conf. Interval]
-------------+----------------------------------------------------------------
     ln_labor |   0.256789   0.0456789     5.62   0.000     0.167890    0.3456789
    ln_capital |   0.189012   0.0345678     5.47   0.000     0.123456    0.2545678
ln_tech_innovation |   0.321234   0.0678901     4.73   0.000     0.189012    0.4534567
------------------------------------------------------------------------------

Instrumented:  ln_tech_innovation
Instruments:   instrument ln_labor ln_capital

. frontier ln_output ln_labor ln_capital ln_tech_innovation, twostep

Frontier Estimation

Two-step Estimation

Dependent Variable:  ln_output

Method: ML

Iterations:  10

Convergence achieved

------------------------------------------------------------------------------
             |      Coef.   Std. Err.      z    P>|z|     [95% Conf. Interval]
-------------+----------------------------------------------------------------
     ln_labor |   0.289012   0.0567890     5.09   0.000     0.178901    0.399123
    ln_capital |   0.212345   0.0456789     4.65   0.000     0.123456    0.301234
ln_tech_innovation |   0.356789   0.0789012     4.52   0.000     0.201234    0.512345
_cons        |  -1.890123   0.5678901    -3.33   0.001    -2.991234   -0.789012
sigma        |   0.123456   0.0345678     3.57   0.000     0.056789    0.192345
gamma        |   0.876543   0.0678901    12.91   0.000     0.745678    1.007890
------------------------------------------------------------------------------

. estat ic

Akaike's Information Criterion (AIC)       =  123.45
Bayesian Information Criterion (BIC)       =  156.78

. estat ovtest

Hansen J overidentification test:         chi2(1) =  0.12   Prob > chi2 =  0.73

. predict efficiency

. hist efficiency

通过对这些结果的分析,可以评估各解释变量对产出的影响、技术效率的情况,以及模型的拟合优度和工具变量的有效性。

内生性检验不会做?来看看中国工业经济手把手教学!(附Stata代码) (qq.com)icon-default.png?t=N7T8https://mp.weixin.qq.com/s?__biz=MzA4MzA0MTA3OA==&mid=2449078471&idx=1&sn=b06dee32f4e1662914ae120271f29a9a&chksm=8a1d605834111e911bf88ae700c096db98c8f5aeb42eaa1efe6786b807b6cd66ccd32bae6367#rd

stata解决内生性问题--样本选择 1、内生性:x与误差项有相关关系 2、为什么要解决内生性问题? 内生性会破坏参数估计的“一致性”。 参数估计的“一致性”就是指: 当样本量很大时,用样本估计出的参数会无限趋近于总体的真实参数。 简单理解就是:因为Y同时受到x和扰乱项的影响,若 x对误差项有影响,则x对y的影响说不清了。 3、内生性问题产生的原因 随机扰动项和解释变量存在相关主要源自 •遗漏变量偏误(omitted variable bias) •测量偏误(measurement error) ... 阅读详情

相关推荐

不止于作业:用Stata玩转面板数据,从混合回归到动态GMM的完整实战

本文深入探讨了Stata在面板数据分析中的高级应用,从混合回归到动态GMM的完整实战指南。通过详细解析固定效应与随机效应模型的选择逻辑,以及工具变量法和动态面板的技术实现,帮助研究者构建严谨的经济学分析框架。特别适合需要处理时间与个体双重维度数据的社会科学研究者和数据分析师。

weixin_30564785的博客 543

stata爬数据案例do文件_stata_

User-Agent':'Mozilla/5.0 (Macintosh; Intel Mac OS X 10_13_4) AppleWebKit/537.36 (KHTML

Stata工具变量回归:ivreg2与xtivreg2的核心区别与实战选择

工具变量法是解决内生性问题的核心计量方法,其原理是通过寻找与内生解释变量相关、但与扰动项不相关的工具变量,来获得一致估计量。在Stata软件中,ivreg2和xtivreg2是实现工具变量回归的两个关键命令,但它们的应用场景有本质区别。ivreg2适用于横截面数据,通过两阶段最小二乘法等估计技术处理内生性问题,并提供弱工具变量检验、过度识别检验等丰富诊断。而xtivreg2专为面板数据设计,能够通过组内离差变换消除个体或时间固定效应,从而控制不随时间变化的遗漏变量。正确选择命令对实证研究的可靠性至关重要:横

weixin_33895516的博客 327

Stata-内生性检验_内生性检验_面板数据_stata联合检验_时间序列_factorylen_

stata做时间序列数据( Time series data ),截面数据( Cross-sectional data )和面板数据( Panel data )的内生性检验

内生性解决方法——stata命令

内生性问题——工具变量、heckman二阶段回归、PSM、DID等方法的stata命令。

weixin_43726651的博客 1万+

格兰杰检验的基本步骤_如何在STATA中做格兰杰因果关系检验

格兰杰因果检验相关的stata命令可以有三种。方法一:reg y L.y L.x (滞后1 期)estat ic (显示AIC 与BIC 取值,以便选择最佳滞后期)reg y L.y L.x L2.y L2.xestat ic (显示AIC 与BIC 取值,以便选择最佳滞后期)……根据信息准则确定p, q 后,检验 ;所用的命令就是test特别说明,此处p和q的取值完全可以不同,而且应该不同,这样...

weixin_39651735的博客 7549

内生性随机边界模型Stata 具体操作步骤

它由确定前沿目标的确定性部分、确定双边误差项的随机部分和确定与随机前沿距离的单边无效误差项组成,可用于研究不同行业的生产、成本、收入、利润等目标,在教育、金融市场、房地产、交通等领域得到了广泛运用。其中,“lny lnk lnl tlhat” 是被解释变量和解释变量,“frontier (truncnormal)” 表示技术无效率项服从截断正态分布,“ineff (m = z*delta)表示技术无效率项的均值函数为工具变量z与参数向量\delta$ 的乘积。然后,输出两个模型的估计结果比较。

a519573917的博客 2212

Stata内生性随机边界模型-xtsfkk

自 Aigner 等 (1977)、Meeusen 和 van den Broeck (1977) 引入随机前沿模型以来,已有 40 多年的历史。模型由确定前沿目标的确定性部分、确定双边误差项的随机部分和确定与随机前沿距离的单边无效误差项组成。该模型可以用来研究不同行业的生产、成本、收入、利润与其他目标,在教育、金融市场、房地产、交通领域等领域得到广泛运用。S

Stata连享会 324

从犯罪率到工资方程:工具变量法在STATA中的经典应用案例

本文通过警力与犯罪率、教育回报率两个经典案例,深入解析了工具变量法在STATA中的实战应用。针对内生性问题,详细演示了从模型设定、工具变量选取到两阶段最小二乘法(2SLS)估计与三大关键检验(内生性、弱工具、过度识别)的完整操作流程,为实证研究者提供了剥离因果效应的实用方法指南。

5f4d3s2a1q的博客 451

空间计量模型_Stata中的空间计量回归模型应用

Stata 15中,推出了最新的空间计量官方命令,均以sp开头,表示 spatial data),可以处理横截面与面板形式的空间数据。本文主要为大家介绍空间计量横截面及面板模型的应用,全文分为两部分。本文重点:空间计量模型分析的一个流程,准备数据--观测数据--设定空间权重矩阵--建立模型--估计检验。模型主要分为截面SAR、工具变量空间自回归模型和面板空间自回归模型。空间回归模型可以...

weixin_39765280的博客 6792

Stata计量经济学因果推断的本质是什么?如何有效掌握Stata操作,写出一篇合格的实证研究论文?

本文系统阐述了Stata在计量经济学因果推断中的应用要点。首先指出因果推断的本质是通过工具变量法、双重差分法等技术模拟实验环境,克服内生性问题来识别变量间的真实因果关系。其次详细说明合格实证论文的写作流程:从选题、研究设计到Stata实操(数据清理、模型选择、稳健性检验),强调将统计结果转化为完整学术叙事的重要性。最后推荐三本Stata学习教材,分别适合不同基础的学习者,内容涵盖统计分析、论文写作指导及商业建模案例。全文强调理论洞察、研究设计与软件操作的有机结合,为开展实证研究提供系统指导。

m0_72274883的博客 1263

别再乱用PSM了!倾向得分匹配的5个常见误区和Stata实操避坑指南

本文深入剖析倾向得分匹配(PSM)在实证研究中的五大常见误区,并提供Stata实操指南。从方法论认知到技术实现,揭示PSM作为条件独立假设下局部平衡工具的本质,帮助研究者避免误用。通过匹配质量诊断、共同支撑域检查等关键步骤,建立稳健分析框架,提升因果推断的可靠性。

weixin_30340819的博客 398

Stata里点首歌吧:imusic

全文阅读:https://www.lianxh.cn/news/3bf18d2eaf835.html 目录 1. 引子 2. imusic 命令介绍 2.1 安装 2.2 命令简介 3. 实例 3.1 随机听 3.2 查找歌手 3.3 查找歌单 3.4 查找电台 4. 结语 5. 相关推文   导师寄语:去年秋季,我给大三本科生讲了一学期「实证金融」。期末没有闭卷考试,大家选择一个自己喜欢的东西做就好。令我深感意外的是,这届学生反而格外努力。或许有「内卷」的.

Stata连享会 440

Stata空间计量分析:从权重矩阵到模型选择的完整实战指南

空间计量经济学是计量经济学的重要分支,它突破了传统计量方法中‘个体独立同分布’的假设,专门处理数据在空间维度上的相互依赖性问题。其核心原理在于通过构建空间权重矩阵来量化地理或经济单元之间的邻近关系,并在此基础上建立模型。这项技术的核心价值在于能够识别和量化空间溢出效应、空间依赖性和空间异质性,从而揭示传统回归分析可能忽略的深层规律。在区域经济学、环境科学、城市研究和公共卫生等领域,空间计量模型被广泛应用于分析如知识溢出、污染扩散、房价传导等具有明显空间交互特征的现象。本文聚焦于空间计量在Stata软件中的工

weixin_30388677的博客 358

Stata实操:Heckman两阶段模型校正样本选择偏误

在实证研究与数据分析中,样本选择偏误是导致估计结果失真的常见问题,其本质是解释变量与误差项相关,违背了经典回归的基本假设。Heckman两阶段模型通过构建选择方程与结果方程,并引入逆米尔斯比(IMR)作为控制变量,有效校正了因样本非随机选择而产生的内生性偏误,从而获得一致估计量。这一方法在劳动经济学、政策评估、医疗研究等领域具有重要价值,尤其适用于处理仅对部分群体可观测的结果变量。在Stata中,用户可通过`heckman`命令结合排他性约束变量,高效完成从模型设定、估计到结果检验的全流程。本文以“数据准备

weixin_34121304的博客 369

Stata常用dofile文件包含常用模型的代码——推荐购买、基础必备

设定解释变量和被解释变量,完整设定:mlmodel命令。静态面板模型:固定效应模型v.s.随机效应模型。广义最小二乘法——解决异方差问题GLS/FG。PermutationTests(组合检验)loSimulation(蒙特卡罗模拟)工具变量法2SLS和广义矩估计法。Stata分析常用模型代码大全。编写似然函数的stata程序。Bootstrap(自抽样)Szroeter's秩检验。异方差、序列相关和截面相关。内生性问题与IV-GMM。识别问题和过度约束检验。自回归条件异方差模型。时间效应、模型的筛选。

zxwk01的博客 505

固定效应模型:从面板数据中剥离个体异质性的核心方法

在面板数据分析中,个体异质性(如个人能力、企业文化)是影响因果推断准确性的关键挑战。固定效应模型通过数学变换(如去均值变换),有效剥离了不随时间变化的个体特质,从而聚焦于解释变量在个体内部变化时对结果变量的净效应。这一方法显著提升了估计的内部有效性,是解决遗漏变量偏误、增强因果推断说服力的核心工具。其技术价值在于,它允许个体效应与解释变量存在任意相关性,比随机效应模型假设更弱、更稳健。在经济学政策评估、管理学公司治理及社会学行为分析等实证研究场景中,固定效应模型已成为标准分析流程。本文结合Stata软件操作

weixin_30552811的博客 558

Stata分析空气质量:一个完整的社会科学实证研究案例拆解

本文详细拆解了如何使用Stata进行空气质量研究的完整流程,从数据清洗到政策建议。通过`airq`数据集,展示了研究设计、异常值处理、模型构建及结果可视化的关键步骤,特别强调了社会科学研究中的常见陷阱和解决方案。适合社会科学研究者学习实证分析方法。

weixin_30080745的博客 302
上一篇: 时空自回归模型(STAR)及 Stata 具体操作步骤
下一篇: Heckman 模型及 Stata 具体操作步骤
数据博士
博客等级 码龄2年 1496粉丝 · 71原创
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值