《内生性随机边界模型及 Stata 具体操作步骤》

《傻瓜计量经济学与stata应用》第七章do文件 面板数据模型回归 do 文件 阅读详情

目录

一、文献综述

二、理论原理

三、实证模型

四、稳健性检验

五、程序代码及解释


一、文献综述

自 Aigner 等(1977)、Meeusen 和 van den Broeck(1977)引入随机前沿模型以来,该模型已有 40 多年的历史。它由确定前沿目标的确定性部分、确定双边误差项的随机部分和确定与随机前沿距离的单边无效误差项组成,可用于研究不同行业的生产、成本、收入、利润等目标,在教育、金融市场、房地产、交通等领域得到了广泛运用。

Stata 提供了 frontier 命令来估计随机前沿模型的参数,但各种命令都没有提供控制模型内生性的方法。如果边界或无效率项的决定因素与模型的双边误差项相关,则估计量的结果将受到内生性的污染。例如,Karakaplan 和 Kutlu(2017)设计了一个随机前沿估计器,用于解决面板中的内生性问题。Stata 的 xtfrontier 命令和 Belotti 等(2013)的 sfpanel 命令适用于面板随机前沿模型,但忽略了内质性问题。

在相关研究中,鲁晓东(2008)通过对比各类 tfp 估算方法,结合中国工业企业数据库,对全要素生产率进行了深入研究;张宁多年来专注于资源环境经济、效率与生产率分析等方面,提出了多种改进的全要素生产率模型和能源环境效率模型,成果丰硕,以第一或通讯作者在 Science、Nature 子刊、Cell 子刊、《经济研究》等权威期刊发表论文 70 余篇,18 篇论文进入 esi 热点和高被引论文;连玉君(2012)等学者也在效率分析领域做出了重要贡献,其研究涉及各类随机边界模型,包括 sfa 估算效率的基本原理、异质性 sfa、双边 sfa 以及新进发展出来的内生性 sfa 等。

二、理论原理

具体来说,内生性随机边界模型的估计过程通常分为以下几个步骤:

第一步,选择合适的工具变量。工具变量的选择需要满足相关性和外生性两个条件。相关性是指工具变量与内生解释变量相关,外生性是指工具变量与随机误差项和技术无效率项不相关。

第二步,进行第一阶段回归。将内生解释变量对工具变量进行回归,得到内生解释变量的拟合值。

第三步,进行第二阶段回归。将被解释变量对生产函数中的解释变量(包括内生解释变量的拟合值)和随机误差项、技术无效率项进行回归,估计模型参数。

通过以上步骤,可以得到内生性随机边界模型的参数估计值。这些参数估计值可以用于分析生产过程中的技术效率、投入要素的产出弹性等问题,为政策制定和企业决策提供依据。

三、实证模型

四、稳健性检验

为了检验模型的稳健性,可以进行以下几种方法:

  1. 改变工具变量的选择:尝试不同的工具变量组合,观察模型估计结果的变化。如果不同工具变量得到的结果较为一致,说明模型具有一定的稳健性。
  2. 改变估计方法:使用不同的估计方法,如两阶段最小二乘法(2SLS)和广义矩估计(GMM),比较估计结果的差异。如果两种方法得到的结果相近,说明模型较为稳健。
  3. 增加控制变量:加入更多的控制变量,如企业规模、行业特征等,观察模型估计结果的稳定性。如果加入控制变量后,主要解释变量的系数和显著性变化不大,说明模型具有稳健性。
  4. 分样本估计:将样本分为不同的子样本,如不同行业、不同地区等,分别进行估计,比较不同子样本之间的结果差异。如果不同子样本的结果具有相似的趋势,说明模型较为稳健。

五、程序代码及解释

以下是使用 Stata 进行内生性随机边界模型估计的程序代码及解释:

  1. 导入数据

use "data.dta", clear

这行代码用于导入数据集 “data.dta”,并清除当前内存中的数据。

  1. 描述性统计

summarize y K L T z

这行代码用于对被解释变量、解释变量、、和工具变量进行描述性统计,包括均值、标准差、最小值和最大值等。

  1. 对数变换

gen lny = log(y)
gen lnk = log(K)
gen lnl = log(L)
gen lnt = log(T)

这部分代码对变量进行对数变换,使得模型线性化。

  1. 相关性检验

pwcorr lnt z

这行代码用于计算技术水平的对数()与工具变量之间的相关性。

  1. 第一阶段回归

reg lnt z
predict tlhat, xb

这部分代码进行第一阶段回归,将技术水平的对数()对工具变量进行回归,并得到技术水平的拟合值(存储在变量tlhat中)。

  1. 设定内生性随机边界模型

srfm lny lnk lnl tlhat, frontier(truncnormal) ineff(m = z*delta)

这行代码用于设定内生性随机边界模型。其中,“lny lnk lnl tlhat” 是被解释变量和解释变量,“frontier (truncnormal)” 表示技术无效率项服从截断正态分布,“ineff (m = z*delta)表示技术无效率项的均值函数为工具变量z与参数向量\delta$ 的乘积。

  1. 估计模型参数

estimates store model1

这行代码用于估计模型参数,并将结果存储在 “model1” 中。

  1. 输出估计结果

estimates table model1

这行代码用于输出模型估计结果的表格形式。

  1. 稳健性检验

(1)改变工具变量的选择

// 使用新的工具变量 new_z
srfm lny lnk lnl tlhat, frontier(truncnormal) ineff(m = new_z*delta)
estimates store model2
estimates table model1 model2

这部分代码首先使用新的工具变量 “new_z” 重新估计内生性随机边界模型,并将结果存储在 “model2” 中。然后,使用 “estimates table” 命令输出两个模型的估计结果比较。

(2)改变估计方法(使用广义矩估计 GMM)

srfm lny lnk lnl tlhat, frontier(truncnormal) ineff(m = z*delta) method(gmm)
estimates store model3
estimates table model1 model3

这部分代码使用广义矩估计(GMM)方法重新估计内生性随机边界模型,并将结果存储在 “model3” 中。然后,输出两个模型的估计结果比较。

(3)增加控制变量(假设控制变量为 control_var)

srfm lny lnk lnl tlhat control_var, frontier(truncnormal) ineff(m = z*delta)
estimates store model4
estimates table model1 model4

这部分代码在模型中加入控制变量 “control_var”,重新估计内生性随机边界模型,并将结果存储在 “model4” 中。然后,输出两个模型的估计结果比较。

(4)分样本估计

// 将样本分为两组
split sample, gen(group)
// 对第一组样本进行估计
srfm lny lnk lnl tlhat if group == 1, frontier(truncnormal) ineff(m = z*delta)
estimates store model5
// 对第二组样本进行估计
srfm lny lnk lnl tlhat if group == 2, frontier(truncnormal) ineff(m = z*delta)
estimates store model6
estimates table model1 model5 model6

这部分代码首先将样本分为两组,使用 “split sample, gen (group)” 命令生成一个新的变量 “group”。然后,分别对两个子样本进行内生性随机边界模型估计,并将结果存储在 “model5” 和 “model6” 中。最后,输出三个模型的估计结果比较

Stata:内生性随机边界模型-xtsfkk (qq.com)icon-default.png?t=N7T8https://mp.weixin.qq.com/s?__biz=Mzk0MDI1NTgyOQ==&mid=2247559291&idx=1&sn=cd15b036d553f983e70c3ef223a8f27a&chksm=c2e7d741f5905e573bd285d42c6765c2199918a57c677c0d429f1c0191b96b45b79fa868c57a#rd

不止于作业:用Stata玩转面板数据,从混合回归到动态GMM的完整实战 本文深入探讨了Stata在面板数据分析中的高级应用,从混合回归到动态GMM的完整实战指南。通过详细解析固定效应与随机效应模型的选择逻辑,以及工具变量法和动态面板的技术实现,帮助研究者构建严谨的经济学分析框架。特别适合需要处理时间与个体双重维度数据的社会科学研究者和数据分析师。 阅读详情

相关推荐

Stata工具变量回归:ivreg2与xtivreg2的核心区别与实战选择

工具变量法是解决内生性问题的核心计量方法,其原理是通过寻找与内生解释变量相关、但与扰动项不相关的工具变量,来获得一致估计量。在Stata软件中,ivreg2和xtivreg2是实现工具变量回归的两个关键命令,但它们的应用场景有本质区别。ivreg2适用于横截面数据,通过两阶段最小二乘法等估计技术处理内生性问题,并提供弱工具变量检验、过度识别检验等丰富诊断。而xtivreg2专为面板数据设计,能够通过组内离差变换消除个体或时间固定效应,从而控制不随时间变化的遗漏变量。正确选择命令对实证研究的可靠性至关重要:横

weixin_33895516的博客 327

frontier与stata操作案例比较.pdf

frontier与stata操作案例比较.pdffrontier与stata操作案例比较.pdffrontier与stata操作案例比较.pdffrontier与stata操作案例比较.pdffrontier与stata操作案例比较.pdffrontier与stata操作案例比较.pdf

别再乱用PSM了!倾向得分匹配的5个常见误区和Stata实操避坑指南

本文深入剖析倾向得分匹配(PSM)在实证研究中的五大常见误区,并提供Stata实操指南。从方法论认知到技术实现,揭示PSM作为条件独立假设下局部平衡工具的本质,帮助研究者避免误用。通过匹配质量诊断、共同支撑域检查等关键步骤,建立稳健分析框架,提升因果推断的可靠性。

weixin_30340819的博客 398

随机前沿分析模型简明操作.pdf

frontier 操作指南,内涵详细案列,讲解前面周到,操作简单明了,包含frontier各种操作教程,及相应的代码程序

stata随机前沿分析操作指南及代码

stata随机前沿分析操作指南及代码 生产、距离、成本和利润函数、生产前沿模型、成本前沿模型、利润前沿模型、成本系统模型、盈利系统模型、原始成本模型、利润原始模型、面板模型、生产力和盈利能力等内容,及其相应ado文件及do文件。

m0_71334485的博客 7439

【初级计量经济学】内生性问题——工具变量法(Stata实现)

以课本案例来讲解内生性问题以及Stata实操,适合初学者自学~

m0_56120502的博客 3万+

内生性随机边界模型Stata 具体操作步骤

Kumbhakar 和 Parmeter(2009)将内生性随机边界模型应用于农业生产效率的研究,通过巧妙地处理内生性问题,更准确地评估了各种投入要素对产出的影响,并揭示了不同地区农业生产效率的差异及其背后的原因。总之,内生性随机边界模型通过解决解释变量的内生性问题,能够更准确地刻画生产或成本前沿,评估技术效率,为深入理解经济和管理中的效率问题提供了更有力的分析工具。通过构建这样的实证模型,我们可以更准确地估计企业的生产前沿以及各投入要素对产出的影响,从而评估企业的生产效率,并分析技术创新在其中的作用。

a519573917的博客 1666

Stata内生性随机边界模型-xtsfkk

自 Aigner 等 (1977)、Meeusen 和 van den Broeck (1977) 引入随机前沿模型以来,已有 40 多年的历史。模型由确定前沿目标的确定性部分、确定双边误差项的随机部分和确定与随机前沿距离的单边无效误差项组成。该模型可以用来研究不同行业的生产、成本、收入、利润与其他目标,在教育、金融市场、房地产、交通领域等领域得到广泛运用。S

Stata连享会 324

从犯罪率到工资方程:工具变量法在STATA中的经典应用案例

本文通过警力与犯罪率、教育回报率两个经典案例,深入解析了工具变量法在STATA中的实战应用。针对内生性问题,详细演示了从模型设定、工具变量选取到两阶段最小二乘法(2SLS)估计与三大关键检验(内生性、弱工具、过度识别)的完整操作流程,为实证研究者提供了剥离因果效应的实用方法指南。

5f4d3s2a1q的博客 451

空间计量模型_Stata中的空间计量回归模型应用

Stata 15中,推出了最新的空间计量官方命令,均以sp开头,表示 spatial data),可以处理横截面与面板形式的空间数据。本文主要为大家介绍空间计量横截面及面板模型的应用,全文分为两部分。本文重点:空间计量模型分析的一个流程,准备数据--观测数据--设定空间权重矩阵--建立模型--估计检验。模型主要分为截面SAR、工具变量空间自回归模型和面板空间自回归模型。空间回归模型可以...

weixin_39765280的博客 6792

Stata计量经济学因果推断的本质是什么?如何有效掌握Stata操作,写出一篇合格的实证研究论文?

本文系统阐述了Stata在计量经济学因果推断中的应用要点。首先指出因果推断的本质是通过工具变量法、双重差分法等技术模拟实验环境,克服内生性问题来识别变量间的真实因果关系。其次详细说明合格实证论文的写作流程:从选题、研究设计到Stata实操(数据清理、模型选择、稳健性检验),强调将统计结果转化为完整学术叙事的重要性。最后推荐三本Stata学习教材,分别适合不同基础的学习者,内容涵盖统计分析、论文写作指导及商业建模案例。全文强调理论洞察、研究设计与软件操作的有机结合,为开展实证研究提供系统指导。

m0_72274883的博客 1263

stata随机前沿模型命令包(包含sfmodel.ado和sfpan.ado)

在用stata软件做随机前沿模型时,需要使用一些外部命令(比如sfmodel),有些外部命令不太容易找得到,本资源包含随机前沿模型的外部命令包(ado文件),非常实用。

stata软件使用讲义

stata使用方法,如何使用,不同程序,不同步骤,权威专家讲授,手把手教学。

Stata里点首歌吧:imusic

全文阅读:https://www.lianxh.cn/news/3bf18d2eaf835.html 目录 1. 引子 2. imusic 命令介绍 2.1 安装 2.2 命令简介 3. 实例 3.1 随机听 3.2 查找歌手 3.3 查找歌单 3.4 查找电台 4. 结语 5. 相关推文   导师寄语:去年秋季,我给大三本科生讲了一学期「实证金融」。期末没有闭卷考试,大家选择一个自己喜欢的东西做就好。令我深感意外的是,这届学生反而格外努力。或许有「内卷」的.

Stata连享会 440

stata命令汇总_Stata:面板数据分析命令汇总

首先对面板数据进行声明:前面是截面单元,后面是时间标识:tsset company yeartsset industry year产生新的变量:gennewvar=human*lnrd产生滞后变量Genfiscal(2)=L2.fiscal产生差分变量Genfiscal(D)=D.fiscal一、描述性统计xtdes :对Panel Data截面个数、时间跨度的整体描述Xtsum:分组...

weixin_39779739的博客 1万+

代码随想录训练营第十五天

7. 给定一个 完美二叉树 ,其所有叶子节点都在同一层,每个父节点都有两个子节点。二叉树的深度为根节点到最远叶子节点的最长路径上的节点数。最小深度是从根节点到最近叶子节点的最短路径上的节点数量。,想象自己站在它的右侧,按照从顶部到底部的顺序,返回从右侧所能看到的节点值。树的序列化输入是用层序遍历,每组子节点都由 null 值分隔(参见示例)。(即按从叶子节点所在层到根节点所在的层,逐层从左向右遍历)(力扣107)叶子节点是指没有子节点的节点。叶子节点是指没有子节点的节点。(即从左到右,逐层遍历)。

xjfbracing的博客 129

stata学习笔记|内生性

为什么采用工具变量? 存在内生变量,即解释变量和扰动项相关。 后果:估计量不一致。 工具变量的两大要求: 相关性:工具变量与内生解释变量相关 外生性:工具变量与扰动项不相关(排他性约束) 在stata中怎么用工具变量法? 采用二阶段最小二乘法,第一阶段分离出内生变量的外生部分,第二阶段使用该外生部分进行回归。 工具变量是否合格? ...

Clytie_Lion的博客 4万+
上一篇: 贝叶斯估计及 Stata 具体操作步骤
下一篇: 《面板变系数模型及 Stata 具体操作步骤》
数据博士
博客等级 码龄2年 1496粉丝 · 71原创
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值