京公网安备 11010802034615号
经营许可证编号:京B2-20210330
STATA软件是一款国际上非常流行的优秀的统计软件,是众多研究机构和公司在数据分析中的首选软件,并被很多国家和国际组织指定为官方使用软件。
STATA强大的统计与计量分析功能、精致的绘图、简单易行的窗口操作、简练便捷的编程、强大的MATA矩阵运算、丰富的网络资源等功能使其成为世界上用户最多的软件之一,被高度评价为“数据分析的操作系统”,可以实现诸多的统计分析方法,如单元统计、多元统计等内容;还包括了许多经典和前沿的计量模型,如单方程回归模型、离散选择模型、分位数回归、时间序列分析、面板数据分析、蒙特卡洛模拟和自举法等。
有效提升论文发表与Stata应用技能
时间:初级:2018年1月13-16日 (四天)
讲师介绍:
连玉君,经济学博士,副教授。2007年7月毕业于西安交通大学金禾经济研究中心,现任教于中山大学岭南学院金融系。主讲课程为“金融计量”、“计量分析与Stata应用”、“实证金融”等。
已在《China Economic Review》、《经济研究》、《管理世界》、《经济学(季刊)》、《金融研究》、《统计研究》等期刊发表论文60余篇。连玉君副教授主持国家自然科学基金项目(2项)、教育部人文社科基金项目、广东自然科学基金项目等课题项目10余项。
目前已完成Panel VAR、Panel Threshold、Two-tier Stochastic Frontier等计量模型的Stata实现程序,并编写过几十个小程序,如xtbalance、winsor2、bdiff、hausmanxt、ttable3、hhi5等。
初级班课程大纲
|
专题名称 |
授课内容 |
|
第1讲(3小时) Stata简介 |
数据的导入和导出 执行指令和基本统计分析 do文件和log文件的使用 帮助文件的使用和外部命令的获取 一篇范例文档 |
|
第2讲(3小时) 数据处理 |
数据的横向合并和纵向追加 重复样本值、缺漏值和离群值的处理 基本统计量的呈现 基本统计分析(组间均值差异和中位数差异检验) 文字变量的处理 大型数据的处理范例(GTA数据库和工业企业数据库) |
|
第3讲(3小时) Stata程序 |
局域暂元和全局暂元(local, global) 控制语句(条件语句、循环语句) Stata中的各类函数 分组回归分析 范例:盈余管理程度的估算、现金持有调整系数的估算 |
|
第4讲(3小时) 普通最小二乘法 (OLS) |
线性回归模型估计方法(OLS) 假设检验和统计推断 Bootstrap、Jackknife及稳健性标准误的获取 虚拟变量 |
|
第5讲(3小时) 模型的设定和解释 |
交乘项和平方项的使用及解释 R2分解和贡献度分析 分组回归和组间系数差异检验 估计结果的呈现和分析 范文2篇 |
|
第6讲(3小时) 内生性问题及估计方法: IV-GMM 倍分法(DID, D-in-D) |
工具变量法(IV) 广义矩估计法(GMM)简介 内生性检验:是否存在内生性 过度识别检验:工具变量的合理性 倍分法(Difference in Difference)简介 PSM-DID 应用实例(介绍2篇论文) |
|
第7讲(3小时) 静态面板数据模型 |
静态面板模型:固定效应和随机效应 基于Bootstrap的Hausman检验 异方差和序列相关(Bootstrap、Cluster调整标准误) 包含内生变量的固定效应模型 实证分析中的常见问题 应用实例(介绍3篇论文) |
|
第8讲(3小时) 论文写作与发表专题 |
Endnote和Google Scholar的使用 论文的选题 如何梳理和评述文献 研究贡献的陈述 研究设计与论文的修改 修改报告的撰写 (与审稿人有效沟通) |
高级班课程大纲
|
第1讲(3小时) 动态面板模型 面板VAR模型 |
一阶差分GMM估计量(FD-GMM) 序列相关检验和过度识别检验(Sargan检验) 面板VAR模型简介 冲击反应函数 (IRF)、方差分解 (FEVD) 应用实例(介绍3篇论文) |
|
第2讲(3小时) 面板门槛模型 |
Bootstrap简介 截面门槛模型(Cross-sectional Threshold Model) 面板门槛模型(Panel Threshold Model) 应用实例(介绍2篇论文) |
|
第3讲(3小时) Logit模型 |
Logit模型简介 模型设定、估计方法和结果的解释 多元Logit模型 (Multinomial Logit) 有序Logit模型 (Ordered Logit) 应用实例(介绍2篇论文) |
|
第4讲(3小时) 内生性问题专题I: Heckman选择模型 处理效应模型 倾向得分匹配分析(PSM) |
Heckman选择模型(Heckman Selection Model) 处理效应模型(Treatment Effect Model) 倾向得分匹配分析(Propensity Score Matching, PSM) 配对方法:精确配对、半径匹配、最近邻匹配等 共同支撑假设和平行假设 应用实例(介绍2篇论文) |
|
第5讲(3小时) 内生性问题专题II: 合成控制法 (Synthetic control methods) |
合成控制法简介 精讲一篇经典论文(Stata实现过程):Abadie, A., A. Diamond, J. Hainmueller, 2010, Synthetic control methods for comparative case studies: Estimating the effect of california's tobacco control program, Journal of the American Statistical Association, 105 (490): 493-505. |
|
第6讲(3小时) 内生性问题专题III: 断点回归分析(RDD) |
Regression Discontinuity Design (RDD) 简介 范例:2篇文章 |
|
第7讲(3小时) 学术论文精讲 Faulkender and Wang (2006, JF) |
Faulkender, M., R. Wang, 2006, Corporate Financial Policy and the Value of Cash, Journal of Finance, 61 (4): 1957-1990.
|
|
第8讲(3小时) 课题标书的撰写 |
评审专家的习惯和偏好 关于选题和子课题的设定 研究基础、研究目标、研究内容、研究难点 特色和创新点的提炼 标书的结构和标书的修改 经验分享:一份中标的自科标书 |
1. 无论报初级班还是高级班,缴费成功后都享受如下优惠:
√ (a)赠送与所报课程相同的stata视频教程,
即报初级班送初级班视频,报高级班送高级班视频,报全程送【初级+高级+论文攻略】视频;
√ (b)5折优惠购买未赠送的其他Stata视频;
2,现场班老学员9折优惠;
6,优惠2,3,4,5不叠加。
PS:根据报名缴费顺序安排现场座位。
报名流程:
1. 点击“初级/高级/全程班报名”网上提交报名信息,报名时请留言报全程还是初级,高级~
2. 电话确认,订单缴费;
3. 缴费确认,开课前一周发送软件准备,电子版讲义;
联系方式:
魏老师
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
做数据聚合时,PySpark的groupBy()确实能完成统计,这也是它的本职工作。但它有一个根本性局限:每一组数据,最终只能返回一行 ...
2026-10-01热力地图是数据可视化中极具辨识度与实用性的空间分析图表,结合地理空间维度与数据密度特征,通过颜色深浅、色阶渐变直观展示数 ...
2026-09-30 很多数据分析师做过按月份的销售额趋势图,画过按天的流量折线图,但当被问到“时间序列和普通数据有什么本质区别”“季节性 ...
2026-09-30同样是“银行数据岗”,在国有大行总行数据中心、在一家城商行的零售部、在银行系金融科技子公司、在保险公司,工作内容、成长节 ...
2026-09-29在数据分析与统计学研究中,数据往往不是独立存在的,不同变量之间普遍存在相互关联、相互影响的关系。相关性统计分析是挖掘变量 ...
2026-09-29 导读:大多数人只把 dataclasses 当成偷懒工具,用来少写 __init__、__repr__ 这类魔法方法。但它的能力远不止于此。本文带 ...
2026-09-29 很多数据分析师能熟练地计算指标、搭建标签体系,但当被问到“画像到底在解决什么问题”“画像和标签是什么关系”“画像如何 ...
2026-09-29在MySQL数据库运维与业务开发中,行业普遍存在“数据达到千万级就必须分表”的说法。但在实际生产环境中,千万条数据并不是强制 ...
2026-09-28CDA数据分析师 出品 作者:李诗怡 1. 5W1H 分析法 定义:经典系统性思维框架,通过六个核心维度对问题进行全方位拆解与剖析,确 ...
2026-09-28 很多分析师在设计标签时思路清晰,但真到落地环节却面临“数据在手,不知如何转化为可用标签”的困境:或因加工方式选择不当 ...
2026-09-28CDA数据分析师 出品 作者:李诗怡 1. 用户标签体系 定义: 通过一系列高度精炼的特征标识,对用户属性、行为与偏好进行量化刻画 ...
2026-09-24Pandas是Python生态中用于表格数据处理的核心库,广泛应用于数据清洗、统计运算、报表输出、数据分析建模等场景。在处理极大数值 ...
2026-09-24随着数字经济快速发展,数据已成为核心生产要素,各行各业的业务沉淀、用户行为、设备运行、市场交易均产生海量数据。数据处理作 ...
2026-09-24 很多分析师每天和数据打交道,但当被问到“标签是什么”“标签和指标有什么区别”“标签体系如何设计”时,却常常答不上来。 ...
2026-09-24在时序数据分析中,大部分业务数据并非持续平稳变化,而是会在某些时间节点出现突然抬升、断崖下跌、趋势反转、波动异变等现象, ...
2026-09-23在统计学与数据分析中,研究多组数据差异最常用的方法为单因素方差分析与事后多重比较。很多数据分析初学者容易混淆两者功能,认 ...
2026-09-23 很多数据分析师每天都在写 SQL,但当被问到“DQL 的本质是什么”“SELECT 子句的书写顺序与执行顺序为何不同”“INNER JOIN ...
2026-09-23 很多数据分析师写过无数个SELECT查询,但当被问到“如何新建一张表来固化中间数据”“创建视图和创建物理表有什么区别”“视 ...
2026-09-22CDA数据分析师 出品 作者:李诗怡 1. 金字塔原理 定义: 一种“先总后分、先结论后原因”的思考和表达方式。顶层为核心观点,中 ...
2026-09-22数据收集是数据分析、数据挖掘与数字化运营的源头工作,数据收集的完整性、准确性、时效性直接决定后续数据分析结果的可信度与业 ...
2026-09-21