管理定量研究方法·开卷考试复盘提纲封面

管理定量研究方法·开卷考试复盘提纲

对照 113 页讲义的开卷复习提纲:全书知识总图、八章分章提纲(英文关键词+PDF 页码指引)、公式速查表、英文答题句型库、跨章对比表与考场检索策略。

使用说明 · 30 秒

管理定量研究方法·开卷考试复盘提纲 · 使用说明(先读这里,30 秒)

  1. 本提纲所有页码 =《管理定量研究方法_完整讲义_英中对照-formatted.pdf》的 PDF 页码(全书共 113 页)。考场上翻 PDF 直接用这里的页码。
  2. 结构:第一部分全书总图(纲)→第二部分分章提纲(目,每节给英文关键词缩写 + 页码指引)→第三部分公式速查→第四部分英文答题弹药库(开卷要英文作答,直接背/抄这些句型)→第五部分跨章对比表(最爱考)→第六部分考场策略与复习节奏。
  3. 标记含义:必须背熟(闭眼能写)|重点(会认、能翻到)|快速过(考到能找着即可)。
  4. 英文关键词已尽量缩写:corr=correlation、reg=regression、dist=distribution、hyp=hypothesis、est=estimation、var=variable、coef=coefficient、sig=significance、fn=function。
第 1 页

纲 · 一条研究流水线

第一部分 全书知识总图(纲)

管理定量研究方法 = 一条完整的研究流水线

  • Ch1 导论 ………… 为什么做定量研究(p1-5)
    • qual vs quant vs mixed|描述-解释-预测-处方|研究四步
  • Ch2 数据特征 ………… 数据长什么样(p6-17)核心基础章
    • 4 种尺度 N-O-I-R|3 种数据类型|集中趋势+离散程度|正态分布+t 分布
  • Ch3 数据处理 ………… 数据从哪来、怎么洗(p17-35)
    • 一手:问卷(设计+信度+效度)|二手:数据库+缺失值|PCA 降维|熵权法
  • Ch4 假设检验 ………… 统计推断的总开关(p35-43)全书逻辑核心
    • 反证法+小概率原理|H0/H1|五步流程|单双侧
  • Ch5 线性回归 ………… 连续因变量(p43-73)分值最高章
    • 相关 r→简单回归 OLS→五大假设→BLUE→R²→t 检验/F 检验→多元回归
  • Ch6 离散选择模型 ………… 分类因变量(p73-86)
    • 二元 Logit(odds/OR/MLE)|Probit|多项 Logit|有序 Logit/Probit
  • Ch7 面板数据 ………… 截面×时间(p87-99)
    • 优点(遗漏变量/异质性)|FE(LSDV/组内/一阶差分)vs RE(FGLS)|Hausman
  • Ch8 研究设计 ………… 怎么写一篇论文(p99-113)
    • 三性(科学/创新/理论)|结构(前置-主体-后置)|文献综述|范文解读

一页记住全书:Ch1 定方向 → Ch2 认数据 → Ch3 备数据 → Ch4 学思想 → Ch5/6/7 三大模型(按因变量类型+数据类型选:连续→Ch5;0/1 或分类→Ch6;面板→Ch7)→ Ch8 写成论文。

第 2 页

Ch1 导论 p1-5 · 快速过

第二部分 · Chapter 1 导论(p1-5)快速过

知识点英文关键词一句话要义翻阅
三种实证方法qual / quant / mixed methods定性用文字,定量用数字,混合两者结合p1
定性研究方法interview, observation, case study; field notes, transcripts, memos访谈/观察/案例;原始数据=笔记、转录、录音等p1
定量方法四大功能Describe → Explain → Predict → Prescribe描述已发生→解释为何→预测未来→处方对策p2 记这四个动词
定量研究一般过程hypothesis → data → test → corr(X,Y)提假设→收数据→检验变量关系→判断相关程度p2
PCT 专利案例AI patent, geographic concentration数据揭示规律:AI 专利集中于中美p3
人均 GDP 门槛per capita GDP $3,000 threshold跨越门槛→城市化/中产/消费升级p3
大数据时代big data; data as factor of production; National Data Bureau (2023.10)数据成为新生产要素(与土地劳动资本技术并列)p4
PAR/JPART 统计quant research >60% of empirical studies定量研究在公管顶刊占主导p4-5
第 3 页

Ch2 数据特征 p6-17 · 必复习

Chapter 2 数据特征(p6-17)必复习

2.1 四种测量尺度(p6-7)必背顺序 N→O→I→R
尺度英文能做什么不能做什么例子翻阅
定类Nominal scale只分类排序、运算性别 0/1p6
定序Ordinal scale分类+排序加减乘除一二三等品;李克特 5 点p6-7
定距Interval scale分类+排序+差值有意义,可加减无绝对零点,不能比倍数摄氏温度p7
定比Ratio scale全部运算,有 absolute zero工资、身高p7
  • 定类尺度两要求:exhaustiveness 穷尽性 + mutual exclusivity 互斥性(p6)
2.2 数据类型(p8)
  • Qualitative data(定性)= nominal + ordinal;Quantitative data(定量)= interval + ratio
  • Cross-sectional(截面:同一时点多个体)/ Time series(时序:一个体多时点)/ Panel(面板:多个体×多时点)——例:2020 各省 GDP / 湖北 2000-2020 GDP / 各省 2000-2020 GDP
2.3 描述统计三大件(p8-12)
第 4 页
维度指标英文要点翻阅
集中趋势 central tendency均值(arithmetic) mean最常用;受 outlier 影响p9-10
几何平均geometric mean连乘开 n 次方p9
中位数median排序后中间值;不受 outlier 影响;适合 ordinalp10
众数mode出现最多;可无/可多;nominal 也能用p10
离散程度 dispersion极差rangemax-minp11
方差variance s2/σ2s^2/\sigma^2最重要的离散度量p11
标准差standard deviation s/σs/\sigma与原始数据同量纲p11-12
变异系数CV=s/xˉ×100%CV=s/\bar{x}\times100\%相对离散度;比较不同量纲/均值的数据(股票 A/B 例)p12
分布形状对称/偏symmetry / skewnessp8-9
2.4 正态分布(p13-16)
第 5 页
  • 历史:de Moivre 1733 提出,Gauss 用于天文 → 又称 Gaussian dist(p13)
  • 密度函数参数:μ\mu=总体均值、σ2\sigma^2=总体方差、π3.14\pi\approx3.14e2.71828e\approx2.71828;记法 xN(μ,σ2)x\sim N(\mu,\sigma^2)(p13)
  • 五大特征(p14-15):①关于 x=μx=\mu 对称;②f(x) 在 x=μx=\mu 取最大;③两个拐点 inflection points 在 μ±σ\mu\pm\sigma;④μ\mu 定位置、σ\sigma 定形状(σ\sigma 大→扁平分散,σ\sigma 小→陡峭集中);⑤两侧无限延伸,以 x 轴为渐近线 asymptote
  • 标准正态分布:μ=0,σ2=1\mu=0,\sigma^2=1;换算 z=(xμ)/σz=(x-\mu)/\sigma(p15-16)
  • 3σ 法则(p16):±1σ\pm1\sigma→68.27%,±2σ\pm2\sigma→95.45%,±3σ\pm3\sigma→99.73%
2.5 t 分布(p16-17)
  • 记法 tt(n)t\sim t(n),n=自由度 degrees of freedom
  • 与正态同:对称钟形,mean=median=mode 重合
  • 与正态异:尾部更厚(小样本不确定性);df→∞ 收敛于 N(0,1);df>30 即很接近
第 6 页

Ch3 数据处理 p17-35

Chapter 3 数据处理(p17-35)

3.1 一手数据:问卷调查(p17-22)
  • 定义:设计问题直接收集 raw data;价值:避免二手数据过时/口径偏差,“量身定制”(p17)
  • 三类问卷(p17-18):Structured(预设选项,标准化、高效,但限制表达)/ Unstructured(开放回答,深入但需人工编码)/ Semi-structured(混合,兼顾效率与深度)
  • 问卷设计四步(p19-22):
    1. 明确目的+目标群体(大学生 ≤15 分钟;中老年简化语言)p19
    2. 问题设计:Likert 5-point scale、matrix items;措辞原则=避免歧义、保持中立、不用引导性问题 leading questions p19
    3. 质量控制 4 类题(p20-21):陷阱题 trap questions(明确指示型/重复一致性/常识题/反向逻辑题);放问卷中部,2-3 题
    4. 结构:开头(标题+问候+说明)→主体(背景→行为→态度,难度递进)→结尾(致谢+开放补充)p21-22
  • 预调查 pre-survey:抽目标群体 10%-20%;查回答时长/歧义/跳题逻辑,然后修订(p22)
3.2 信度与效度(p23-27)高频考点
第 7 页
信度 Reliability效度 Validity
定义同一方法反复测同一对象,结果一致的程度(p23)测到想测的东西的程度=准确性/真实性(p24)
指标 1Cronbach’s α(内部一致性;α>0.7 好/0.8 优/0.9 非常高)p23Content validity 内容效度(覆盖概念全维度;专家判断;CVR,N=5 时 >0.74)p25-26
指标 2Test-retest 重测信度(不同时间测同组人,r>0.7 良好)p24Construct validity 构念效度(因子分析;χ2/df\chi^2/df 1-3 好、2-5 可接受;CFI>0.9;TLI>0.9)p26
指标 3Criterion validity 效标效度(与外部标准一致;Pearson r)p27
  • 记忆口诀:信度=稳不稳,效度=准不准;信度是效度的必要非充分条件。
3.3 二手数据(p27-28)
  • 三来源:公开数据(统计年鉴)、非公开(企业财报)、网络爬取 web crawler(p27)
  • 四大国家级数据库(p28):国家统计局数据库 / CGSS 中国综合社会调查(人大,2003)/ CSS 中国社会状况综合调查(社科院,2005)/ CFPS 中国家庭追踪调查(北大,微观数据)
3.4 缺失值处理(p28-29)
  1. 直接删除:缺失随机且比例 <5%<5\%
  2. 插补 imputation:均值/中位数(数值型)、众数(分类型)、线性插值(时序数据)、回归插补(用相关变量预测)
第 8 页
3.5 主成分分析 PCA(p29-32)
  • 目的:降维 dimensionality reduction;把多个相关变量→少数不相关主成分(线性组合),按方差排序,方差越大信息越多(p29)
  • 五步(p30-32):①标准化(Z-score)→②算协方差矩阵→③求特征值+特征向量→④定主成分个数(累积贡献率 ≥85%)→⑤算主成分得分(排序/聚类)
3.6 熵权法(p32-35)
  • 信息熵=系统无序/不确定性程度;指标变异越大→熵越小→信息越多→权重越大(p32)
  • 客观赋权,用于多准则综合评价
  • 五步(p32-35):①归一化(极差法,正/负向指标公式不同)→②算比重 pijp_{ij} →③算熵值 eje_jpij=0p_{ij}=0 时调成 0.001 以便算 ln\ln)→④算差异系数 dj=1ejd_j=1-e_j →⑤算权重 wj=dj/Σdjw_j=d_j/\Sigma d_j → 加权和算综合得分
第 9 页

Ch4 假设检验 p35-43 · 思想核心

Chapter 4 假设检验(p35-43)全书思想核心

  • 引入案例:女士品茶 Lady Tasting Tea(Fisher,8 杯奶茶挑 4 杯,纯猜对概率 =1/70≈0.014,太小→不信是猜的)(p35-37)
  • 概念(p38):对总体参数(均值/方差)或分布形式做先验假设,用样本数据判断是否成立。又名 significance test 显著性检验
  • 两大思想支柱(p38)反证法 proof by contradiction + 小概率事件原理(小概率事件在一次试验中几乎不可能发生;发生了→怀疑原假设)
  • 显著性水平 α\alpha:常用 0.01 / 0.05 / 0.1,研究者事先定;α=0.01\alpha=0.01 表示“错误拒绝 H0 的概率 <1%”(p38)
  • 五步流程(p39)必背
    1. State H0 (null) & H1 (alternative)
    2. Select test statistic & its distribution
    3. Determine rejection region at given α\alpha
    4. Calculate observed value, compare
    5. Make statistical decision
  • 全聚德鸭子案例(p39-41):H0:μ=2.00\mu=2.00 vs H1:μ2.00\mu\neq2.00;n=100 大样本+σ\sigma 已知→z 统计量 N(0,1)\sim N(0,1);算得 z=-6 < -1.96 落入拒绝域→拒绝 H0,鸭子不达标
  • 单双侧检验(p42-43):
    • Two-tailed:拒绝域平分两尾;H1:μμ0\mu\neq\mu_0;只想知道“有没有差异”时用
    • One-tailed:拒绝域在一尾;左尾 H1:μ<μ0\mu<\mu_0 / 右尾 H1:μ>μ0\mu>\mu_0
    • 选择规则:实验设计阶段由专业知识定;无先验方向→双侧;有理论/经验表明 A 不差于 B、只想验证 A 更好→单侧(p43)
第 10 页

Ch5 线性回归 p43-73 · 分值最高

Chapter 5 线性回归(p43-73)分值最高

5.1 相关分析(p44-49)
  • 变量关系三种(p44):deterministic functional(一对一确定)/ statistical correlation(不确定,含 ε\varepsilon)/ none;用 scatter plot 散点图
  • 相关分类(p45):按变量数=simple vs multiple;按形式=linear vs nonlinear;按方向=positive vs negative;按程度=perfect / imperfect / no corr
  • 总体相关系数 ρ\rho(p46):公式含 Cov(X,Y)\mathrm{Cov}(X,Y) 协方差;X,Y 独立 →Cov=0;ρ\rho 是客观常数、无量纲0ρ10\le|\rho|\le1
  • 样本相关系数 r(p47):用观测值估计 ρ\rho,是随机变量
  • r 的性质(p47-48):[1,1][-1,1];r>0 正相关/r<0 负相关/r=0 无线性关系/|r|=1 完全线性;对称 rXY=rYXr_{XY}=r_{YX}只测线性;不能推因果
  • r 的检验(p49):H0:ρ=0\rho=0;t 统计量 t(n2)\sim t(n-2)t>tα/2(n2)|t|>t_{\alpha/2}(n-2)\rightarrow 拒绝 H0,相关显著
5.2 简单线性回归(p50-63)
第 11 页
  • 回归的目的(p50):用固定的自变量估计因变量的均值(总体→样本→估计→回总体)
  • PRF 总体回归函数 E(YXi)=α+βXiE(Y\mid X_i)=\alpha+\beta X_i;一般式 Yi=α+βXi+εiY_i=\alpha+\beta X_i+\varepsilon_i(p50)
  • SRF 样本回归函数 Y^i=a+bXi\hat{Y}_i=a+bX_i;一般式 Yi=a+bXi+eiY_i=a+bX_i+e_i(p51)
  • 五大经典假设(p51)必背:①零均值 E(εi)=0E(\varepsilon_i)=0;②同方差 homoscedasticity Var(εi)=σ2\mathrm{Var}(\varepsilon_i)=\sigma^2;③无自相关 Cov(εi,εj)=0\mathrm{Cov}(\varepsilon_i,\varepsilon_j)=0;④ε\varepsilon 与 X 不相关;⑤正态性 εiN(0,σ2)\varepsilon_i\sim N(0,\sigma^2)
  • OLS 普通最小二乘(p52-54):原理=最小化残差平方和 RSS;对 a、b 求导、令一阶导=0 解出
  • Gauss-Markov 定理(p55):OLS 估计量是 BLUE = Best Linear Unbiased Estimator(最佳线性无偏估计量):线性+无偏+方差最小
  • σ2\sigma^2 的无偏估计(p56):用 RSS/(n2)RSS/(n-2)
  • 拟合优度(p56-57):TSS=ESS+RSSTSS=ESS+RSS(总离差平方和=解释+残差);R2=ESS/TSSR^2=ESS/TSS
  • R2R^2 特征(p57):非负、[0,1][0,1]、随机变量;简单回归中 R2=r2R^2=r^2
  • 回归系数 t 检验(p57-59):H0:β=0\beta=0 vs H1:β0\beta\neq0t=(β^β)/set(n2)t=(\hat\beta-\beta)/se\sim t(n-2);四步:提假设 → 算统计量 → 给 α\alpha 查临界值 → 比较下结论
  • p 值(p59):H0 成立时得到观测统计量(或更极端)的概率;p<α 拒绝 H0;p>α 不拒绝
  • 银行不良贷款例题(p60-63):y^=0.8295+0.037895x\hat{y}=-0.8295+0.037895xR2=71.16%R^2=71.16\%(贷款余额解释不良贷款变异的 71.16%);t=7.53>2.20 拒绝 H0;评价回归结果 4 问:系数符号合理论?显著吗?R2R^2 多大?ε\varepsilon 正态吗(残差直方图/正态概率图)
5.3 多元线性回归(p64-73)
第 12 页
  • 为什么要多元(p64):冰淇淋销量与儿童溺水=典型 spurious regression 虚假回归——共同受温度影响;多元回归能控制其他变量、逼近因果
  • 模型(p65):矩阵形式 y=Xβ+εy=X\beta+\varepsilon;假设=简单回归 5 条+第 6 条:自变量间无完全相关(X 满列秩,XXX'X 可逆)
  • OLS 矩阵解(p66-67)b=(XX)1Xyb=(X'X)^{-1}X'y;仍是 BLUE;σ2=RSS/(nk)\sigma^2=RSS/(n-k),k=参数个数(含常数项)
  • 调整 R2R^2(p68-69)R2R^2 随变量增多只增不减→不同变量数的模型不能直接比 R2R^2;调整 R2R^2 纳入 k 做惩罚,在解释力与简约性 parsimony 间权衡
  • 单个系数:t 检验(p69);整体方程:F 检验(p70):基于 ANOVA 方差分析;H0:β1=β2==0\beta_1=\beta_2=\ldots=0FF(k1,nk)F\sim F(k-1,n-k)
  • 章小结 p71;重要公式汇总 p72-73(考前最后翻这两页!)
第 13 页

Ch6 离散选择 p73-86

Chapter 6 离散选择模型(p73-86)

  • 现实问题(p73-74):选食堂/考研/通勤方式;公管例=政策创新扩散(采纳或不采纳)、部门终止(终止 vs 存续)、调查量表(很难~很容易)
  • 共同特征(p75):因变量是分类变量;自变量无量纲要求;研究“哪些因素影响分类结果的发生”
  • 三大家族(p75):Binary 二元 / Multinomial 多项 / Ordered 有序
6.1 二元 Logit(p75-81)
  • 为什么不用线性回归:线性模型无法保证预测值落在 (0,1)(0,1)(p75)
  • 模型:P(y=1X)=e(α+βX)/(1+e(α+βX))P(y=1\mid X)=e^{(\alpha+\beta X)}/(1+e^{(\alpha+\beta X)}),S 形曲线=logistic 分布(p76)
  • Logit 变换(p77)ln[p/(1p)]=α+βX\ln[p/(1-p)]=\alpha+\beta X(对数变换后对自变量线性)
  • 估计:MLE 极大似然(p77-78):选参数使观测样本出现概率最大;软件迭代求解
  • 系数解释(p78-79):α\alpha=截距(所有 X=0 时的 ln(odds)\ln(\text{odds}));β\beta=某自变量每增加 1 单位(其他不变)引起的 ln(odds)\ln(\text{odds}) 变化
  • Odds 优势(p79)=两结果概率之比 p/(1p)p/(1-p);抛硬币例:均匀→odds=1,偏币(2/3 vs 1/3)→odds=2
  • Odds Ratio 优势比 OR=eβe^\beta(p79-80):β>0→OR>1 正向效应;β<0→OR<1 负向;β=0→OR=1 无效应(p80-81)
  • 拟合优度(p81):①Accuracy rate 准确率(预测概率 >0.5 判 1,否则 0,对比实际);②McFadden Pseudo-R²(无平方和分解,用对数似然构造:lnL1\ln L_1 全模型 vs lnL0\ln L_0 仅常数项)
6.2 二元 Probit(p82)
第 14 页
  • Φ\Phi=标准正态累积分布函数 CDF 替代 logistic;同样 MLE
  • 缺点:参数不如 Logit 好解释→用得比 Logit 少;解释只看系数符号:正→提高 P(y=1),负→降低
6.3 多项选择(p82-85)
  • Multinomial Logit(p83-84)y=1,2,,K1y=1,2,\ldots,K-1;以第 K 项为基准(系数全设 0);MLE;似然函数用指示函数 1()1(\cdot);最大化 Σ\Sigma 对数似然
  • Multinomial Probit(p85):假设效用函数误差项服从正态分布;表达式复杂、可解释性差→不常用
6.4 有序选择(p85-86)
  • 场景:官员晋升(0 退休/1 留任/2 晋升)、满意度 1-5、态度五级(p85)
  • 微观基础(p85-86):潜变量 y=xβ+εy^*=x'\beta+\varepsilon(不可观测)+ cut-off points 截止点划分等级;εN(0,1)\varepsilon\sim N(0,1)\rightarrow Ordered Probit;ε\varepsilon\sim logistic→Ordered Logit;两者预测概率很接近
第 15 页

Ch7 面板数据 p87-99

Chapter 7 面板数据(p87-99)

7.1 面板数据是什么、好不好(p87-89)
  • 数据类型复习+典型面板=城市×年份政策采纳 0/1(政策扩散研究)(p87-88)
  • 优点(p88):①解决遗漏变量 omitted variables 问题——遗漏变量常来自不可观测个体异质性 heterogeneity;若差异时间不变 time-invariant,面板可消掉它;②信息更多(截面+纵向两维);③样本量更大→估计更精确
  • 缺点(p88):①通常不满足 i.i.d.(同一个体不同期扰动项自相关);②收集成本高、难获取
7.2 三种估计策略(p89-90)
  • 极端 1:Pooled regression 混合回归(所有个体同一方程)→缺点:忽略个体异质性→估计不一致(p89)
  • 极端 2:每个体单独回归→缺点:忽略共同特征+样本量不足(p89)
  • 折中:同斜率、不同截距捕捉异质性(p90)
  • 个体效应模型(p90)yit=α+xitβ+ziδ+ui+εity_{it}=\alpha+x_{it}\beta+z_i\delta+u_i+\varepsilon_{it}uiu_i=个体效应(随时间不变的个体特征截距项)
7.3 FE vs RE 定义(p91)必背
  • uiu_i任一解释变量相关Fixed Effects 固定效应(OLS 不一致,需变换消 uiu_i
  • uiu_i所有解释变量不相关Random Effects 随机效应
7.4 FE 三种估法(p91-95)
第 16 页
方法英文思路缺点/注意翻阅
虚拟变量法LSDV (Least Squares Dummy Variable)每个体一个 dummy,OLS 估计n 个截距只放 n-1 个 dummy(全放→完全共线性=dummy 陷阱);个体多时(300+地级市)不可行p91-93
组内估计Within-group各变量减去个体时间均值(离差变换)再 OLS,消掉 uiu_i聚类标准误 clustered SE(组内自相关);无法估计时不变变量(如性别,被消掉)p93-94
一阶差分First-difference (FD)本期减上期消 uiu_i,OLS 得 FD 估计量要求 Δε\Delta\varepsilonΔx\Delta x 不相关才一致p95
7.5 RE 估计:FGLS(p95-96)
  • OLS 一致但非最有效(扰动项非球形 spherical:同一个体存在序列自相关)
  • FGLS 可行广义最小二乘:先 OLS 估 θ\theta,再做变换;θ=0\theta=0\rightarrow 退化为混合回归;θ=1\theta=1\rightarrow 组内估计;所得=随机效应估计量(Stata 中 theta)
7.6 选 FE 还是 RE:Hausman 检验(p97-98)必背
  • H0:uiu_ixitx_{it}ziz_i 不相关(RE 更好)
  • H0 对 → FE、RE 都一致,RE 更有效,两估计量差异不显著
  • H0 错 → FE 一致、RE 不一致,差异显著
  • 统计量超阈值(或 p<αp<\alpha)→拒绝 H0→选 FE;否则选 RE(Hausman 1978)
7.7 模型选择总纲(p99)

选回归模型看两件事:①数据类型(面板 or 非面板)②因变量测量尺度(连续 or 离散)——连续非面板→Ch5 多元回归;离散→Ch6 Logit/Probit;面板→Ch7 FE/RE。参数分析始终遵循假设检验基本规则。

第 17 页

Ch8 研究设计 p99-113

Chapter 8 研究设计(p99-113)

8.1 总论(p99-101)
  • 研究设计=对研究全过程的综合规划(计划-实施-收集-分析);最常见载体=学术论文(p99-100)
  • 论文三大特性(p100-101)
    • Scientificity 科学性(前提):数据真实+术语规范+结构合范式
    • Innovation 创新性(核心):新理论/新视角/新现象/新数据;分 breakthrough 突破性 vs incremental 增量性——本科生做增量性
    • Theoretical nature 理论性:结果要理论解读→可推广结论;常见误区=只有数据模型没有理论
8.2 论文结构(p101-103)框架必背
第 18 页
  • 前置 Preliminary:标题(名词短语、含关键词)→ 作者+单位 → 摘要(核心论点/方法/发现)→ 关键词(3-8 个,名词)
  • 主体 Main Body:引言(问题+目的+文献综述+方法+概念)→ 正文论证(方法/结果/讨论)→ 结论(三件套)
  • 后置 Supplementary:附录(问卷/代码/原始表)→ 参考文献(GB/T 7714、APA、Chicago;文中引用与文末列表一一对应)→ 致谢
  • 结论三件套(p103):研究结论 + 政策建议 policy implications + 局限与未来方向 limitations & future research
  • 引言要素(p104):为什么值得研究(理由+意义)→文献综述(进展+空白)→本研究目标/范围/方法/预期贡献
  • 文献综述三大作用+特点(p104-105):作用=①助选题(识别 research gap)②为研究假设提供理论支撑(定量论文中综述与假设常一起呈现);特点=综合性 comprehensiveness、评述性 criticality(述+评结合)、前沿性 frontier
  • 研究方法部分(p106):关键=研究对象(依课题性质/可行性/效率界定)+样本(怎么抽、多大、什么结构)
  • 结果(p106):图表+文字呈现;定量定性整合分析;正文/表/图不重复
  • 讨论(p107):与已有文献比较→新结论;分析结果提新见解;评估意义价值创新;指出局限与未来
8.3 范文解读:垃圾分类政策试点扩散(p107-113)
第 19 页

公式速查 · 26 条

  • 出处:李欢欢、顾丽梅《中国行政管理》2020;235 个地级市、2000-2018(p107,p110)
  • 结构:引言→文献综述与研究假设→研究方法→实证结果→结论与未来研究(p108)
  • 三种逻辑、8 个假设(p108-109)需求驱动(H1a 经济发展水平+、H1b 人口密度+)/ 压力回应(H2a 上级政治压力+、H2b 同级政府采纳数+、H2c 公众舆论+)/ 效率导向(H3a 社会支持+、H3b 科技投入+、H3c 配套制度+)
  • 变量(p110):因变量=二元变量 0-1(当年是否实施垃圾分类)→用离散选择/面板模型
  • 结论(p112-113):人均 GDP、人口密度、上级压力、社会压力、人力资本、制度建设显著影响扩散;不同阶段/区域存在异质性;建议:回应治理需求、试点形成可复制可推广经验、纳入官员考核
  • 局限(p113):未涵盖全部因素(志愿组织、市场主体缺数据);未考虑交互效应;政策扩散测量待改进(象征性/表演性执行未讨论)

第三部分 公式速查表(考前过一遍)

第 20 页
#公式名称用途翻阅
1xˉ=ΣXi/n\bar{x}=\Sigma X_i/nsample mean样本均值p9
2s2=Σ(Xixˉ)2/(n1)s^2=\Sigma(X_i-\bar{x})^2/(n-1)σ2\sigma^2 除以 Nvariance方差(样本 n-1)p11
3s=s2s=\sqrt{s^2}standard deviation标准差p11
4CV=s/xˉ×100%CV=s/\bar{x}\times100\%coefficient of variation比较多组数据的相对离散度p12
5z=(xμ)/σz=(x-\mu)/\sigmastandard score正态→标准正态p16
6±1σ/2σ/3σ=68.27/95.45/99.73%\pm1\sigma/2\sigma/3\sigma=68.27/95.45/99.73\%3σ rule正态概率区间p16
7r=Σ(Xxˉ)(YYˉ)/Σ(Xxˉ)2Σ(YYˉ)2r=\Sigma(X-\bar{x})(Y-\bar{Y})/\sqrt{\Sigma(X-\bar{x})^2\Sigma(Y-\bar{Y})^2}sample corr coef样本相关系数p47
8t=rn2/1r2t(n2)t=r\sqrt{n-2}/\sqrt{1-r^2}\sim t(n-2)test of r相关系数检验p49
9Yi=α+βXi+εiY_i=\alpha+\beta X_i+\varepsilon_i(PRF);Y^i=a+bXi\hat{Y}_i=a+bX_i(SRF)reg functions总体/样本回归函数p50-51
10minRSS=Σ(YiY^i)2\min RSS=\Sigma(Y_i-\hat{Y}_i)^2\rightarrow 求导=0OLS最小二乘原理p53
11σ2=RSS/(n2)\sigma^2=RSS/(n-2)(简单);RSS/(nk)RSS/(n-k)(多元)unbiased est of σ2\sigma^2误差方差估计p56, p67
12TSS=ESS+RSSTSS=ESS+RSSR2=ESS/TSSR^2=ESS/TSSdecomposition拟合优度p56-57
13Rˉ2=1(1R2)(n1)/(nk)\bar{R}^2=1-(1-R^2)(n-1)/(n-k)adjusted R²跨模型比较p68
第 21 页
#公式名称用途翻阅
14t=(βjβj)/se(βj)t(nk)t=(\beta_j-\beta_j)/se(\beta_j)\sim t(n-k)t-test单个系数显著性p58, p69
15F=(ESS/(k1))/(RSS/(nk))F(k1,nk)F=(ESS/(k-1))/(RSS/(n-k))\sim F(k-1,n-k)F-test方程整体显著性p70
16b=(XX)1Xyb=(X'X)^{-1}X'ymatrix OLS多元回归系数p67
17ln[p/(1p)]=α+βX\ln[p/(1-p)]=\alpha+\beta Xlogit二元 Logit 线性形式p77
18OR=eβOR=e^\betaodds ratio优势比解释p79-80
19Pseudo-R2=1lnL1/lnL0R^2=1-\ln L_1/\ln L_0McFaddenLogit/Probit 拟合优度p81
20P(y=1X)=Φ(xβ)P(y=1\mid X)=\Phi(x'\beta)probit二元 Probit(Φ\Phi=标准正态分布 CDF)p82
21y=xβ+εy^*=x'\beta+\varepsilon + cut-offsordered model有序选择微观基础p85-86
22α\alpha(Cronbach)reliability信度p23
23CVR;χ2/df\chi^2/df;CFI;TLIvalidity indices效度指标p26
24z-score 标准化:(xμ)/σ(x-\mu)/\sigmastandardizationPCA 第一步p31
25dj=1ejd_j=1-e_jwj=dj/Σdjw_j=d_j/\Sigma d_jentropy weight熵权法p33, p35
26Hausman 统计量 χ2(K)\sim\chi^2(K)FE vs RE拒绝 H0 选 FEp98
Ch5 全部重要公式汇总考前最后翻p72-73
第 22 页

英文作答句型 · 直接套用

第四部分 英文答题弹药库(开卷英文作答直接套用)

以下句型全部源自讲义原文英文,考试可直接改写使用。背带标记的万能句。

Ch1-2 定义类
  • Quantitative research uses numbers and data to analyze and explain social phenomena, while qualitative research uses words and texts to describe and study events and social problems. (p1)
  • The four functions of quantitative methods: describe what has happened, explain why it happened, predict what may happen, and prescribe what to do. (p2)
  • The nominal scale can only distinguish categories and must satisfy exhaustiveness and mutual exclusivity. (p6)
  • The interval scale has no absolute zero, while the ratio scale requires a true absolute zero point. (p7)
  • The mean is affected by outliers, whereas the median and the mode are not. (p10)
  • The coefficient of variation measures the relative degree of dispersion and is used to compare the dispersion of multiple sets of data. (p12)
  • The normal distribution curve is symmetric about x=μx=\mu, attains its maximum at x=μx=\mu, has two inflection points at μ±σ\mu\pm\sigma, and takes the x-axis as its asymptote. μ\mu determines the position and σ\sigma determines the shape. (p14-15)
  • As the degrees of freedom approach infinity, the t-distribution converges to the standard normal distribution; when df>30, it is very close to N(0,1). (p16-17)
Ch3 信度效度/数据类
第 23 页
  • Reliability refers to the degree of consistency of results obtained when the same method is repeatedly applied to the same object. (p23)
  • Validity denotes the degree to which a measurement tool can accurately capture the desired variable. (p24)
  • Validity encompasses content validity, construct validity, and criterion validity. (p25)
  • For Cronbach’s α\alpha: α>0.7\alpha>0.7 indicates good reliability, α>0.8\alpha>0.8 excellent, and α>0.9\alpha>0.9 very high. (p23)
  • PCA transforms multiple correlated variables into a smaller set of uncorrelated principal components through linear combinations. (p29)
  • When missing values are random and the proportion is low (less than 5%), direct deletion is a straightforward approach. (p28)
Ch4 假设检验类
  • Hypothesis testing adopts proof by contradiction, and its rationality is based on the principle of small probability events. (p38)
  • Steps: (1) state H0 and H1; (2) select a test statistic; (3) determine the rejection region at the given α\alpha; (4) calculate the observed value and compare; (5) make a statistical decision. (p39)
  • If the test statistic falls within the rejection region, a small-probability event has occurred and H0 should be rejected. (p41)
  • If there is no prior knowledge of direction and the purpose is to examine whether a significant difference exists, a two-tailed test should be selected. (p43)
Ch5 回归类
第 24 页
  • The purpose of regression analysis is to estimate the mean of the dependent variable using fixed independent variables. (p50)
  • The OLS estimator is the Best Linear Unbiased Estimator (BLUE) according to the Gauss-Markov theorem. (p55)
  • The correlation coefficient only reflects linear correlation and cannot determine causal relationships. (p48)
  • R2R^2 shows that X% of the variation in the dependent variable can be explained by the independent variable(s).(仿 p61)
  • The adjusted R2R^2 introduces a trade-off between explanatory power and parsimony by incorporating k. (p69)
  • If the p-value is less than the significance level α\alpha, we reject the null hypothesis. (p59)
  • The F-test examines whether multiple variables collectively exert a significant effect on the dependent variable, based on ANOVA. (p70)
  • The ice-cream/drowning example represents a spurious relationship because both variables depend on temperature. (p64)
Ch6 离散选择类
第 25 页
  • The conventional linear regression model cannot ensure that the predicted value of y lies within (0,1)(0,1); therefore a logistic model is adopted. (p75)
  • The regression coefficient β\beta represents the change in ln(p/(1p))\ln(p/(1-p)) caused by a one-unit change in the given independent variable, holding others constant. (p78)
  • When β>0\beta>0, the odds ratio eβ>1e^\beta>1, indicating a positive effect on the occurrence of the event. (p80)
  • Parameters are estimated by Maximum Likelihood Estimation (MLE), which finds the optimal parameters that maximize the probability of the observed sample. (p77)
  • The binary probit model relies on the cumulative distribution function Φ\Phi of the standard normal distribution and is less interpretable than logit. (p82)
Ch7 面板类
第 26 页

辨析题高发区 · 19 组

  • Panel data helps address the omitted variable problem caused by unobservable, time-invariant individual heterogeneity. (p88)
  • If the individual effect uiu_i is correlated with any explanatory variable, the fixed-effects model should be used; if uncorrelated, the random-effects model applies. (p91)
  • In LSDV, only n-1 dummy variables can be included; otherwise perfect collinearity arises. (p92)
  • The within-group estimator cannot estimate the effects of time-invariant variables, and clustered standard errors should be used due to within-group autocorrelation. (p93-94)
  • Hausman test: H0 states that uiu_i is uncorrelated with the explanatory variables (RE is better). If H0 is rejected, choose the fixed-effects model; otherwise choose random effects. (p97-98)
Ch8 论文写作类
  • A complete conclusion typically includes research conclusions, policy recommendations, and limitations with future research directions. (p103)
  • The literature review facilitates topic selection by identifying research gaps, and provides theoretical support for the proposed hypotheses. (p104-105)
  • Its characteristics are comprehensiveness, criticality (combining description and comment), and frontier orientation. (p105)
  • Innovation falls into breakthrough and incremental types; undergraduates are advised to pursue incremental contributions. (p100-101)

第五部分 跨章对比表(论述/辨析题高发区)

第 27 页
对比组核心区别一句话翻阅
Qual vs Quant vs Mixed文字 vs 数字 vs 结合p1
Nominal/Ordinal/Interval/Ratio分类→排序→差值→比值(绝对零点),层级递增p6-7
Cross-sectional / Time series / Panel一时点多个体 / 一个体多时点 / 多体多点p8, p87
Mean vs Median vs Mode受不受 outlier;适用什么尺度p9-10
Variance vs SD vs CV平方单位 / 同量纲 / 相对(跨量纲可比)p11-12
Normal vs t distt 尾更厚;df>30≈正态;小样本用 tp16-17
Reliability vs Validity稳不稳(一致)vs 准不准(测到目标)p23-27
α\alpha vs p-valueα\alpha 事先定的标准;p 算出来的概率;p<α\alpha 拒绝 H0p38, p59
One-tailed vs Two-tailed有无方向先验;拒绝域一尾还是两尾p42-43
ρ\rho vs r总体常数 vs 样本随机变量p46-47
Corr vs Regression对称只看线性关联 vs 不对称估计均值/可预测;都不能直接=因果p48, p50
R² vs Adjusted R² vs Pseudo-R²只增不减 / 惩罚 k 可跨模型比 / 似然构造(Logit)p68, p81
t-test vs F-test(回归)单个系数 βj=0\beta_j=0 / 全部系数联合=0p69-70
OLS vs MLE最小化残差平方和(线性模型)/ 最大化似然(Logit/Probit)p53, p77
第 28 页
对比组核心区别一句话翻阅
Logit vs Probitlogistic 分布 S 曲线 / 正态 CDF Φ\Phi;Logit 更好解释更常用p76-77, p82
Pooled vs FE vs RE忽略异质性 / uiu_i 与 X 相关 / uiu_i 与 X 不相关p89-91
LSDV vs Within vs FD加 n-1 个 dummy / 减组均值 / 减上一期;都不能估时不变变量(后两者)p91-95
FE vs RE 选择Hausman:拒绝 H0→FE,不拒绝→RE(RE 更有效)p97-98
Consistent vs Unbiased vs Efficient大样本收敛真值 / 期望=真值 / 方差最小p55, p89, p95
第 29 页

检索三步法 + 必背 5 件事

第六部分 开卷考场策略 + 考前节奏

考场检索三步法
  1. 审题抓关键词 → 判断属于哪章(用第一部分总图:因变量连续→Ch5;0/1 分类→Ch6;面板→Ch7;问信度效度→Ch3;问检验步骤→Ch4;问论文结构→Ch8)
  2. 翻本提纲第二部分找到对应节的 PDF 页码 → 直接翻 PDF 抄原文英文(第四部分弹药库有现成句型的先用句型)
  3. 答题格式:定义题=英文定义句+一个例子;步骤题=编号 1-5 步(Ch4 五步/p39、OLS 四步、PCA 五步/p30、熵权法五步/p32);辨析题=用第五部分对比表“一句话区别+各自适用场景”
必背到“不用翻书”的 5 件事(其余都允许翻)
  1. 假设检验五步流程 + α\alpha 常用值(p38-39)
  2. 回归五大假设 + BLUE(p51, p55)
  3. FE vs RE 判据 + Hausman 逻辑(p91, p97-98)
  4. Logit 系数解释 + OR 三种符号情形(p78-81)
  5. 论文结构树 + 结论三件套(p101-103)
考前节奏(今天起)
  • D-3~D-2 系统过:每天 2-3 章,用本提纲“关键词→页码”演练翻书速度;重点章 Ch4/5/6/7 各留 40 分钟
  • D-1 冲刺:只过标记 + 第三部分公式表 + 第五部分对比表;给 PDF 贴上章节便签(p6/p17/p35/p43/p73/p87/p99 七个分界页)
  • 考试当天:进场先在草稿纸默写“必背 5 件事”,之后全程按三步法检索;不确定的题先写弹药库句型占位,再翻书补细节

诚实提醒:本提纲的页码基于你上传的 PDF(113 页)逐页核对生成;若老师另发新版讲义,页码可能偏移,届时以标题关键词检索为准。

第 30 页
返回首页返回「脑图集」