自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+

Stata连享会

连玉君老师团队 - 主页 lianxh.cn

  • 博客(1647)
  • 资源 (1)
  • 收藏
  • 关注

转载 AI 我知道-07:知识图谱如何用于研究?工具、提示词与工作流

本文探讨如何利用知识卡片与知识图谱提升AI辅助文献综述的效率与可复用性。针对传统Agent处理文献时重复核验、信息碎片化等问题,提出将论文拆分为包含研究命题、来源、页码及核验状态的知识卡片,并在需要跨论文比较、多跳查询时构建关系网络——研究知识图谱。文章区分了卡片与图谱的适用场景,强调图谱在复杂研究任务中的优势,并提供从卡片到图谱的工作流、提示词模板及工具推荐(如Neo4j、GraphRAG、OpenAlex),助力研究者实现可查询、可核验的智能文献管理。

2026-09-10 09:00:00 11

转载 分仓回归和推断:binsreg 的 Stata、R 与 Python 实现

本文介绍binsreg方法体系及其Stata、R和Python实现。与传统binscatter仅绘图不同,binsreg提供分箱选择、曲线估计、置信带、函数检验和组间比较的完整工具链,支持协变量调整及非线性扩展,适合实证研究中的非参数分析与可视化。

2026-09-09 09:00:00 9

转载 从美欧调查看「AI 采用」的测量、组织扩散与因果识别

<think>我们根据用户提供的文本生成一篇≤150字的文章摘要。用户给出的内容是关于AI采用测量的论文介绍,要求生成摘要。需要提炼核心:测量差异、组织扩散、因果识别、跨国数据43% vs 32%等。摘要需简洁,不超过150字。我们写一段或几句。注意:要概括要点,避免细节。</think>摘要:Bickel等通过美欧工人与企业调查发现,美国43%、欧洲六国平均32%的工人使用生成式AI,但这并非简单排名。文章强调应区分AI暴露、实际采用、使用强度与流程嵌入。测量口径(工人自报、企业问

2026-09-09 09:00:00 13

转载 AI Agent 到底是什么?一次理清 LLM、Chatbot、Workflow 与 Agentic

本文通过代码修正案例,区分了LLM、Chatbot、Workflow与Agent:模型是决策部件,对话应用强调交互,预编排流程由程序控制步骤,而Agent则由模型动态安排操作并调用工具,同时受权限约束。文章旨在厘清术语,帮助准确描述AI系统。

2026-09-09 09:00:00 13

转载 AI 怎样把文本材料变成研究数据?从历史报纸到实证分析

本文将文本材料转化为研究数据的流程拆解为:先确认材料能否回答研究问题,再将概念写成清晰的标注规则,最后借助Codex执行批量标注。强调研究者须区分“使用证据”与“真实状态”,做好人工验证和误差评估,才能构造可信变量。

2026-09-08 08:44:51 12

转载 SBW:稳定平衡权重法如何提高随机实验的估计精度?

本文介绍稳定平衡权重法(SBW)如何通过协变量加权提高随机实验的估计精度。该方法可同时改善均值差、率比、Mann–Whitney等指标的估计,强调权重稳定性,并与回归、熵平衡比较,适用于多效应指标报告场景。

2026-09-08 08:42:37 15

转载 文生图很烧 Tokens 吗?科研配图的选择逻辑

文生图成本不仅关乎Tokens,更在于工具选择。核心逻辑:场景和隐喻用文生图,关系流程用矢量工具,数据结果用代码,文字公式用排版软件。正确划分工具边界能减少返工,才是真正的节省额度之道。

2026-09-07 09:00:00 17

转载 文本转成 Embedding 后,还能直接拿来做因果推断吗?

文本嵌入可用于聚类,但作为因果推断的控制变量需谨慎:须保证嵌入保留了与处理、结果同时相关的主题结构,否则降维已丢失混淆信息,后续灵活模型无法补救。

2026-09-07 09:00:00 14

转载 wbopendata:从Stata中获取世界银行70多国2000多个指标

本文介绍Stata命令wbopendata,它通过World Bank API获取71个数据库、2万余项指标和296个国家(地区)数据,支持长/宽格式、多国多指标下载及对话框操作。文章说明安装语法、五种下载模式,并演示中国全指标、主题下载、全球人均GDP及金砖五国趋势绘图案例。

2026-09-07 09:00:00 20

转载 遗漏变量敏感性分析:为什么系数可能先“变号”而不是“归零”?

遗漏变量敏感性分析中,仅关注“系数归零”可能不足,因为系数可能先变号。Masten和Poirier(2026)证明,在Oster框架下符号反转临界点总≤1,即不可观测选择与可观测同级时方向

2026-09-06 22:10:44 18

转载 AI 参与金融决策,为什么不能只看准确率?

金融AI决策不能只看平均准确率,还需关注结果稳定性、理由一致性与可审计性。综述区分计算确定性、可复现性、可审计性,指出表格模型、图神经网络与LLM各有漂移来源;近似解释、训练扰动与并行配置均可能导致个案

2026-09-06 22:05:10 13

转载 Logit + XGBoost:一种可解释的混合信用评分模型

本文介绍一种混合信用评分模型:Logit构建透明主体,XGBoost学习其残差,并用可解释比例衡量每笔预测的透明程度。模型在接近XGBoost性能的同时支持逐笔审计,且能识别更易被送入黑箱的群体,兼顾预测精度与监管解释需求。

2026-09-06 22:02:20 10

转载 ReproAI-下:Stata 复现包实测——ReproAI 能找到漏洞吗?

含10项预设缺陷的Stata复现包进行受控实测,ReproAI在8项核心缺陷中仅检出4项,且未自动修复。它擅长发现硬编码路径、缺失脚本、无随机种子等问题,但遗漏样本静默缩减、输出目录、文档缺失等盲区,提示静态检查的局限性。

2026-09-04 09:00:00 19

转载 加入年份固定效应以后,宏观共同冲击真的被控制了吗?(上):从扰动项到异质暴露

年份固定效应只能吸收对所有单位同质的年度加性冲击,无法自动控制企业暴露度不同导致的异质影响。异质共同冲击的残余部分进入扰动项,造成遗漏变量偏误;须借助行业×年份固定效应、交互固定效应或共同相关效应等方法处理。

2026-09-04 09:00:00 24

转载 女性 CEO 为何这么少?顶刊论文构造识别策略的思路

He 和 Whited(2026)在 RFS 发文研究女性 CEO 占比低。为避免简单归因于董事会偏见,作者重建 CEO 候选人池,并用结构模型区分三种机制:生产率差异、搜寻摩擦和董事会偏好。识别上,分别借助企业规模变化、候选池性别结构变化及控制两者后的剩余水平差,将不同机制分离开来。

2026-09-04 09:00:00 12

转载 招聘数据如何获取?数据来源、去重与字段清洗

本文聚焦在线招聘广告数据的获取与整理,强调必须区分广告、空缺与录用,并区分新发布流量与在招存量。去重与标准化决定样本含义,职位标题、要求、技能和任务不可混用。以Chen et al.处理7.5亿条中国平台广告为例,说明数据样本受平台范围与规则限定的重要性。

2026-09-02 10:34:03 22

转载 我会 AI,为什么还拿不到实习?

<think>我们只需要根据内容生成摘要,不超过150字。内容是讲AI时代求职,项目经历比工具清单重要,需要可复现、可核验的项目作品,以及沟通、理解问题等能力。摘要要简洁。</think>AI时代求职,光会工具不够,关键在于能独立推进可核验的项目。招聘者看重项目经历和可复现能力,而非技能列表。实习生需学会明确问题、留痕过程、检验结果、有效汇报,并善用AI拆解任务,才能赢得信任。

2026-09-01 09:00:00 17

转载 如何用 AI-Agent 把分析项目推送到 GitHub 仓库?

<think>我们根据用户要求,基于给定内容生成≤150字的文章摘要。摘要需涵盖核心要点:AI-Agent将本地项目推送到GitHub,包括概念、三件事、文件边界和流程。语言简洁。</think>利用AI-Agent安全推送本地分析项目至GitHub:只需明确本地路径、账号和仓库名,并授权Agent检查与登录。Agent可自动处理边界划分、敏感信息扫描、提交说明等固定检查。文章强调.gitignore的局限、私有仓库非保险箱,并给出完整操作流程与可复用Skill。

2026-09-01 09:00:00 17

转载 LLM 文本标注成本降 80%:一次放几条、一次问几个变量?

该文用 8 个商业模型对 3962 条带专家标签的推文做了 96 万余次分类,系统检验了两个几乎每个 LLM 标注项目都要面对、却极少被讨论的实施选择:文本批量处理 (item batching):一次调用里放多少条文本;变量堆叠 (variable stacking):一次调用里同时问多少个变量。

2026-08-30 08:31:04 38

转载 平行趋势不成立怎么办?用 DiDwb、MDiD 和 RD 重新识别政策效果

本文介绍原文的主要研究问题、数据来源、识别策略和主要结论,并重点讨论在平行趋势假设失效时,如何使用 DiDwb、MDiD 和 RD 修正 DID 偏误。论文的复现数据和代码可在 OpenICPSR 获取。

2026-08-30 08:26:07 26

转载 AI 我知道-06:为什么 AI 越聊越乱?上下文腐烂与论文协作工作流

​本文是「AI我知道」系列推文的第一篇,面向经管、金融、社会学领域的研究者和学生。我们的目标不是把你训练成 AI 工程师,而是帮你建立足够扎实的概念框架,让你能更聪明地使用这些工具,并在研究和工作中做出有依据的判断。​

2026-08-30 08:22:57 25

转载 WorkBuddy 接入 Stata MCP:从文献整理到直接跑回归

让 AI 写一段 Stata 代码并不难,麻烦的是后面的循环:复制代码、切换窗口、运行命令、查看报错,再把日志贴回对话框。WorkBuddy 是腾讯推出的全场景 AI 智能体桌面工作台,可以在授权范围内读取本地文件、执行任务并交付文档、表格和代码。本文以经济学实证研究为主线,说明如何用 WorkBuddy 整理文献、审核数据,并通过 Stata MCP 建立「生成代码—调用 Stata—读取日志—返回结果」的执行链路。文中信息截至 2026 年 8 月,界面和功能如有变化,请以官方文档为准。

2026-08-24 16:22:54 129 1

转载 AI 跑出的 DID 很显著,可信吗?用 causal-did 加一道识别防线

本文要介绍的 causal-did,就是给这种工作方式加一道规则边界。它出自 Robson Tigre 维护的 GitHub 仓库 everyday-causal-skills。causal-did 既不是新估计量,也不是新的统计包,而是一份写给 Agent 看的工作规范:先把处理、结果、处理时点和目标参数定义清楚,再查识别假设和数据结构;按单一时点还是交错实施来选估计量;看到真实运行结果之后才解释系数;识别出严重问题时,要么警告,要么停止因果表述。

2026-08-24 16:19:16 28

转载 Skills、MCP、A2A、ARD:科研 Agent 到底该用哪些?

本文探讨了科研Agent中四个关键概念(Skills、MCP、A2A、ARD)的区别与应用。作者指出这些并非必须全部安装的组件,而是针对不同需求的解决方案:Skills用于保存方法流程,MCP连接外部环境,A2A协调多Agent协作,ARD则帮助发现所需能力。文章以文献核验任务为例,详细说明了各模块的作用场景,并提供了具体实现方法,强调应根据实际任务需求选择性使用这些功能。最后介绍了科研领域已有的MCP项目及其应用场景。

2026-08-22 16:44:13 24

转载 从 reghdfe 到 PyFixest:Python 高维固定效应与 DID 快速上手

若页面不能正常显示和代码,请获得更好的阅读体验。:郭皑馨 (华南理工大学)reghdfefixest如果你在 Stata 中习惯了reghdfe,转到 Python 后最麻烦的往往不是不会做回归,而是同一个模型要拆成数据处理、虚拟变量、协方差设定和结果输出等多段代码。fixest的公式很紧凑,换到 Python 后却未必能找到完全对应的写法。PyFixest 解决的正是这个问题。它借鉴 R 语言fixest。

2026-08-20 13:44:41 57

转载 万能提示词真的存在吗?五份 Prompting Science Report 的实证检验

【摘要】沃顿商学院Generative AI Labs的五份Prompting Science Report研究表明,不存在跨模型、跨任务通用的"万能提示词"。实证发现:(1)礼貌用语对准确率无稳定影响;(2)思维链提示(CoT)对非推理模型效果有限,且会降低可靠性;(3)输出格式约束能减少歧义但不保证准确率提升;(4)模型表现高度依赖评价标准。研究建议根据具体任务需求设计提示,优先明确任务定义和输出格式,而非依赖流行技巧。这些发现对提示工程实践具有重要指导意义。

2026-08-20 13:34:39 21

转载 SNAP07-手动计算:社会网络分析中的密度、距离与聚集系数

本文通过三张小网络实例,手把手计算了社会网络分析中的核心结构指标。文章以6位老师的合作为例,构造了环形、双三角和桥接三种网络结构,逐一计算并对比了网络密度、连通分量、平均路径长度、直径、全局效率、聚集系数和全局传递性等指标。研究发现:(1)边数相同的网络可能具有完全不同的连通性和聚集性;(2)仅增加一条边就可能显著改变整体网络结构;(3)密度指标无法识别边的结构分布差异。文章不仅提供了详细的手算过程,还通过Python代码验证了计算结果,揭示了网络结构分析的复杂性,为初学者理解社会网络基本概念提供了直观案例

2026-08-17 10:14:45 22

转载 SNAP08-社会网络中的「圈子」是怎样识别出来的?

本文介绍了社会网络分析中的社群发现方法,重点讲解了模块度指标及其应用。通过一个5节点网络的示例,作者逐步演示了如何手工计算模块度,并对比了4种不同的社群划分方案。文章还以Zachary空手道俱乐部网络为例,展示了如何使用Python实现社群发现算法。核心内容包括:(1)社群发现的目标是识别网络中内部连接紧密、外部连接稀疏的群体;(2)模块度通过比较实际连接与随机预期来评估划分质量;(3)标准模块度采用允许自环和重边的期望矩阵;(4)文章提供了详细的计算过程和软件实现,所有数字均可手工验证。

2026-08-17 10:11:26 19

转载 Claude Code Hooks-钩子:怎么配,如何迁移到 Codex?

摘要: 本文探讨了ClaudeCode Hooks的配置与迁移问题,分析了Hooks的核心机制与适用场景。Hooks作为事件驱动的自动化工具,通过事件触发、条件匹配和处理器执行三个环节,解决科研工作流中必须稳定执行的机械操作问题(如自动格式化、权限拦截、任务通知等),与CLAUDE.md的项目说明和Skills的任务流程形成互补。文章建议用户优先配置高频低风险场景(如修改后检查、敏感路径拦截等),并提供了基础JSON配置示例。对于Codex用户,文中虽未直接说明迁移方案,但通过对比机制差异,间接提示需关注事

2026-08-17 10:08:42 25

转载 如何发现因果关系?基于causal-learn的因果推理

本文介绍了基于Python的开源因果发现工具包causal-learn,它集成了多种因果发现算法,便于在机器学习流程中使用。causal-learn支持基于约束的方法(如PC、FCI、CD-NOD算法)和基于评分的方法,可从观测数据中学习变量间的因果结构。这些方法适用于广告投放、医疗分析等需要因果推理的场景,为后续干预分析提供基础。相比跨语言工具,causal-learn完全基于Python开发,更易与机器学习代码整合。文章还提供了安装方法和代码示例,说明如何应用不同算法进行因果发现。

2026-08-17 10:05:29 32

转载 手动计算:社会网络分析「中心性指标」没那么难

摘要: 本文通过一个11人合作网络的例子,手动计算了四种中心性指标(度中心性、中介中心性、接近中心性和特征向量中心性),阐释了它们的不同含义。结果表明,不同指标可能选出不同的“核心节点”,反映了网络位置的不同维度:直接连接数量(度)、跨群体最短路径控制(中介)、全局距离效率(接近)以及邻居质量(特征向量)。文章强调中心性并非单一概念,而是对应不同的研究机制,需根据具体问题(如资源流动、传播效率或圈层声望)选择合适的指标。计算过程揭示了指标对网络结构的敏感性,例如中介中心性可能因新增边而大幅变动。最后提醒,网

2026-08-15 09:00:00 39

转载 SNAP04-社会网络分析:经典与前沿文献地图

本文系统梳理了社会网络分析在经济学领域的研究脉络与发展方向。首先,作者通过六条经典研究脉络建立坐标系:网络的经济学基础、信息与弱关系理论、同伴效应识别、生产网络传导机制、金融网络系统性风险以及公司治理中的关系网络。随后重点聚焦近五年的前沿研究方向,包括网络计量的识别问题、内生生产网络重组、干扰下的因果推断、AI与文本构建网络、高阶动态网络分析,以及中国情境下的研究机会。文章特别强调,当前研究正从静态网络分析转向动态网络重组研究,从预设网络结构转向数据驱动网络识别,从手工构网转向自动化文本挖掘。文末提供了丰富

2026-08-15 09:00:00 28

转载 Stata新命令moransi:空间自相关分析的理论与实操

本文介绍了Stata新命令moransi在空间自相关分析中的应用。该命令可用于计算全局和局部Moran's I指数,通过内部构造距离型空间权重矩阵来分析空间依赖性和局部异常。文章详细阐述了空间权重矩阵的构建方法(包括幂函数、指数、二值和k最近邻四种类型)、Moran's I统计量的计算方法及其统计含义,并提供了安装指南和数据下载建议。文中强调,显著的空间自相关结果并不等同于因果溢出效应,研究者需要谨慎解释分析结果。该命令特别适合初步探索数据空间模式,为后续更复杂的空间计量分析提供参考依据。

2026-08-10 09:00:00 34

转载 扰动项知多少(3):如果污染具有稳定结构,面板模型能分离什么?

本文是「扰动项知多少」系列的第三篇,主要讨论面板数据如何通过固定效应模型处理扰动项中的稳定结构。文章指出,固定效应的核心价值在于改变比较方式——从不同个体间的比较转向同一个体内部的跨期变化比较,从而分离出稳定的个体差异和共同时间冲击。个体固定效应通过吸收所有以加法形式存在且不随时间变化的遗漏因素(如土壤质量、管理能力等),避免了这些因素对核心解释变量系数的污染。不过,这种处理存在两个边界:一是无法吸收随时间变化的因素,二是无法处理非加法形式的异质反应。文章还强调,固定效应虽然能减少遗漏变量偏误,但并不保证估

2026-08-10 09:00:00 26

转载 扰动项知多少(2):扰动项什么时候会污染 β?

摘要 本文探讨了扰动项在回归分析中的作用及其对系数估计的影响。文章指出,遗漏变量并不必然导致偏误,关键在于该变量是否与核心解释变量存在条件相关性。偏误方向取决于遗漏变量对结果的影响及其与解释变量的关联方式。实际分析中,真正相关的是控制协变量后的剩余相关性。作者强调,控制变量的选择应基于其在数据生成过程中的因果角色,而非单纯提高模型拟合度。混杂因素必须控制,而仅影响结果波动的变量则可选。研究结论的稳健性取决于核心变量与扰动项的系统性关联是否被消除。

2026-08-10 09:00:00 23

转载 扰动项知多少(4):同一冲击影响各异,模型如何拆解?

本文探讨了面板数据模型中扰动项的异质性问题。文章指出,双向固定效应模型假设共同冲击对所有个体影响相同,但现实中同一冲击对不同个体的影响强度往往不同。作者通过三家企业受利率冲击的案例说明,当冲击影响存在异质性时,双向固定效应无法完全吸收扰动项中的交互效应,可能导致估计偏差。文章建议,若研究者能观察冲击和传导机制,应直接构建"事前暴露度×冲击"交互项;若不可观测,则可采用交互固定效应或共同相关效应模型来捕捉扰动项的低秩结构。全文通过微型数据示例,深入浅出地解释了技术公式背后的经济学含义。

2026-08-10 09:00:00 40

转载 30 个常用 Agent Skills:经管社科用户分类指南

本文为经管社科用户精选了30个实用的AgentSkills,涵盖学术研究、数据处理和文档管理等场景。文章首先介绍了skills.sh网站的功能和使用方法,强调应根据实际需求选择技能而非盲目安装。随后将技能分类为PDF处理、Excel操作、Jupyter Notebook、论文复现、网页采集和学术写作等类别,并提供了具体安装命令和使用建议。作者特别提醒用户注意技能的安全审计状态,建议通过终端执行安装,并区分项目级和全局安装。最后指出这些推荐基于2026年7月的数据,排名和功能可能随时间变化。全文为经管社科研究

2026-08-10 09:00:00 25

转载 省级聚类以后,空间相关就解决了吗?Conley标准误详解

本文探讨了省级聚类标准误在处理空间相关性时的局限性,并详细介绍了Conley标准误的原理和应用。主要内容包括: 指出省级聚类标准误的强假设:认为不同省份间的误差完全不相关,而同一省份内误差可任意相关,这可能与经济现实不符。 分析了省级聚类不适用的场景:如环境污染、交通网络、产业链等经济活动往往跨越行政边界,空间相关性应随距离连续变化。 系统阐述了Conley标准误的理论基础:通过地理或经济距离定义加权核函数,允许误差相关性随距离递减,更符合经济活动空间依赖的特征。 对比了不同类型标准误的数学表达:包括Whi

2026-08-08 23:11:56 29

转载 一套Skills,多Agent共享:Claude Code、Codex 统一管理方案

本文探讨了如何统一管理ClaudeCode、Codex等不同AI Agent的Skills,避免重复维护和版本分叉问题。文章提出建立一个公共Skills库作为唯一权威源,同时为每个Agent创建轻量级调用入口的方案。作者详细介绍了针对新用户和老用户的两类实施方案,分析了Skills格式的统一趋势与管理挑战,并给出了目录结构设计的建议,强调"一个公共库,多个调用入口"的核心原则。文中还提供了迁移流程建议和长期管理策略,帮助用户实现跨Agent的Skills统一管理。读者可下载附件并按指引完

2026-08-07 09:44:23 62

转载 多个 AI 来回挑毛病,论文就会更好吗?基于 44 篇经济学论文的对比结果

摘要:Havránek和Iršová(2026)比较了三种AI论文检查方法:单模型检查(singlepass)、多模型互相质疑(mad-research)和多Agent分工讨论(paper-workshop)。结果显示,尽管多Agent方案消耗更多计算资源(token量高达单模型的9-30倍),但55%的论文作者更认可单模型生成的简洁报告。研究发现,多模型协作虽能增加问题数量,却可能导致背景信息丢失和误报率上升,反而降低实用性。这表明,在论文修改中,质量而非数量才是关键,复杂流程未必带来更好的改进效果。(1

2026-08-07 09:38:30 38

Stata101:人手一份的入门指南-连玉君

花了几天的时间,用 Markdown - Marp 做了一份幻灯片,介绍了 Stata 的基本操作,以及常用资源和链接。 这不是一份操作指南,而是一份地图,方便各位在需要的时候查阅。 封面图片是动画片「极速蜗牛」的剧照,我很喜欢这只蜗牛的励志故事。

2024-09-20

profile.do

连玉君的 profile.do 文件。下载后放置于 stata 安装目录根目录下,重启后生效。 可以通过 dofile editor 打开后按照自己的需要进行修改。

2017-09-10

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除