- 博客(1674)
- 资源 (1)
- 收藏
- 关注
转载 QSM 怎么学?从读懂模型到复现论文,再到自己的研究
本文系统梳理了数量空间模型(QSM)的学习路径,从理解框架、跑通模型到复现论文与开展原创研究。建议按“理解→实践→扩展→创新”顺序推进:优先阅读Allen & Arkolakis(2023)、Redding & Rossi-Hansberg(2017)等综述建立模型地图;通过Ahlfeldt课程及AB2022 toolkits等工具包动手实践,掌握数据、参数、均衡求解与反事实分析的联动机制;再结合研究方向选择专题论文,逐步深入。重点在于打通“数据→基本面反演→均衡求解→政策模拟”的逻辑链条,
2026-10-07 10:17:58
6
转载 一文读懂 QSM:一个地方的变化如何影响其他地区?
本文介绍了定量空间模型(QSM)的基本概念、核心逻辑及其在分析空间政策影响中的应用,重点说明了一个地方的变化如何通过迁移、通勤、贸易和企业网络影响其他地区,最终形成新的空间均衡。
2026-10-07 10:14:22
8
转载 对话式调查:AI 时代问卷调查研究的新模式
本文介绍对话式调查作为AI时代问卷研究的新模式,通过自适应追问与自然语言处理,实现从“填选项”到“讲经历”的转变。该模式能动态捕捉受访者真实经历,提升对复杂行为与心理过程的测量深度,同时引入结构化编码、随机验证与复现机制,保障数据质量。文章结合最新研究,提供可复用的开源资源,推动社会科学研究方法革新。
2026-10-06 09:00:00
11
转载 从 DID 到 QSM:柏林墙研究如何连接因果识别与空间均衡
本文讨论了在完成 DID 分析之后,如何利用 QSM(定量空间模型)进一步推进机制分析。通过柏林墙的历史案例,说明了单纯的处理效应无法揭示复杂的经济机制,而 QSM 可以通过明确经济主体的决策行为及其相互作用,揭示政策冲击背后的深层次机制。
2026-10-06 09:00:00
10
转载 figures4papers:借助 AI Agent 绘制科研图
本文介绍如何利用开源项目figures4papers与AIAgent高效绘制科研图表,提升绘图一致性与质量。通过提供参考图、源代码、设计规范及统计含义,结合ChatGPT、Claude或Codex等AI工具,可自动生成符合论文标准的事件研究图与异质性系数图。强调绘图前需明确格式要求,避免仅依赖AI“美化”导致的格式不一致或统计误读。项目支持本地引用,便于版本控制与规范复用,显著降低科研绘图门槛。
2026-10-05 18:53:40
18
转载 Stata 调用大模型:用 `catllm` 完成文本分类与主题发现
本文介绍Stata命令catllm,用于调用大语言模型实现文本分类与主题发现。该工具可批量编码开放式问卷回答,支持按预设规则分类(classify)或提取候选主题(extract),并生成可分析的0/1变量。文章演示安装配置流程,强调需正确设置Stata与Python环境及API密钥,并建议通过人工验证确保结果可靠性。适用于社科研究中高效处理文本数据。
2026-10-05 18:49:30
8
转载 别急着做 DID (下):让 AI 做你的政策分析「虚拟导师」
本文提出“虚拟导师”模式,倡导将AI从被动执行者转为主动追问者,以提升政策评估研究设计质量。作者建议研究者先提交政策背景、数据条件等材料,让AI主动追问识别策略、反事实假设、机制与数据匹配性等问题,推动研究思路逐步清晰化。相比直接指令式提问(如“帮我做DID”),该模式更契合研究初期的探索性特征,有助于发现潜在偏误、优化识别方案,实现从“外行指挥内行”到“协同构建严谨设计”的转变。
2026-10-04 16:22:39
11
转载 别急着做 DID(上):先把政策背景搞清楚
政策评价研究应先厘清政策背景,而非急于套用DID等模型。处理组形成、识别假设是否成立,均依赖对政策制定动因、执行机制、作用对象、预期路径及潜在偏差的深入理解。唯有掌握制度细节,才能设计出可信的反事实,实现“量身定制”的因果识别。
2026-10-04 16:20:00
10
转载 Jev:快速、低成本的语义判断,用于 Agent 分流与文本分析
Jev是一款快速、低成本的语义判断工具,专为Agent工作流中的频繁决策优化而设计。它通过结构化接口(如概率评分)高效响应“是否符合标准”“下一步该做什么”等判断,显著减少串行等待时间。在文献筛选等任务中,可并行评估研究对象、数据来源、主题相关性等条件,实现精准分流与材料筛选。结合领域微调与开源模型(如GLiNER2),Jev助力构建可复用的文本分析测量体系,提升Agent整体效率。
2026-10-04 09:00:00
16
转载 greCAPTCHA:测测作者是否真的懂自己的论文
greCAPTCHA是一套基于AI的论文作者理解能力核验框架,通过分析论文与作者贡献声明,自动生成针对性问题,限时考核作者对研究设计、方法选择及边界条件的理解。实验显示,其核心题型(如“未明示理由”“背景知识”)能有效区分真实作者与外行,AUC达0.825和0.798,显著优于仅考察记忆的事实类题目(AUC=0.595)。该系统强调“核验能力”,即理解为何采用特定方法及结论适用条件,适用于课程考核、论文指导与投稿前自检,助力应对生成式AI带来的学术诚信挑战。
2026-10-03 07:16:42
13
转载 LLM 前视偏差:回测的高准确率可信吗?三种检查方法
本文探讨大模型在历史回测中因“前视偏差”导致预测准确率虚高的问题,提出三种检测方法:(1)仅提供公司名与日期,检验模型是否依赖事后信息;(2)对公告进行匿名化处理,评估身份识别的影响;(3)使用训练截止日后事件测试模型真实预测能力。基于DeepSeek对1,223份美国财报的实验发现,未提供正文时模型对早期事件判断更准,提示其可能记忆了部分历史结果,但尚无法确定事后信息带来的具体影响提升。研究强调需结合训练截止日、匿名化效果与多维度验证,以提升回测可信度。
2026-10-03 07:14:46
16
转载 Stata新命令tvpreg:时变参数回归分析
我们是否真的可以假定一个经济关系在整个样本期间保持不变?在传统计量经济学模型中,研究者通常假设模型参数在整个样本期间保持稳定。例如,经典线性回归模型:隐含假设解释变量 xtxt 对结果变量 ytyt 的边际影响 ββ 不随时间变化。但现实中,货币政策传导机制、财政政策乘数、通胀与失业之间的关系等,都可能随着经济制度、政策环境和市场结构的变化而变化。
2026-10-02 09:00:00
14
转载 LLM 文本标注不再写长答案:Jev 直接返回分类、评分和判断概率
本文介绍TypeSafeAI发布的Jev模型,一种直接返回分类、评分及概率的“System One Model”。与生成式LLM需先输出自然语言再提取结果不同,Jev在输入非结构化文本后,直接针对预定义问题(如Choice、Score、Noul)输出结构化概率判断,省去冗余文本生成,提升效率与成本效益。其核心优势在于灵活应对动态任务,无需重新训练,适用于大规模文本变量构造。相比传统分类器,它无需固定标签数据;相比生成式模型,它避免无意义文本生成。尽管其架构细节未完全公开,但Jev为有限判断场景提供了高效、可
2026-10-01 21:23:54
23
转载 AI 预测不能直接当真值:如何用少量人工标注改进统计推断?——从 PPI 到 RePPI
本文探讨在实证研究中如何合理利用大模型生成的低成本预测值(如文本评分),而非直接将其作为真实结果变量。指出直接使用AI预测会改变统计推断目标,导致参数估计偏误。提出Prediction-Powered Inference(PPI)与RePPI方法,通过少量人工标注构建金标准,结合大规模预测提升统计效率,同时保持估计参数与真实结果一致。文章详解其原理、交叉拟合策略、Python实现及模拟效果,强调人工标注样本设计的重要性与实际应用边界。
2026-10-01 21:21:04
14
转载 LLM文本标注:一换 prompt 系数就变号?用 DSL 纠偏
本文探讨LLM文本标注在计量回归中的系统性偏差问题。基于FinancialPhraseBank数据,发现尽管三套Prompt下LLM标签准确率均达80%以上,但回归系数却从人工标注的显著正数变为负数或不显著,根源在于标注误差与解释变量(难判句子)相关。作者引入设计型监督学习(DSL)与PPI方法,通过小规模人工标注校正误差,提升估计可靠性。实验表明,合理设计抽样可有效纠偏,为LLM标注在经管研究中的可信应用提供方法支持。
2026-10-01 21:18:58
13
转载 Stata 新命令 sreg:随机实验的回归系数未必是你关心的平均效应
本文介绍Stata新命令sreg,用于分层随机实验中更准确地估计平均处理效应。在分层实验中,固定效应回归的权重受各层人数及处理比例双重影响,可能导致回归系数偏离按人数加权的平均效应。以课外辅导实验为例,说明仅比较处理组与对照组均值会因学生构成差异产生偏误。通过sreg可汇总各层效应、利用实验前变量提升精度,并基于实验设计正确计算标准误。该方法要求处理确实随机分配,适用于分层随机实验的规范分析。
2026-10-01 21:15:00
9
转载 LLM标注与人工标注高度一致,文本变量就可靠吗?
本文探讨大语言模型(LLM)在文本变量构建中的可靠性,指出尽管人工标注常被用作验证标准,但其作为“真值”的合理性需审慎对待。作者区分事实提取、规则分类与解释性构念三类任务,强调人工评分的主观性可能影响对LLM输出的评估。研究发现,高一致性未必代表构念效度,关键在于参照标准是否具备客观依据。因此,仅凭人工与LLM标签一致,不足以证明文本变量可靠,需进一步检验编码规则的清晰性与构念的有效性。
2026-09-29 09:09:31
16
转载 Sphinx + Agent:快速生成 Python 项目主页和在线文档
本文介绍如何利用Sphinx与本地Agent构建Python项目主页与在线文档,通过panelcheck_demo实例演示从代码审计、文档生成到GitHubPages发布的全流程。针对代码写完后展示难、维护难的问题,Sphinx实现文档与代码同步,自动提取函数接口信息,结合Markdown教程提升可读性与协作效率。适用于研究者、求职者及团队协作场景,助力项目长期维护与高效传播。
2026-09-29 09:07:16
10
转载 87% 未违约与 13% 违约:投研 AI 的判断会相同吗?
本文提出面向投研Agent的表述敏感性压力测试,检验同一财务信息在正向与负向表述下LLM判断的一致性。研究发现,尽管经济含义等价,表述方式仍可能引发评分、建议及证据搜索路径的系统性差异,暴露“框架偏差”。针对投研Agent需多步推理的特点,强调应综合评估评分、置信度、搜索关键词、工具调用与证据选择等维度。通过严格控制变量、构造等价提示对并重复测试,可有效诊断与缓解模型对表述的过度敏感问题,提升投研AI的稳定性与可靠性。
2026-09-25 16:30:54
16
转载 CatalyzeX:查论文,顺手找代码
本文介绍CatalyzeX平台及其Chrome扩展,助力经管研究者从论文快速定位代码实现。通过输入论文标题或研究主题,可一键访问相关代码仓库、Notebook及相似论文实现,提升文本分析、因果机器学习等交叉研究的复现效率。结合EJD、HuggingFace、Kaggle等平台,形成“查论文—找代码—复现验证”的完整路径。文章以KARMA论文为例,演示从CatalyzeX到GitHub的检索流程,并强调核对版本、理解方法适用性的重要性。建议经管学者按任务主题(如情感分析、异质性处理效应)精准查找,善用多平台互
2026-09-23 20:08:10
19
转载 从 GraphRAG 到 ColQwen:大模型文本分析有哪些新玩法?
本文探讨大模型时代文本分析的新范式,聚焦GraphRAG与ColQwen等技术在经济研究中的应用。通过语义标注识别投资意向、关系抽取构建企业关联网络、多模态检索提取图表数据,实现从关键词统计到动态关系与跨文档证据的深度挖掘。文章梳理六类研究任务,结合真实案例与横向评测,强调方法输出需经可复现性与可靠性检验,为构造非结构化数据驱动的新型经济变量提供系统路径。
2026-09-23 20:04:56
18
转载 Stata命令xttestpanel:面板数据模型跑完后,六项检验一起做
本文介绍Stata新命令xttestpanel,可在面板数据回归后一次性执行六项诊断:异方差、序列相关、截面相关、函数形式、Hausman检验与多重共线性。基于nlswork数据和模拟数据,演示如何运行与解读结果,强调应结合具体情境判断诊断信号,而非依赖单一汇总结论。命令需Stata 14及以上,安装后可通过postestimation调用,推荐逐项检查以深入理解模型问题。
2026-09-22 17:41:13
27
转载 Harness 和 Agent 到底有什么区别?
本文厘清了模型、Harness与Agent三者关系:模型如大脑,Harness是工作环境,Agent是执行任务的数字员工。以DeepSeekHarness为例,其“一切皆插件”架构支持灵活组合模型、工具、会话与循环机制,适用于定制化Agent开发;而Codex、ClaudeCode等为开箱即用的Agent,定位不同。文章强调,Harness并非替代模型或Agent,而是构建可持续任务执行系统的底层框架,帮助用户判断应选择现成Agent还是自建工作环境。
2026-09-22 09:00:00
126
转载 连续DID:系数分解、适用条件与Stata和Python实现
本文探讨连续处理强度下的双重差分(DID)模型系数分解问题。当处理变量由二元转为连续时,回归系数同时包含组间差异(处理组与控制组)和组内差异(处理组内部强度变化)。通过一个可手算的例子,作者推导出系数的分解公式,揭示其由两部分构成:反映组间平均效应的部分与处理组内回归系数部分。研究者需区分这两类比较,避免误将整体系数解释为“提高强度带来更大收益”。文章还讨论了识别条件、适用场景及在Stata和Python中的实现方法,强调应根据研究目的分别报告两类效应,以提升因果推断的准确性。
2026-09-21 14:45:35
43
转载 readraster:在 Stata 里直接读 GeoTIFF 和 NetCDF 地理栅格数据
本文介绍Stata命令readraster,实现直接读取GeoTIFF与NetCDF地理栅格数据,涵盖安装、Java环境配置、坐标转换及按行政区或点位汇总的全流程。该工具通过集成GeoTools与NetCDF-Java库,将栅格处理链路完整嵌入Stata,支持夜间灯光、气温格点等数据的高效分析,避免跨软件传递带来的精度漂移与脚本不可复现问题。
2026-09-21 14:41:55
18
转载 annotaid:不用写代码,在本地批量实现文本标注
本文介绍annotaid工具,无需编写代码即可在本地批量标注文本,适用于研究者处理开放式问卷数据。通过连接本地大语言模型(如LMStudio、Ollama),用户可设定标注规则,批量生成标签并导出结果。适合16GB内存以上设备,支持中文任务,推荐使用4–8B量化模型。部署简单:安装LMStudio启动服务,解压annotaid后运行Python网页服务,浏览器访问即可操作。实测显示,13,484条英文文本处理耗时约10小时,人工一致性达98%。适用于小至数百条、大至数千条的文本分析任务,但大规模或复杂任务需
2026-09-14 09:10:23
30
转载 llm-for-zotero 实操指南:在 Zotero 里把一篇论文读透
本文以Imbert和Ulyssea(2026)的论文为例,详细介绍llm-for-zotero插件在Zotero中的安装、配置与应用。该插件将大语言模型嵌入PDF阅读器,实现论文问答、引用核验、对话保存与笔记回写,支持云端与本地模型,提升文献阅读效率。通过结构化提问,可快速提取研究问题、数据来源、识别策略与机制分析,并确保回答可追溯至原文。插件还支持复杂版式文档的MinerU解析与Agent自动化整理,适用于已系统管理文献的研究者,实现“读透一篇论文”的全流程智能辅助。
2026-09-14 09:08:35
127
转载 AI 我知道-07:知识图谱如何用于研究?工具、提示词与工作流
本文探讨如何利用知识卡片与知识图谱提升AI辅助文献综述的效率与可复用性。针对传统Agent处理文献时重复核验、信息碎片化等问题,提出将论文拆分为包含研究命题、来源、页码及核验状态的知识卡片,并在需要跨论文比较、多跳查询时构建关系网络——研究知识图谱。文章区分了卡片与图谱的适用场景,强调图谱在复杂研究任务中的优势,并提供从卡片到图谱的工作流、提示词模板及工具推荐(如Neo4j、GraphRAG、OpenAlex),助力研究者实现可查询、可核验的智能文献管理。
2026-09-10 09:00:00
29
转载 分仓回归和推断:binsreg 的 Stata、R 与 Python 实现
本文介绍binsreg方法体系及其Stata、R和Python实现。与传统binscatter仅绘图不同,binsreg提供分箱选择、曲线估计、置信带、函数检验和组间比较的完整工具链,支持协变量调整及非线性扩展,适合实证研究中的非参数分析与可视化。
2026-09-09 09:00:00
22
转载 从美欧调查看「AI 采用」的测量、组织扩散与因果识别
<think>我们根据用户提供的文本生成一篇≤150字的文章摘要。用户给出的内容是关于AI采用测量的论文介绍,要求生成摘要。需要提炼核心:测量差异、组织扩散、因果识别、跨国数据43% vs 32%等。摘要需简洁,不超过150字。我们写一段或几句。注意:要概括要点,避免细节。</think>摘要:Bickel等通过美欧工人与企业调查发现,美国43%、欧洲六国平均32%的工人使用生成式AI,但这并非简单排名。文章强调应区分AI暴露、实际采用、使用强度与流程嵌入。测量口径(工人自报、企业问
2026-09-09 09:00:00
36
转载 AI Agent 到底是什么?一次理清 LLM、Chatbot、Workflow 与 Agentic
本文通过代码修正案例,区分了LLM、Chatbot、Workflow与Agent:模型是决策部件,对话应用强调交互,预编排流程由程序控制步骤,而Agent则由模型动态安排操作并调用工具,同时受权限约束。文章旨在厘清术语,帮助准确描述AI系统。
2026-09-09 09:00:00
62
转载 AI 怎样把文本材料变成研究数据?从历史报纸到实证分析
本文将文本材料转化为研究数据的流程拆解为:先确认材料能否回答研究问题,再将概念写成清晰的标注规则,最后借助Codex执行批量标注。强调研究者须区分“使用证据”与“真实状态”,做好人工验证和误差评估,才能构造可信变量。
2026-09-08 08:44:51
30
转载 SBW:稳定平衡权重法如何提高随机实验的估计精度?
本文介绍稳定平衡权重法(SBW)如何通过协变量加权提高随机实验的估计精度。该方法可同时改善均值差、率比、Mann–Whitney等指标的估计,强调权重稳定性,并与回归、熵平衡比较,适用于多效应指标报告场景。
2026-09-08 08:42:37
21
转载 文生图很烧 Tokens 吗?科研配图的选择逻辑
文生图成本不仅关乎Tokens,更在于工具选择。核心逻辑:场景和隐喻用文生图,关系流程用矢量工具,数据结果用代码,文字公式用排版软件。正确划分工具边界能减少返工,才是真正的节省额度之道。
2026-09-07 09:00:00
33
转载 文本转成 Embedding 后,还能直接拿来做因果推断吗?
文本嵌入可用于聚类,但作为因果推断的控制变量需谨慎:须保证嵌入保留了与处理、结果同时相关的主题结构,否则降维已丢失混淆信息,后续灵活模型无法补救。
2026-09-07 09:00:00
21
转载 wbopendata:从Stata中获取世界银行70多国2000多个指标
本文介绍Stata命令wbopendata,它通过World Bank API获取71个数据库、2万余项指标和296个国家(地区)数据,支持长/宽格式、多国多指标下载及对话框操作。文章说明安装语法、五种下载模式,并演示中国全指标、主题下载、全球人均GDP及金砖五国趋势绘图案例。
2026-09-07 09:00:00
75
转载 遗漏变量敏感性分析:为什么系数可能先“变号”而不是“归零”?
遗漏变量敏感性分析中,仅关注“系数归零”可能不足,因为系数可能先变号。Masten和Poirier(2026)证明,在Oster框架下符号反转临界点总≤1,即不可观测选择与可观测同级时方向
2026-09-06 22:10:44
38
转载 AI 参与金融决策,为什么不能只看准确率?
金融AI决策不能只看平均准确率,还需关注结果稳定性、理由一致性与可审计性。综述区分计算确定性、可复现性、可审计性,指出表格模型、图神经网络与LLM各有漂移来源;近似解释、训练扰动与并行配置均可能导致个案
2026-09-06 22:05:10
27
转载 Logit + XGBoost:一种可解释的混合信用评分模型
本文介绍一种混合信用评分模型:Logit构建透明主体,XGBoost学习其残差,并用可解释比例衡量每笔预测的透明程度。模型在接近XGBoost性能的同时支持逐笔审计,且能识别更易被送入黑箱的群体,兼顾预测精度与监管解释需求。
2026-09-06 22:02:20
25
转载 ReproAI-下:Stata 复现包实测——ReproAI 能找到漏洞吗?
含10项预设缺陷的Stata复现包进行受控实测,ReproAI在8项核心缺陷中仅检出4项,且未自动修复。它擅长发现硬编码路径、缺失脚本、无随机种子等问题,但遗漏样本静默缩减、输出目录、文档缺失等盲区,提示静态检查的局限性。
2026-09-04 09:00:00
30
Stata101:人手一份的入门指南-连玉君
2024-09-20
profile.do
2017-09-10
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅