- 博客(90)
- 收藏
- 关注
原创 万字长文详解因果推断:从SCM/PO 双框架、后门 / 前门 / IV 识别、ATE 估计算法到 DoWhy、NOTEARS、LLM 因果融合
摘要 因果推断是一套新兴的统计分析框架,用于量化变量间的真实因果效应,区别于传统机器学习基于相关性的预测方法。其理论体系由Rubin、Judea Pearl等学者在近30年构建,随着机器学习向逻辑推理阶段发展而兴起。因果推断的核心价值在于:通过观测数据(如互联网行为日志)识别真实因果关系,解决传统统计无法处理的辛普森悖论等问题——当整体与分组结论矛盾时(如伯克利招生性别差异、药物疗效评估),需控制混淆变量(如院系、年龄)才能揭示真实因果。该框架并非否定相关性模型,而是明确了其适用边界:纯预测任务可用相关模型
2026-07-17 20:02:40
1331
原创 2026 年 4 月实测:OpenAI Codex 保姆级教程,从安装到 MCP、Skills 与多智能体协作
Codex是一款由OpenAI开发的AI编程工具,能够深入项目上下文进行代码补全、修改和执行命令,而不仅仅是简单的聊天问答。它适合开发者用于理解陌生项目、中小规模开发、代码审查和工程化协作。安装Codex需要Node.js环境和Git基础,通过CLI、IDE插件或Codex App进行操作。核心功能包括项目初始化(/init)、代码审查(/review)和上下文管理(/compact)。Codex强调权限控制和审批机制,确保操作安全,并通过AGENTS.md文件规范项目约束。它支持多入口协作,包括命令行、I
2026-04-12 22:21:20
4329
原创 万字长文详细解读扩散模型(diffusion model)从原理剖析、公式推导、Unet架构到代码实现
扩散模型通过逐步去噪实现高质量图像生成,其核心是噪声预测器学习训练数据的真实分布。在文本到图像任务中(如Stable Diffusion),模型结合文本编码器提供的语义条件指导生成过程。评估生成质量主要采用FID指标衡量图像分布相似度,以及CLIP模型验证图文匹配度。扩散模型通过正向加噪构造训练数据,反向去噪生成图像,其性能依赖于文本编码器的语义理解能力和噪声预测器的分布拟合效果。这种分步生成框架显著提升了生成图像的逼真度和语义一致性。
2025-11-24 11:30:54
19009
9
原创 如何高效构建一个RAG知识库 dify实例与常见问题
本文主要介绍了基于dify工具搭建RAG应用的实操指南及RAG技术在工作与面试中的核心问题。在实操部分,重点讲解了模型配置、数据源格式选择(推荐CSV)、文本分块参数设置、检索模式对比(向量检索为主)、Rerank重排模型应用等关键环节。在问题解答部分,分析了知识检索与模型微调的场景选型、多格式数据处理、实时数据对接、知识图谱应用等高频问题,并提出了性能与成本的平衡方案。文章强调RAG效果的核心在于知识库的精细化构建,推荐结构化数据源+标准分块参数+向量检索的最优组合,同时需做好数据清洗、权限管理等企业级落
2026-07-29 20:07:49
472
原创 零基础选型指南:Make / 扣子 Coze/n8n/Dify 四大自动化平台完整对比
本文对比分析了四款主流零代码自动化工具(Make、扣子Coze、n8n、Dify)的选型要点。从部署合规性看,SaaS版的Make和Coze适合无数据本地化要求的个人用户,而支持私有化部署的n8n和Dify则满足企业数据管控需求。在易用性方面,Make凭借3000+插件生态、可视化界面和低学习门槛成为零基础用户首选,其AI功能也最为全面;Coze擅长AI对话机器人但办公集成较弱;n8n适合有技术基础的用户自定义开发;Dify则侧重知识库和AI应用。建议个人用户优先选择Make,企业根据数据合规需求在n8n和
2026-07-29 19:20:01
423
原创 区块链、NFT、DeFi深度拆解:从零搭建Web3知识体系
Web3.0:下一代互联网还是资本泡沫? Web3.0作为去中心化互联网新范式,近年来伴随区块链、NFT、加密货币等概念爆火。其核心愿景是让用户真正拥有数据主权,摆脱平台垄断。从技术演进看,Web1.0是只读时代(如门户网站),Web2.0是可读可写时代(如社交平台),而Web3.0则强调"可读、可写、可拥有",依托区块链构建独立经济生态。当前Web3落地集中在四大赛道:加密货币交易(如币安)、DeFi去中心化金融(如稳定币)、NFT数字资产(如OpenSea)和链游(如Axie Infinity)。然而行
2026-07-29 19:03:08
283
原创 Codex全套科研技能汇总
本文整理了覆盖科研全流程的AI专用技能工具集,包含六大类功能:1.前置通用技能(计划模式、科研绘图、综述写作);2.文献阅读与检索工具;3.论文撰写润色系统;4.数据可视化与汇报制作;5.审稿模拟与返修辅助;6.综合科研助手。重点推荐Nature系列工具(图表生成、论文润色、审稿模拟)和学术PPT自动生成功能,可显著提升研究生从开题到投稿全环节效率。各工具均标注优缺点,建议根据具体场景组合使用,其中计划模式能有效减少返工,但需注意复杂图表仍需人工优化。
2026-07-19 20:38:39
413
原创 自进化智能体:智能体优化器与智能体强化学习落地架构 | 专题报告
NVIDIA Research张少坤围绕自进化智能体展开分享,指出其具备递归自我优化、自主环境交互学习两大核心特质。报告介绍两项核心工作:一是Agent Optimizer,无需微调基础模型,让智能体自主迭代优化工具、提示词等运行框架(Harness),低成本实现性能提升,但存在数据依赖外部数据集的局限;二是ProRL Agent V2(Polar)解耦式强化学习架构,采用异步流水线调度CPU/GPU资源,通过轨迹合并、梯度掩码处理交互数据,在SWE-Bench数据集验证效果显著。
2026-07-19 13:22:06
336
原创 Open-ended World 中的世界认知与自进化智能体 | Self-Evolving Agents专题报告
开放世界下的因果学习与世界模型构建,本质是一套智能体自我进化的闭环系统:智能体通过主动提问、定向探索获取新经验,依托现有认知解释场景现象,发现无法匹配的未知规律与逻辑矛盾,进而反向更新自身的因果认知与世界模型,实现持续、动态的自我迭代与进化。
2026-07-19 12:32:06
344
原创 【模型推理】深度学习模型部署核心:算子Lower拆解、计算图优化与PNNX源码解析
PyTorch模型部署主要采用TorchScript和ONNX两种核心方式,衍生出libtorch部署、ONNXRuntime部署和第三方库部署三种主流方法。libtorch部署直接基于PyTorch底层库,兼容性好但性能未优化;ONNXRuntime部署通过ONNX格式实现跨平台兼容,但存在算子支持不全和子图复杂化问题;第三方库部署针对特定硬件优化,但依赖ONNX中间格式可能导致兼容性问题。模型转换中的"Lower"机制通过拆解不支持的算子为多个基础算子实现兼容,但可能导致计算图冗余。为解决ONNX中间件
2026-07-18 21:58:15
400
1
原创 在 vibe coding开发项目过程中使用过的命令和概念整理
本文介绍了npm和Docker的常用命令及其具体含义。npm命令部分包括在指定目录运行测试脚本(npm --prefix backend test)和执行lint检查(npm --prefix frontend run lint),解释了参数用途。Docker命令部分展示了如何在容器内操作PostgreSQL数据库,包括查看表结构(\d+ public.profiles)、查询数据(select id, title, location)以及查找外键约束(select conname, conrelid::r
2026-07-18 21:56:46
183
原创 WSL超详细保姆级教程:Windows极致运行AI Agent(含 pi、Hermes agent 实践)
摘要: Windows系统运行AI Agent时,优先使用WSL(Windows子系统Linux)而非原生PowerShell,主要原因在于: 兼容性更强:AI模型训练依赖Linux/Mac命令,WSL减少报错与Token损耗,提升运行效率。 贴近生产环境:项目部署多在Linux服务器,WSL确保开发与线上环境一致。 安全隔离:独立子系统避免误操作影响宿主机,故障可快速重置。 部署步骤: 启用CPU虚拟化(BIOS中开启Intel VMX/AMD SVM)。 安装WSL:执行命令wsl --install
2026-07-17 16:10:12
373
原创 首次尝试使用CPA搭建codex号池 ---- 操作流程整理
本文介绍了如何快速搭建和使用CPA(CliProxyAPI)服务来共享codex账号。主要内容包括:下载并解压CPA程序、配置config.yaml文件(需修改默认API密钥)、启动服务并通过浏览器管理界面导入.json认证文件。最后以Cherry Studio为例,演示如何将本地CPA服务作为OpenAI提供商接入,并补充了ccswitch配置说明。全文提供了详细的操作步骤和配图指引,适合新手快速上手使用共享账号资源。
2026-06-10 21:27:06
868
原创 一次性搞懂 CDN、对象存储、反向代理、函数计算和边缘计算 --- Cloudflare 免费服务到底能用到什么程度
文章摘要 CDN、反向代理与边缘函数 CDN是一种分布式内容分发网络,通过就近节点访问资源降低延迟。实际工程中采用"源站-缓存-回源"的被动缓存模型,而非全量推送。CDN本质是带缓存的反向代理集群,包含就近调度、多级缓存等功能。边缘计算将函数计算部署到CDN节点,实现低延迟处理,可用于图片防盗链等场景。 Cloudflare免费服务汇总 Cloudflare提供多项免费服务:1)无限流量的CDN和DNS解析;2)Workers和Pages服务,Workers每天10万次请求,Pages每月500次构建;3)
2026-06-10 21:26:32
590
原创 从 DSM 到多智能体仿真:复杂产品变更传播研究路线图
摘要 工程变更传播分析研究设计变更如何沿产品、流程和组织网络扩散,涉及多学科交叉方法。本文梳理了关键研究路线:基于DSM/复杂网络建模传播路径,利用多智能体仿真动态模拟变更扩散过程,并通过优化算法选择控制方案。推荐了必读文献(如2022年综述和2017年多智能体方法论文)及开源工具链(Mesa、NetworkX、PuLP等),为构建可复现的研究原型提供路线图。研究重点在于将静态网络分析、动态仿真与优化决策结合,以量化评估变更风险并支持控制决策。
2026-05-25 21:25:00
435
原创 大模型系统多目标调优开源论文代码整理
本文探讨了大模型系统落地中的多目标调优问题,分析了效果、成本、延迟和安全之间的平衡挑战。文章汇总了五个关键方向的开源解决方案:1)多目标偏好对齐(如MODPO、DPA);2)推理时动态控制(如MOD);3)RAG/Agent系统优化(如syftr);4)多模型路由调度(如ParetoBandit);5)LLM Serving自动优化(如VibeServe)。这些方法帮助在Pareto最优前沿找到最佳折中点,适用于不同场景需求,从理论研究到工程落地均有覆盖,为大模型系统的多目标优化提供了实用工具和框架。
2026-05-20 09:31:16
402
原创 大模型多目标对齐开源论文代码整理
摘要:大语言模型的多目标对齐研究进展 当前大语言模型对齐研究正从单一偏好优化转向多目标协同优化。传统RLHF/DPO方法将人类偏好压缩为标量奖励,难以平衡实际应用中相互冲突的多维目标(如帮助性、安全性、简洁性等)。本文梳理了11个代表性开源项目,归纳出5条技术路线:多目标DPO优化、帕累托前沿插值、推理时动态控制、多目标奖励建模和策略无关对齐。重点介绍了MODPO、Rewarded Soups、RiC等项目的创新点,它们通过引入多目标margin、模型插值、奖励条件化等方法,实现了对不同偏好权衡的可控调节。
2026-05-20 09:24:57
583
原创 【ICML 2025】MODULI:基于扩散模型解锁离线多目标强化学习的偏好泛化
本文提出MODULI框架,解决离线多目标强化学习中的分布外偏好泛化问题。MODULI基于条件扩散模型生成面向偏好的轨迹,通过两种多偏好回报归一化方法(偏好预测归一化和邻域偏好归一化)优化生成引导,并设计滑动引导机制实现从分布内到分布外偏好的平滑过渡。实验表明,MODULI在D4MORL基准上超越现有方法,显著提升了分布外偏好的泛化能力。该框架通过将决策过程转化为条件生成任务,利用扩散模型的强大表达能力,有效修补了不完整的帕累托前沿。
2026-05-13 20:40:55
521
原创 【KDD 2025】RL4CO:组合优化的强化学习统一基准框架详解
强化学习已成为求解 NP 难组合优化(CO)问题的主流范式,RL4CO 作为统一开源基准框架,集成 27 类环境与 23 个基线模型,标准化了研究流程。本文围绕 RL4CO,详解了 CO 问题的 MDP 建模方法,对比构造式与改进式策略、归纳式与转导式训练算法,分析各类解码策略的优劣,并分享关键实验洞察:模块替换可显著提升性能,构造式与改进式混合范式效果最优。同时介绍框架工程设计要点,指出 CO 基础模型、大规模算例求解等前沿开放问题,为神经组合优化研究提供全面参考。
2026-05-13 18:26:50
394
原创 贝叶斯边际似然与强化学习:从行为建模到元学习
本文围绕边际似然与贝叶斯因子展开,系统梳理其在强化学习多方向的模型比较应用。首先介绍边际似然内置奥卡姆惩罚、适配跨结构模型对比的核心特性及主流估计方法;随后分别从认知行为 RL 建模、贝叶斯元强化学习、离线强化学习世界模型筛选、贝叶斯逆强化学习四大场景,分析边际似然的作用机制与实践范式,对比各类方法优劣,汇总工具、文献与估计技术,为贝叶斯框架下的强化学习模型选择提供理论与实践参考。
2026-05-12 09:37:40
394
原创 因果推理研究方向综述笔记
本文系统梳理了因果推理领域的核心框架、研究方向与技术进展。主要内容包括:1)领域概览,介绍Pearl因果层级理论和七大研究方向的关系图;2)因果发现,总结主流算法类别(约束型、评分型、深度学习型等)及重要工具;3)因果效应估计,分析核心方法(倾向得分、双重机器学习等)和开源库;4)因果表示学习,作为连接深度学习与因果推理的桥梁。文章特别强调LLM在因果推理中的横切应用价值,并提供了各方向的入门路径、关键论文和代码资源,为研究者提供系统性参考。
2026-05-12 09:34:10
1113
原创 多任务强化学习开源论文代码综述
文章摘要: 本文梳理了2024-2025年多任务强化学习(MTRL)的最新进展,重点介绍了组合优化、机器人操控和离线RL领域的代表性工作。主要内容包括:1)三大Benchmark框架(RL4CO、MetaWorld+、MTBench)及其多任务评估标准;2)核心方法创新,如MOORE的正交专家混合、MVMoE的多变体路径求解、HarmoDT的双层优化架构,以及M3DT和UniCO的序列建模方法;3)工具资源与开源实现。文章特别关注MoE架构和课程学习在解决任务异构性、负迁移和规模化挑战中的应用,为研究者提供
2026-05-08 11:48:41
442
原创 【NeurIPS 2023】离线强化学习的高效扩散策略 EDP --- Efficient Diffusion Policies for Offline Reinforcement Learning
离线强化学习可规避在线交互成本与风险,但存在分布偏移问题。扩散策略表达能力强,却存在训练耗时久、对数似然不可计算、无法兼容 IQL/CRR 等似然类算法的缺陷。本文提出高效扩散策略 EDP,借助动作近似技术实现单步动作重构,结合 DPM-Solver 加速采样;通过高斯近似拟合策略似然,适配主流离线 RL 算法。设计 EAS 采样机制,在 D4RL 基准上实现大幅训练加速,性能优于 Diffusion-QL,可通用嵌入 TD3、IQL 等算法,刷新多项任务 SOTA。
2026-05-06 20:53:36
595
原创 (AAMAS 2023)基于广义策略改进优先级的高效多目标学习 GPI - LS/PD
本文提出了一种基于广义策略改进(GPI)的新型多目标强化学习算法,通过优先级技术高效学习凸覆盖集(CCS)。该算法在每个时刻动态选择最具改进潜力的偏好权重进行训练,利用GPI计算状态-动作层面的最优决策,而非简单加权策略得分。通过定义角权重和构建多面体模型,算法能优先训练落差最大的偏好区域,从而快速收敛到CCS。理论证明该方法在有限步数内可找到最优解,在次优情况下仍能保证ε-近似最优,并定义了效用损失上界。实验表明该算法采样效率显著优于现有MORL方法,同时支持连续状态空间和基于模型的Dyna式学习,能有效
2026-05-06 20:51:39
404
原创 OOD 感知决策与可信强化学习:从置信度评估到安全回退
文章摘要:本文探讨强化学习系统在检测到OOD状态后的决策机制,聚焦检测后的行动策略。首先指出OOD检测仅是中间环节,关键在于后续决策,并提出7种可能的行动选择。随后分析神经网络置信度的可靠性问题,强调需要多维度信号和校准方法。重点介绍了四种OOD感知决策架构:硬切换(简单直接但粗糙)、软加权(平滑过渡但安全性难保证)、安全过滤器(事后修正动作)和人工接管(高风险场景必备)。文章提供了具体实现方法和适用场景分析,为构建可信RL系统提供了实用框架。
2026-05-03 18:14:21
493
4
原创 强化学习中的OOD检测:从状态异常到分布偏移
本文系统梳理强化学习(RL)场景下 Out-of-Distribution(OOD)检测的问题定义、四类检测对象(状态 / 动作 / 转移 / 轨迹)、六类主流检测方法,以及代表论文与可复现的开源代码,帮助研究者和工程师建立一套可操作的 RL OOD 检测知识框架。本文是"强化学习 OOD 与可信决策"系列第 1 篇,侧重 检测;第 2 篇侧重检测之后的 决策与行动。
2026-05-03 18:13:23
570
原创 多智能体强化学习求解 FJSP 变体全景:动态调度、AGV 运输、绿色制造与开源代码导航
本文系统梳理了多智能体强化学习(MARL)在柔性作业车间调度问题(FJSP)七类现实变体中的应用研究。首先介绍了标准FJSP的问题定义及其与经典JSP的区别,指出真实制造场景中的复杂约束催生了多种FJSP变体。针对这些变体,本文详细分析了每类问题的核心挑战,并提供了代表性算法和可复现的开源代码资源,包括标准FJSP、多目标FJSP、动态FJSP、含AGV/运输约束的FJSP等。特别强调了多智能体方法在解决这些复杂调度问题时的优势,如分解决策空间、提高实时响应能力等。本文可为调度优化与深度强化学习领域的研究者
2026-04-23 21:24:11
568
原创 多目标柔性作业车间调度(MOFJSP)开源代码全面梳理:从 NSGA-II 到深度强化学习
本文系统梳理了GitHub上关于多目标柔性作业车间调度问题(MOFJSP)的开源代码资源,涵盖传统进化算法、增强型NSGA-II以及深度强化学习等多种技术路线。重点分析了四个典型项目:Enhanced_NSGA-II_EFJSP-TT(引入运输时间约束的能效优化)、NSGA-II-FJSP(标准双目标实现)、NSGA-II-FJSP-AGVs(集成AGV物料搬运)和BioAI_Project(三目标优化课程项目)。各项目在优化目标、算法实现和适用场景上各具特色,为研究者提供了从入门学习到工业落地的完整参考体
2026-04-23 20:42:15
540
原创 2026 年 AI 编码多代理协作全景:Claude Code + Codex CLI 7 个开源工具深度评测
2025年起,AI编码工具从单代理转向多代理协作成为关键趋势。本文评测了7个解决Claude Code与Codex CLI协作问题的开源项目: agor - 功能最全面的多代理操作系统,提供可视化画布和MCP通信,适合团队基础设施 claude-squad - 最均衡的终端管理器,使用tmux+git worktree隔离,适合快速上手 myclaude - 方法论导向的工作流框架,提供路由编排和规格门控 其他项目包括codexmcp(MCP桥接)、ccmanager(会话管理)、codexia(GUI工作
2026-04-22 21:01:18
2064
6
原创 AI 辅助科研工具全景指南:计算机与金融领域(2025-2026)
本文梳理了AI科研与量化投资领域的关键开源工具,涵盖计算机和金融两大方向。在通用科研工具方面,推荐Semantic Scholar、Zotero和RAGFlow等文献检索管理工具;计算机领域重点介绍AI-Researcher、STORM等自主科研Agent和OpenHands代码实验辅助工具;金融领域则聚焦FinGPT金融大模型和FinRobot分析平台。文章还针对不同研究场景给出具体选型建议,如全流程自动化科研推荐AI-Researcher+OpenHands组合,金融分析建议FinGPT+FinRobo
2026-04-22 14:30:05
1076
原创 【ICLR 2025】学习引导式滚动时域优化(L-RHO)用于长周期组合优化问题
本文提出学习引导式滚动时域优化(L-RHO)方法,用于高效求解长周期组合优化问题(如柔性作业车间调度FJSP)。传统滚动时域优化(RHO)因窗口重叠导致冗余计算,L-RHO通过神经网络预测相邻窗口中机器分配稳定的工序,固定其分配以缩减子问题规模。实验表明,L-RHO相比标准RHO最高减少54%求解时间,提升21%解质量,并在噪声、故障等动态场景中保持稳定性。核心创新在于利用学习模型识别可沿用决策,避免重复优化,显著提升计算效率。
2026-04-20 13:33:01
551
原创 Hermes Agent 上手与迁移实践:一个能沉淀技能和记忆的开源 Agent 平台
文章摘要: Hermes Agent 是一个专注于技能沉淀和长期记忆的AI代理系统,其核心优势在于将技能复用、记忆存储和工具调用整合为一套可持续学习的闭环。不同于单纯依赖大模型的聊天工具,Hermes通过分层记忆机制(如SOUL.md、USER.md)和技能模板库实现渐进式知识积累,支持本地/云端部署与多模型来源。官方提供从OpenClaw等系统的迁移支持,并推荐通过WSL2在Windows环境下运行。配置时建议使用OpenRouter的免费模型降低成本,其模块化设计(主模型+辅助任务槽位)兼顾性能与实用性
2026-04-13 14:34:45
1038
原创 Internet of Agents 论文解读:给异构 Agent 搭一层“互联网”到底意味着什么
《多智能体真正缺的不是更多Agent,而是协作层》一文深入解读了IoA(Internet of Agents)论文的创新价值。文章指出,IoA并非简单堆砌多个Agent进行对话,而是致力于构建一个支持异构Agent动态协作的基础设施层。其核心创新在于:1)将多智能体系统抽象为服务器-客户端架构,实现注册发现与消息路由;2)采用嵌套组队机制处理复杂任务,形成任务树结构;3)运用有限状态机管理动态对话流程。实验证明,该框架在GAIA等基准测试中优于现有方案,并能有效集成第三方Agent。当前实现虽为中心化架构,
2026-04-12 16:43:35
598
原创 【Neural Networks 2025】TDAG 论文解读:多智能体不是重点,动态任务分解才是关键
摘要 大语言模型智能体(Agent)面临复杂任务时表现不佳的核心问题在于静态任务分解导致错误传播、预定义代理适配性不足以及评估粒度粗糙。TDAG框架提出动态任务分解、面向子任务的代理生成和增量式技能库三大创新机制,显著提升了复杂场景下的适应能力。该研究构建了细粒度评估基准ItineraryBench,通过多层级评分系统更准确地衡量任务完成度。实验表明,TDAG在旅行规划等复杂任务上优于现有方法,错误传播减少40%以上,同时验证了动态调整和代理生成机制的关键作用。这项工作为智能体系统提供了更灵活的任务处理范式
2026-04-12 11:04:27
441
原创 跨平台桌面应用框架怎么选?Electron 快速上手案例实操
跨平台桌面应用框架选择与Electron实践指南 本文对比了三大跨平台桌面应用框架:Electron、Flutter和Tauri。Electron生态成熟但体积大,Flutter视觉统一但非Web技术栈,Tauri小巧安全但生态较弱。文章从架构、性能、生态三方面进行对比,指出Tauri在体积和性能上最优,Electron在开发体验上占优。 详细介绍了Electron开发实践:环境搭建、项目初始化、窗口创建、本地页面加载和安全配置。通过具体代码示例展示了Electron的核心功能,包括BrowserWindo
2026-04-10 13:03:38
453
原创 【AI Agent实战经验】Anthropic如何构建多智能体研究系统 ---《How we built our multi-agent research system》
Anthropic构建的多智能体研究系统采用Orchestrator-Worker架构,将研究任务拆解为全局决策和局部探索两部分。该系统通过并行处理扩大信息覆盖范围,性能提升主要源于Token容量的扩张而非单纯推理能力。研究发现:复杂研究任务需要动态分工和反复调度,单智能体模式难以应对开放式、路径依赖的研究特性。系统采用Claude Opus担任编排者,多个Sonnet作为子智能体的组合方式,并强调工具接口设计的重要性。真正的工程挑战在于生产环境中的状态管理,尤其是长链路任务中的上下文窗口限制问题。该系统适
2026-04-10 13:02:19
704
原创 Harness 工程:Agent‑First 时代的规模化 AI 编码实践
OpenAI 开展了一项极端实验:五个月内完全依靠 Codex Agent 开发百万行级产品,效率达传统模式十倍,并提出用于管控 AI 编码的 Harness 工程体系。在 Agent‑First 研发模式下,人类工作从编写代码转向架构设计、环境构建与反馈闭环搭建。团队放弃臃肿文档,改用轻量化、可导航、可自动校验的结构化文档体系;针对 Agent 易模仿坏模式、代码碎片化问题,构建刚性架构约束与自动化 Lint 强制校验,并通过后台 Agent 定时清理技术债。随着系统不断完善,Codex 已可独立完成从需
2026-03-19 18:25:55
593
原创 AI 时代前端框架选型:React 核心原理与 SocialVibe 项目实战解析
本文先对比 AI 时代 Vue 与 React 的选型逻辑,指出 React 因生态庞大、AI 适配性高更具优势,同时兼顾 Vue 在国内小程序场景的适用性。接着系统讲解 React 核心概念,包括组件、JSX、Props、State 等基础语法,以及 Hooks、Portal、Suspense 等进阶特性。最后以 SocialVibe 社交平台 Monorepo 项目为例,拆解其前端(React 19+TypeScript 实现页面与全局状态管理)、后端(Express 分层架构,路由 - 控制器 - 服
2026-03-19 17:05:55
961
1
原创 本地数据库的表数据迁移至对应云平台,流程整理和问题总结:以supabase为例
本文记录开发者将本地 Docker 部署的 Supabase 数据库迁移至云端 Supabase 的实操过程。迁移中遇到两大核心问题:一是连接云端数据库时因 VPN、DNS 解析异常,出现服务器意外断开连接,关闭代理或设置直连、选用 Session Pooler 连接模式可解决;二是导入 SQL 文件因编码非 UTF-8 报错,改用在本地容器通过 pg_dump 带 --column-inserts 参数导出数据,保证兼容性。作者给出完整迁移流程:先配置云端参数、定位本地容器,再分表结构与数据导出,通过指定
2026-03-16 11:38:52
476
原创 REMOTION+AI零代码创作:告别AE/PR,自媒体推广视频10分钟搞定
摘要:REMOTION是一款通过React代码生成视频的创新框架,解决了传统视频制作软件学习成本高、操作复杂的问题。其核心流程包括:1)通过AI对话描述视频需求;2)自动生成REMOTION代码;3)渲染帧画面;4)导出最终视频。实践操作需安装Node.js、Git和FFmpeg环境,通过命令初始化项目并安装Agent Skill。以宠物领养APP推广视频为例,用户只需提供素材和需求描述,AI即可自动生成符合要求的视频。该方法相比传统制作节省80%时间,无需专业技能和付费,适合自媒体人、创业者等各类人群实现
2026-03-16 11:34:18
656
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅