自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+
  • 博客(76)
  • 收藏
  • 关注

原创 2026 年了,AI Agent 框架到底怎么选?一张表说清主流方案

AI Agent 框架那么多,从 LangChain 到 AutoGen 到底怎么选?本文按场景分档,一张表对比主流方案的能力边界与适用团队,帮你把选型成本降下来。

2026-09-22 21:14:00 229

原创 GPT-6 发布 20 天传播数据复盘:HN 86 帖、B站占中文圈七成、信任议题比能力惊叹活得更久

20 天追踪数据复盘:HN 86 帖、仅 2 个高热帖、10 个零增日;中文圈 B站占七成,内容形态经惊叹→实用→娱乐化三级跳;跨平台传播最快 12 小时,降温期议程由信任与安全议题接管。

2026-09-22 13:51:08 181

原创 前大厂研究员搞出的“闭嘴模型“火了:不能生成一个字,却比大模型快 200 倍——我把它打包成了免注册的懒人包

本文由开源复刻者分享,与 Jev 官方(TypeSafe AI)无关。懒人包基于开源复刻模型制作,文末附下载链接。

2026-09-19 23:27:29 177

原创 Agent 的记忆该谁来管:框架层自建 vs 平台托管

记忆是 Agent 最易被低估的模块:框架层自建(Mem0 等)灵活但隐性成本高,平台托管开箱即用。一篇讲清两条路线的取舍与判断标准。

2026-09-19 21:11:41 143

原创 Agent 什么时候该有 plan 系统?

Agent 任务一复杂就散架?不是模型变笨,是缺了规划层。本文拆解 plan 系统的三件事:任务分解、状态追踪、重规划,并给出一个务实的上/不上判断标准。

2026-09-15 21:04:49 191

原创 科技优惠日报(详情版)· 2026-09-12:16 家厂商 73 条有效优惠

本周科技优惠日报:整理云服务、AI 工具与开发者平台的最新优惠与活动信息,附领取入口与截止时间,帮你省钱上云、省心用 AI。

2026-09-12 10:02:17 219

原创 Agent 框架选型的第二层问题:用 LangGraph 自建,还是直接上数字员工平台?

Agent 框架对比文都在回答"LangGraph 和 Dify 哪个好",但真正决定 ROI 的是下一层问题:搭好的 Agent 怎么变成业务部门真能用的东西。本文用同一个日报需求对比 LangGraph 自建与数字员工平台的成本结构,附决策清单。

2026-09-11 13:00:20 100

原创 截图工具的“暗工程“:从 C 匹配器到本地 RAG,快咔这波更新都改了什么

快咔(KuaiKa)是一款主打"按下快捷键、说完即成文"的语音转文字效率工具。本文以实际场景为例,拆解它的核心流程:录音捕获、语音识别、AI 润色归一,并给出在写作、客服、会议纪要等场景的落地用法,以及与百灵数字员工结合的自动化思路。

2026-09-10 15:18:45 95

原创 截图工具的“暗工程”:从 C 匹配器到本地 RAG,快咔这波更新都改了什么

快咔这批更新的工程拆解:长截图拼接匹配器下沉到原生 C(两层漏斗 + 相位相关)、截图内容搜索的本地 RAG 管线(Qwen3.5-0.8B 做待办意图识别)、OCR 按视觉布局还原换行与段落、以及双目录 + SHA-256 清单校验的应用内更新机制。

2026-09-09 03:51:21 363

原创 Agent 工具粒度设计:别把工具做成聊天脚本

40 个工具让模型越选越错?切分原则:一个业务动词一个工具,参数只留决策字段,返回带 next_hint,确定步骤下沉代码——模型做选择,代码做执行。

2026-09-07 19:29:18 322

原创 数字员工为什么叫 Myna.bot?聊聊产品命名这件小事

产品定名 Myna.bot——一只学得快、干实事的八哥 + 诚实的 .bot 后缀。本文复盘命名思考全过程,附产品命名 checklist,讲清为什么不用 AI 后缀、为什么选 Myna。

2026-09-07 19:19:00 225

原创 做 Agent 架构,本质上是在“研究人本身“——一个 Agent 团队的工程自白

做 Agent 架构像是在研究人本身:把认知、记忆、决策、协作这些人的机制抽象成可运行的系统。本文从一次 X 主帖观点出发,结合 Claude/Grok/Cloudflare 故障的真实教训与我们的上下文工程实践,谈谈 Agent 架构为什么难做、难在哪。

2026-09-03 22:39:44 373

原创 腾讯 WorkBuddy vs 百灵数字员工:两种数字员工架构,到底差在哪?

单 Agent 打天下,还是多 Agent 团队协作?本文从架构、任务编排、记忆机制三个维度对比腾讯 WorkBuddy 与百灵数字员工,附实测分析与选型建议。

2026-09-03 21:18:32 332

原创 [特殊字符] 帝王蟹 vs [特殊字符] 龙虾:两大开源 AI 分身项目源码级深度对比

Self-System**(🦀 帝王蟹):一个 Solo Developer + AI 构建的项目,定位是"数字渐进式分身"

2026-03-03 10:30:56 822

原创 在“极速产出”与“长期打磨”之间:一篇给行动派的产品思维备忘录

在AI产品开发中,应以用户为核心,采用“双引擎策略”平衡快速探索与长期深耕。分发速度(降低TTFV)和信任建设(透明迭代)是关键胜负手。通过10天为周期的敏捷验证筛选机会,30天为阶段打造可依赖的拳头产品。同时需将热点洞察流程化,建立“捕捉-分析-评分-投产”的自动化系统。用可量化的指标(如TTFV≤20秒、7日留存≥15%)控制风险,并在20天无进展时果断调整。最终目标是构建“速度×信任”的复利增长模式,将执行力转化为可持续的产品信用。

2025-10-09 02:34:03 1053

原创 华为准17级程序员,离职 4 个月狂写 108 万行代码!后大模型时代开发新模式经验分享

要学会分任务、挑多模型、多 AI 工具利用、适度代码 review 、及时重构。好的拆解能让 AI 成为你团队里的“熟练工”,实践经验证明说 LLM 不可靠的可以靠边站了。快速部署 域名、证书、备案、公司资质、全球收款( Stripe )、微信/支付宝通道,这些环节要尽量标准化和模板化。技术大会、社群参与,也都是新的“必修学分”。项目做出来,如何传播、如何找到用户、如何做品牌,甚至如何拉合伙人、远程协作,都是必须学习的技能。也欢迎交流你的看法——这是一个真正要重新思考“程序员身份”的时代。

2025-09-25 22:31:20 321

原创 【!!震惊!!】最近一个月,我在 Cursor 上烧掉了 500 刀

AI开发者月烧500刀背后的疯狂生产力 一位开发者为实现「一年100个AI项目」的目标,在Cursor上单月花费500美元,主要开销包括两个Ultra会员账号和API调用费用。他采用15个项目并行开发的模式,涉及多个领域:雅思翻译App、ICO生成工具、消息聚合Agent、微信小程序等。其核心感悟是:执行力比灵感更重要,AI工具极大提升产能但成本惊人。目前他正在推进AI内容生成、拍照教学等新项目,并计划开发跨时代笔记系统。这场实验证明,在充足资源支持下,AI能突破传统开发效率边界。

2025-09-22 05:27:50 555

原创 【一年 100 个 AI 产品挑战】之 ICO APEX|AI 智能图标生成与优化工具

当AI让个人开发者的边界被大幅拓展,我决定在2025年用“一年100个AI产品"的节奏,持续把想法变成可用的软件。这篇文章介绍其中的一款:ICOAI Gen一一一款面向产品经理、设计师与独立开发者的“AI智能图标生成与优化工具”。

2025-09-22 05:05:28 1113

原创 【开源】我把 Everything 和 AI 拼在一起了:用自然语言“秒搜”本地文件

大家好,我做了一个小工具 Everything AI Chat,把 Everything 的极速本地搜索 和 大模型的自然语言理解结合在一起。一句话:你可以像和朋友聊天一样描述要找的文件,工具会把你的话自动“翻译”成精准的 Everything 搜索语法,几乎秒回结果。与其背复杂的搜索语法,不如把需求扔给 AI,让它来写语法、我来拿结果。• 对话式 refine:搜到后还能继续补充条件,比如“只看 50MB 以上的”、“限定在 Downloads 文件夹”。• 首次使用有简单引导,不需要折腾复杂配置。

2025-09-03 02:22:33 1126

原创 GPT-OSS-20B vs Qwen3-14B 全面对比测试

本文对比了开源模型GPT-OSS-20B和Qwen3-14B在9个维度的表现。GPT-OSS-20B在输出速度(4900 token/s)、指令遵循、安全防护和prompt工程方面表现突出,但在中文理解、代码能力和创意写作上弱于Qwen3-14B。Qwen3-14B在中文任务、数值计算和创意写作方面更优。测试还发现GPT-OSS-120B展现出了接近顶级模型的逻辑推理能力。建议根据任务需求选择模型:GPT-OSS-20B适合快速响应和强指令遵循任务,Qwen3-14B更适合中文相关任务。测试结果已开源,完整

2025-08-06 20:23:31 2143

原创 【一年 100 个 AI 产品挑战】开篇|把梦想落在键盘上

7年AI从业者,两次离职创业。2025年我要做“全年100个AI产品”挑战,公开进度与复盘。相信LLM引发软件爆发,随后是营销AI、机器人社会与资源再分配。我想趁前AI时代再突破一次自己。

2025-07-25 02:48:17 769

原创 【部署与总结】从本地运行到公网服务器的全过程

本文详细介绍了将本地游戏AI助手应用部署到公网的完整流程,涵盖本地开发环境配置、Electron应用打包、服务器部署、域名与SSL设置、Nginx配置等关键环节。重点讲解了性能优化、安全措施、监控维护等生产环境必备要素,并提供了自动化部署方案和问题排查方法。总结项目采用Vue3+Electron+Node.js技术栈,分享了架构设计、部署优化的实践经验,最后展望了功能扩展和技术升级方向。该指南为开发者提供了从开发到上线的全流程参考,具有实用价值。

2025-07-05 14:15:40 1158

原创 【AI篇】当Transformer模型开始学习《孙子兵法》

本文探讨了如何将《孙子兵法》的战略思想与AI技术结合,开发实时游戏战术指导系统。系统架构包括战略引擎、分析器和策略生成器,将"知己知彼"等兵法原则转化为可计算模型。通过实时数据处理、动态Prompt生成和多阶段策略流程,实现了开局布局、团战决策等场景的智能建议。模型优化方面注重响应速度和准确度提升,实战测试显示该系统能有效提高游戏胜率。该研究展示了传统智慧与现代AI融合的创新应用前景。

2025-07-05 14:14:19 649

原创 【前端篇】用Vue3和Electron打造电竞感十足的UI界面

本文介绍了使用Vue3和Electron开发电竞风格游戏助手界面的实践。通过分析项目目录结构,展示了主进程管理、渲染进程架构、数据分析展示和实时通信等核心模块的实现。重点阐述了UI设计亮点包括电竞风格、信息层级和响应式布局,以及性能优化策略如渲染优化和通信优化。文章还分享了组件封装、状态管理等开发技巧,并提出了未来优化方向。该方案成功打造了兼具实用性和沉浸感的游戏助手界面。

2025-07-05 14:13:00 1069

原创 【开篇】为什么我要用大模型+孙子兵法改造LOL?

《英雄联盟AI助手:融合孙子兵法与现代AI的战略游戏伴侣》摘要:本项目创新性地将传统东方兵法与现代AI技术结合,开发了一款智能LOL游戏助手。采用Electron+Vue3框架,集成OpenAI API,实现实时战术分析。系统包含游戏数据采集、策略分析引擎等模块,将孙子兵法思想转化为可计算策略模型。通过优化prompt工程和大模型应用,在保证实时性的同时提供实用策略建议。未来计划扩展AI模型支持及团队协作功能,探索传统智慧与前沿技术的深度结合。

2025-07-05 14:08:59 500

原创 【AI】基于生活案例的LLM强化学习(入门帖)

为了让你对“RLHF + 强化学习”的过程有更直观的感受,我们拿一个**“咖啡店机器人”**的故事来类比。你在一家咖啡店里放置了一台机器人服务员,它最初只会死记硬背几句对话,对人的问题经常回答得很僵硬或者不合逻辑。给它示范正确答案(监督微调)“客人问:你们这里的咖啡好喝吗?“机器人标准回答:我们使用新鲜烘焙的咖啡豆,口感醇厚。这样一来,机器人知道“什么叫好答案”。(对应 LLM 的第二阶段:监督微调“我们推荐拿铁。“我们推荐摩卡。“嗯……随便点。

2025-05-07 00:07:26 1029

原创 【技术】Ruby 生态概念速查表,通过对比nodejs生态(入门)

以下是对应概念的速查表,并使用与对比的方式来参照,涵盖名称、作用(或解释)、简单用法、可能的替代方案,以及 Node.js 中最相似或可类比的工具(如果有的话)。有些工具在两个生态中并没有完美对应,但可做近似类比。

2025-04-11 10:38:13 1187

原创 【AI】最近较火的11个开源AI智能体框架深度分析(爆肝!!!)

本文对比分析列出的11个**智能体框架**项目,包括它们的运行原理、架构设计、核心功能、优势亮点以及社区反馈。各项目在多智能体协作、工具集成、任务规划等方面各有特色,下面分述每个项目的关键点。

2025-04-08 00:59:20 6418

原创 【AI热点】meta新发布llama4深度洞察(快速认知)

训练完成的 Behemoth2T 级别的 Llama 4 Behemoth 一旦完成训练并释出,将可能在复杂推理、编程、数学竞赛、STEM 测试等更多细分领域刷新评测记录。也会成为整个开源阵营对抗顶尖闭源(如 GPT 4.5、Gemini 2.5+)的新标杆。开源生态加速Meta 在 Llama 4 中继续强调开源,允许一定程度上自由下载/部署,对于 AI 技术民主化是一次重大推动;同时也需要用户遵守相关政策许可(如不可直接用于 >7 亿用户规模的商用产品,须获授权等)。

2025-04-06 23:03:45 1311

原创 【奇点时刻】GPT4o新图像生成模型底层原理深度洞察报告(篇2)

GPT-4o的图像生成功能,为自回归 Transformer 在视觉领域大规模应用提供了最有力的注脚。它不仅在生成流程上跳出传统“先整体噪声后去噪”或“GAN一次性对抗”的模式,而且与语言模型深度耦合,在理解、构图和可控编辑上展现出前所未有的融合度。这种边画边想、所见即所得的生成方式,或将塑造新的AI+创意设计工作流:用户可以自然语言对话,AI 将每一步的绘制思路逐渐呈现,并能随时依据指令调整。未来,随着更多开源或商业自回归与混合架构出现,曾经由扩散模型独领风骚的格局正迎来新的竞争与机会。

2025-04-05 21:39:56 1229

原创 【奇点时刻】GPT4o新图像生成模型底层原理深度洞察报告

GPT-4O 图像生成的核心突破并非单纯在图像生成质量上的提升,而是把“语言、图像理解与图像生成”更紧密地结合在同一个多模态大模型中,使得人类只需使用自然语言指令就能灵活操控生成过程。从技术角度,最合理的猜测是 GPT-4O 使用了自回归(Transformer)+ 扩散(或高级解码器)的混合路线,既借助自回归大模型的全局语义理解与灵活表达,也保留了扩散或专用解码器对图像细节与一致性的还原。未来,随着多模态大模型的持续迭代,势必还会出现更多跨模态的新功能,例如视频生成、可控动画、AR/VR 实时生成等。

2025-04-05 15:56:39 1084

原创 【AGI周边】Sam Altman 被 OpenAI 董事会解雇及迅速复职事件报告(回顾)

2023 年 11 月 OpenAI 围绕 Sam Altman 上演的“解雇与复职”事件,是科技史上一次引人瞩目的公司治理风波。在短短几天内,创始 CEO 被突然免职、员工集体逼宫、科技巨头介入斡旋,最终剧情反转、CEO 火速复职。这一系列戏剧性事件的背后,折射出人工智能公司在飞速崛起过程中面临的独特挑战:一方面是对超级 AI 潜在风险的深切关注,另一方面是对商业成功和快速创新的执着追求。当理想主义的董事会遇上实用主义的 CEO,冲突一触即发。

2025-04-05 13:08:36 968

原创 【云原生】coder开源项目深度洞察(入门帖)

Coder 平台的 Web 界面示例:开发者可以通过浏览器访问并管理远程开发环境。图中展示了“工作空间”(Workspaces)列表,以及一个正在运行的工作空间详情,包括其CPU、内存等资源使用情况,并列出了多种可连接方式(如本地 VS Code 客户端、文件浏览器、GoLand、网页 VS Code 即 code-server、终端等)。是一个开源的“云开发环境(CDE)”平台项目,支持在自有基础设施(云端或本地服务器)上搭建和托管开发环境。

2025-04-02 14:22:28 1837

原创 【奇点时刻】GPT-4o新生图特性深度洞察报告

GPT4o新生图特性是 OpenAI 在 ChatGPT 产品线上推出的新一代图像生成模型。它融合了当前主流的语言大模型能力与图像生成能力,让用户在同一个对话界面就能从“文字”到“图像”进行联动式创作。主要特征不再局限于文本,GPT4o 可以同时处理图像和文字指令。用户可以连续对生成的图片提出修改请求,模型会在原图基础上再生成新的版本。

2025-04-01 23:15:13 1163

原创 【云原生】Kubernetes CEL 速查表

以下是一份,涵盖了常见的语法、宏、标准函数和一些在 Kubernetes 中常见的使用示例。可在编写或调试 CEL 表达式时用作快速参考。

2025-04-01 11:33:12 973

原创 【DeepThinking】笔记系统底层逻辑思考(篇2)

如何让信息不仅被“记住”,更能被合适地“想起”,乃至“被动推送”到我们眼前。短期内,我们可以通过外部授权与通知触发的方式,初步实现信息回调;中期则可探索更大规模的虚拟环境模拟,让笔记系统不再孤立;远期展望则是搭建一个与我们高度融合的数字化“第二自我”,在虚拟世界中同步我们的行为、判断与需求。无论是个人还是企业,若想在未来社会有效掌控信息与资源,建立一个拥有感知与交互能力的笔记系统,都将是不可或缺的关键一环。

2025-03-24 01:36:47 719

原创 【DeepThinking】四象限时间管理底层逻辑思考

四象限分类法之所以广为人知,是因为它提供了一种简洁而有效的思考框架,将复杂的任务分解成“紧急/不紧急”与“重要/不重要”两个最直观、最常用的判断标准。它的底层逻辑来自于我们对时间(紧急)和价值(重要)的朴素认识。然而,面对现实世界的多变与多维度,想要仅依赖四象限来完成所有任务的优先级判断是远远不够的。我们需要在“紧急”“重要”之外,引入其他正交或非正交的维度,例如资源、收益、团队协作等,以做出更准确的决策。或许,四象限更重要的意义。

2025-03-24 01:34:35 1124

原创 【DeepThinking】笔记系统底层逻辑思考

笔记与历史既紧密相连,又各自拥有不可混淆的属性:历史是不以人们意志为转移的客观事实,而笔记只是我们对历史和思考过程的主观记录和再创造。在这个过程中,“记录本身也是历史”,每一次敲击键盘或涂鸦笔记,都为整体时间轴增添新的事件与思考节点。我们希望通过更细致的时空分层、更灵活的标签系统以及更全面的“透明层”与“光刻”式记录方式,来更好地展现历史的多维度,也让我们对自己思考过程的变化拥有更清晰的掌控和回溯可能。历史永远无法修改,而笔记的意义在于不断地记录、重塑与迭代。

2025-03-24 01:31:35 501

原创 【DeepThinking】事业与精神双成长的底层逻辑思考

无论是精神的成长还是事业的成长,本质上都可以视为一种“神经网络训练”与“应激反应优化”的过程。我们对外部信息做出反复的处理,并在其中寻找规律,形成抽象化的总结,进而在行为上做出调整。从这个角度看,“成长”就是对信息的认知处理不断迭代、综合、升华的过程。精神成长与事业成长从来都不应该是割裂甚至相互对立的。如果我们能认识到“成长”其实是一种神经网络式的迭代训练,那么就能在事业领域的实践中不断汲取养分,同时也在更广阔的生活领域找到自我提升的契机。

2025-03-24 01:29:46 819

原创 【DeepThinking】拖延与情绪管理的底层逻辑思考

即使在一个消极或焦虑的状态下去深挖这些拖延行为与情绪起伏的根源,也并不是无用功。相反,这些当下看似并不高效的思考,恰恰能够在未来成为我们更好地掌控自己时间与情绪的基石。带着问题去行动:当我们开始觉察到拖延的深层动力,情绪发酵的触发点,才能一步一步地拆解它。多借助外部工具与系统:无论是通过笔记、任务管理,还是借助像 GPT-4 这样的语言工具来“过滤”情绪化表达,都是在为理性和有序留出空间。给自己预留成长和调整的弹性:过程中的反复与回潮是正常的,只要不断总结和内化,未来一定能形成更成熟的应对机制。

2025-03-24 01:28:02 1059

空空如也

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除