自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+
  • 博客(187)
  • 资源 (1)
  • 问答 (1)
  • 收藏
  • 关注

原创 ffly-plus 又又又一个`gin` demo项目,带你快速上手用`gin`进行`web`开发!!!!

ffly-plus又又又一个gin demo项目,带你快速上手用gin进行web开发, 在这个demo项目中,你可以学到项目结构设计、gorm的使用、gin中间件的编写、DB设计规范、Swagger文档生成、配置文件解析库viper使用、使用JWT进行身份鉴权认证、使用sentinel-go进行QPS限制、Makefile文件编写、项目文档结构设计和相关内容编写github: https://github.com/colinrs/ffly-plusffly-plus一款适合于快速开发业务的 Go G

2020-10-30 01:03:54 814

原创 写代码不再是瓶颈之后,软件研发流程该怎么改

解读 Anthropic 的 AI 原生 SDLC 手册:代码不再是瓶颈,卡点移到评审与验收。用 intent、spec、plan 三类制品串联流程,判定交给确定性脚本,批准权始终留在人手里。

2026-09-04 00:15:00 326

原创 从聊天系统到 AI 智能客服:大促期间如何不雪崩、分层路由、流式响应与成本优化

大促峰值时,每条消息都送进大模型,队列、连接和成本会被绑在一起。本文给出 AI 客服方案:L0/L1/L2 分层路由、版本化缓存、SSE 背压、依赖图并行、过载保护,以及延迟与 Token 双预算。

2026-08-31 12:45:00 657

原创 从聊天系统到 AI 智能客服: 从文本到图片与情绪、多模态客服与实时智能分流

本文探讨了面向售后场景的多模态AI客服系统设计,聚焦图片处理和情绪分析两个关键环节。系统强调将视觉模型输出转化为受限证据对象,而非直接用于业务决策,并通过结构化流程实现图片上传、安全扫描、质量检查、视觉信息抽取和交叉验证的严格分离。情绪线索则转化为随时间变化的动态升级风险分,配合滞回和冷却机制避免路由抖动。整体设计追求可追溯性,确保图片、模型输出和路由决策都能关联原始数据和处理版本,同时防范多模态提示注入和个人信息泄露风险。技术方案包含对象存储隔离、证据契约、受限查询计划和防注入处理,适用于需要平衡自动化效

2026-08-27 09:00:00 361

原创 我用 Rust 写了一个 SSH 本地端口转发管理器:Via 的实现与取舍

工作中访问内网的数据库、缓存和搜索服务,我一直在跳板机后面开 SSH 本地端口转发,再用一堆 bash 脚本统一启动这些隧道。脚本越攒越多,散在各个目录,哪条规则改过、哪个隧道断了,全靠记忆和手动重跑。市面上有终端、有 SFTP 工具,但没有一个专门用来统一管理和记录 SSH 本地转发的,所以我写了 Via——一个 macOS 桌面端的 SSH 本地端口转发管理器。读完这篇文章,能判断它适不适合自己的工作流。仓库地址:https://github.com/colinrs/via。

2026-08-22 11:30:00 652

原创 从聊天系统到 AI 智能客服: 向量检索到证据治理、混合召回、重排与防幻觉设计

本文探讨了AI智能客服系统中如何构建可信的混合检索架构,重点解决回答依据可追溯的问题。文章提出将检索层设计为Evidence收集器,通过结构化查询、稠密向量检索和稀疏检索等多路径获取证据,并统一为可验证的Evidence格式。系统采用分层设计:检索层负责证据收集,生成层基于证据约束输出,校验层验证回答与证据的一致性。作者强调了查询路由器的关键作用,建议使用受限查询计划确保安全性,并指出不同数据源应按事实类型分工。该架构旨在保证每个事实性结论都有明确来源,在证据不足或冲突时停止猜测,从而提升AI客服的可信度和

2026-08-19 08:45:00 705

原创 从聊天系统到 AI 智能客服:让 AI 安全执行业务, Agent、Tool Calling 与状态机编

本文探讨了业务执行型智能客服Agent的设计方法,提出将语言理解与业务执行分离的架构思路。核心观点包括: 风险控制机制:通过将事实查询、权限校验和副作用提交交给受约束的服务端流程,确保模型只负责语言理解,不直接执行敏感操作。 分层自治设计:建议采用"Workflow中嵌入有限Agent"的模式,Agent处理语言歧义和信息收集,业务系统和Policy Engine负责状态验证和权限控制。 状态图管理:使用LangGraph构建显式状态机,通过节点和边明确定义流程分支,包括槽位收集、事实查询、准备变更、审批等

2026-08-17 09:45:00 227

原创 从聊天系统到 AI 智能客服:第一期架构、产品边界与技术选型

本文是AI智能客服技术专题的第一期,主要探讨如何从基础聊天系统升级为智能客服系统的架构设计和技术选型。文章从产品边界、消息处理流程和会话模型三个维度展开: 产品边界:系统聚焦单店铺部署,覆盖售前咨询、商品问答、物流查询等场景,但不直接处理高风险操作。提出分层设计原则,确定性业务由代码控制,不确定性语言理解交给LLM。 消息处理流程:详细描述了从用户发送消息到系统响应的完整链路,包括持久化顺序、状态机设计和事件流处理。特别强调了SSE协议在实时消息传递和断线恢复中的作用。 会话模型:设计了Visitor-Se

2026-08-14 08:45:00 36

原创 如何做高效的库存预留:三种主流方案的工程取舍

本文探讨了电商库存预留的三种主流技术方案及其优劣对比。作者基于Shopify工程团队的实践,结合自身经验,重点分析了Redis+MySQL混合方案、Redis锁+MySQL条件更新方案和纯MySQL方案。文章首先明确了库存预留的业务场景和技术挑战,指出核心问题在于"库存真相存储位置"的选择。随后详细拆解了三种方案的数据模型、实现逻辑和潜在陷阱,特别强调了幂等性处理、数据一致性保障等关键点。通过对比表形式,从实现难度、性能上限、维护成本等维度进行横向评估,指出不同规模企业的最优选择方案,并提醒避免生搬硬套大厂

2026-08-12 00:15:00 664

原创 Go GC 的十四年:从 STW 一秒到 100 微秒,再到 Green Tea 改写物理成本

▎ Go GC 14 年把 STW 从一秒压到 100μs:前十年的算法(三色、写屏障、Pacer、异步抢占)解决「准不准」,后两年的 Greenea + SIMD 把扫描单位从对象换成页,重新组织数据在 CPU 上的位置——把软件问题做成硬件问题。

2026-07-27 13:30:00 17

原创 多租户隔离 从手工到自动 4 种方案对比:白名单、显式标记、Model 接口、AST 改写

多租户 SaaS 系统中,手动给每个查询加 WHERE tenant_id = ? 既重复又容易遗漏。本文用 GORM Plugin 机制实现自动注入,对比白名单、显式标记、Model 接口、SQL AST 改写四种方案,给出选型建议。

2026-07-15 07:00:00 212

原创 AI 时代的经验悖论:你今年积累的经验,明年还值钱吗?

AI 让写代码变快了,但也让"失控"变容易了。这一年如果你把活全交给 AI、自己不验证,积累的经验可能约等于零。但复杂系统的判断力和验证能力,恰恰是 AI 现阶段做不到的。问题不是"会不会被替代",而是"你攒的到底是哪一层经验"。

2026-07-10 05:00:00 12

原创 Elasticsearch Ingest Pipeline 指南:从处理器到插件扩展与大模型向量化

本文适合有一定 Elasticsearch 使用基础、想系统掌握数据预处理机制的开发与运维同学。涵盖 Ingest Pipeline 概念原理、_ingest/pipeline API 实操、插件扩展机制、HTTP 限制与替代方案,以及在 AWS 环境下结合大模型做向量化的落地选型。

2026-07-08 11:30:00 320

原创 PostgreSQL 实时数据同步:基于逻辑复制的 CDC 实战

本文从 PostgreSQL 逻辑复制原理讲起,对比内置订阅、Debezium+Kafka、pglogrepl 等主流 CDC 方案的取舍,并用 Go + pglogrepl 从零搭建一套完整可运行的数据库变更追踪系统,覆盖环境配置、代码实战、测试验证到生产落地的关键工程问题。适合后端开发者和架构师阅读。

2026-07-06 07:45:00 771

原创 macOS 26 上一个诡异的 Python Bug,我排查了整整一个晚上

在 macOS 26 上用 pipx 装工具,报 platform.mac_ver() 返回空值。排查发现根因是 Homebrew 本地编译的 Python 跟 Apple 的版本兼容机制打架。解决方案:卸载 Homebrew Python,换 uv 管理的官方 CPython,或者去 python.org 下安装包。从此 Python 环境交给 uv,不再踩这个坑。

2026-06-26 10:30:00 351

原创 Claude Code 偷偷给你的 API 加了「料」:第三方模型缓存集体翻车事件揭秘

Claude Code 从 2.1.36 版本起,在 system prompt 里偷偷注入了一个每次请求都会变化的 cch 字段。第三方 API 代理把它当成内容算进了缓存 key,导致 KV Cache 命中率从 90%+ 直接归零,token 消耗暴涨 20 倍。本文揭秘了这个隐藏机制的逆向发现,并给出了三种修复方案。

2026-06-23 10:30:00 275

原创 Code Review 要完了?一篇论文说 AI Agent 正在接管代码审查

我经历过 Code Review 的两个阶段:纯手工时代,薛定谔的等待,同一段代码换三个人审出三种意见;AI Agent 时代,秒级反馈,立场中立。Google 数据说开发者 10%~15% 的时间在 Review,Microsoft 说 Code Review 不找 Bug。这篇基于 KTH 皇家理工学院最新论文,聊聊为什么强制人类审查的理由在技术上已经站不住了——以及怎么用双层 Agent 保险把它落地。

2026-06-22 09:45:00 394

原创 GORM 的并发安全是怎么实现的?翻源码就知道了

> **一句话简介**:拆解 GORM `clone` 字段的写时复制机制,搞懂 Go ORM 并发安全的底层逻辑。>> **核心看点**:> 1. 四宗罪——真实复现 GORM 并发不安全的四类问题(条件污染/条件丢失/map panic/Session panic)> 2. 三态机制——clone=1/2/0 的状态流转与 `getInstance()` 源码解析> 3. 三张时序图——安全派生、不安全复用、事务深拷贝的隔离过程> 4. 实践范式——4 类安全模式 + 3 类反模式 + 封装

2026-06-20 09:00:00 358

原创 两步配置Codex与ClaudeCode代理

核心思路:不开系统代理、不开 TUN 模式,只给真正需要代理的程序单独配代理,其余软件直连。 第一步:设置终端环境变量(适用于 Claude Code CLI 等命令行工具) 在 ~/.zshrc 中写入 HTTP_PROXY、HTTPS_PROXY、ALL_PROXY、NO_PROXY 四个环境变量,指向本地代理客户端端口。配置后所有从终端启动的程序自动走代理,Claude Code CLI 无需额外操作。 第二步:给桌面程序单独配代理(适用于 Codex Desktop,三种方案)

2026-06-19 10:32:54 1416

原创 从 Prompt 到 Loop:AI 工程到底在卷什么

AI 工程正从单次 Prompt 优化转向自动化系统设计。文章提出四层工程栈框架:1) Prompt 层确保单次调用质量;2) Context 层解决信息供给问题;3) Harness 层构建可靠性保障机制;4) Loop 层实现自主持续运行。当前挑战已从"模型理解"转为"系统可靠性",需关注生成与验证分离、自动化评估、成本控制等关键设计。成熟的AI应用需兼顾准确率、任务完成率和失败恢复能力,最终目标是构建能自我验证、持续迭代的自动化系统。

2026-06-16 07:57:26 331

原创 读完这篇论文,我对“软件工程“有了完全不同的想法

Brooks 在《人月神话》里分了偶然复杂度和本质复杂度。几十年过去,前者被消灭得差不多了,后者——组件数量指数爆炸带来的交互路径——始终没解。Agent 范式做的事很简单:不再要求人预先遍历整个解空间。LLM 的推理能力随训练算力增长,解空间的大小不再受限于你的认知天花板。不是快 10%。是能处理的问题类型变了。你正在写代码,还是在指挥 Agent 去拿到一个结果?这个问题,可能跟你未来十年的职业位置有关。

2026-06-10 23:34:21 351

原创 从工程师到管理者:一个技术 Leader 的自我修炼

摘要 本文探讨了技术管理者从工程师角色转型的核心挑战与关键能力。优秀的技术管理者需要具备技术判断力、业务理解力和团队领导力三种核心能力,并在对上承接战略、对内平衡矛盾、对下扫清障碍三个站位上发挥作用。日常管理需聚焦五大模块:业务技术匹配度、团队人才结构、项目风险管控、技术债务治理和成本资源管理。文章还指出了三个常见陷阱:沦为高级程序员、只顾交付不建设和预期管理失控,强调管理者应建立容错不纵错的文化。技术管理本质是持续迭代的认知升级,从"做事的人"转变为"让事情发生的人"。

2026-06-07 12:00:43 239

原创 构建 AI 原生企业:从架构原则到工程落地

上层:正确的架构原则架构优先,模型其次信任内建,而非外挂统一数据,消除孤岛人机协作,渐进成熟以业务结果衡量价值中层:成熟的设计模式根据场景特征选择合适的模式从简单模式起步,逐步演进下层:扎实的基础设施治理脚手架:标准化工具、内建安全、统一协议度量基础设施:安全、可用性、质量、生产力四维追踪工作流集成:AI 嵌入已有流程,双轨驱动采纳技术栈:AI Gateway + MCP + 双层护栏 + 编排层AI 编码工具和智能体系统都不是银弹。

2026-05-30 23:10:20 458

原创 AI 智能体入门指南:你需要知道的一切

AI智能体入门指南:核心概念解析 AI智能体是通过感知环境并采取行动实现目标的自主系统。本文概述了智能体的核心特征: 核心定义:智能体由环境、工具和行动三大要素构成,能够感知环境并执行特定任务 工具分类: 知识增强工具(如网页浏览、数据检索) 能力扩展工具(如计算器、代码解释器) 写入操作工具(如数据库更新、邮件自动化) 规划机制: 包含计划生成、验证、执行和反思四个阶段 采用分层、逐步、并行和动态等规划方法 反思能力:通过自我批评、错误分析和重新规划实现持续改进 AI智能体正在变革各行业,从日常助手到专业

2026-02-14 23:56:20 943

原创 Image-to-3D — 让 2D 图片跃然立体*

系统采用全异步 FastAPI 后端 + React + Babylon.js 前端架构,提供上传图片 → 任务创建 → 实时进度跟踪 → 3D 模型预览与下载的全流程体验。支持多视角输入(主视图 + 背/左/右),显著提升几何精度与细节还原;后端集成任务调度器自动轮询状态,异步处理结果 ZIP 包解压与存储;前端使用 Babylon.js 实现专业级 PBR 渲染、环绕相机、软阴影与后处理效果。

2026-01-30 18:58:06 997

原创 语义搜索系统原理与实现

本文介绍了一个基于Flask的多模态语义搜索系统,该系统结合了Milvus向量数据库和Elasticsearch全文检索,能够理解用户查询意图并返回语义相关结果。系统采用Sentence-BERT和CLIP模型实现文本和图像的向量化,支持自然语言搜索、图像搜索和跨模态搜索。技术架构包含语义理解、向量检索、混合排序和结果缓存等功能模块,通过将语义搜索与传统检索相结合,显著提升了电商场景下的搜索体验。项目采用微服务架构,包含完整的API层、服务层和数据访问层,并提供了容器化部署方案。

2026-01-30 17:57:28 761

原创 在 go-zero 中优雅使用 Google Wire 实现依赖注入

本文介绍了如何在go-zero微服务框架中结合Google Wire实现优雅的依赖注入。go-zero提供完整的微服务工具链,而Wire作为编译期依赖注入工具,能避免运行时反射性能损耗。文章展示了项目结构示例,并详细说明了实施步骤:首先定义各层依赖关系(Repo、Manager、Logic),然后通过Wire生成依赖注入代码,包括创建Wire Set组合和初始化函数。最后提供了Wire生成代码示例和Makefile命令,展示了如何自动生成服务上下文初始化代码。这种组合能实现清晰的依赖管理、自动初始化流程和更

2025-10-20 14:55:32 901 2

原创 异步任务使用场景与实践

本文介绍了异步任务处理的典型场景与实现方案,重点分析了Go语言中的Asynq框架。文章首先定义了异步任务的概念及其非阻塞特性,列举了发送通知、数据处理等常见应用场景,并强调数据一致性、错误处理等注意事项。随后对比了四种异步设计方案的特点和适用场景,从简单异步任务到复杂任务管理式设计。最后详细讲解了Asynq框架的架构组成、代码实现、延迟任务设置以及监控管理功能,为开发者提供了完整的异步任务处理解决方案。文章通过清晰的架构图和代码示例,帮助读者理解如何在实际项目中应用异步任务处理机制。

2025-10-14 23:29:31 1132

原创 Agentic Commerce Protocol(ACP):开启对话式购物新时代

OpenAI 推出 Agentic Commerce Protocol(ACP),让用户可在 ChatGPT 内对话式完成商品搜索、下单与支付。ACP 已与 Stripe、Shopify、Etsy 合作试点,商家可借此获得流量红利和转化提升。系统需实现标准化接口与数据同步。ACP 仍在早期,建议企业分阶段探索接入。

2025-10-13 12:08:02 1672

原创 1v1 管理者提醒清单

这篇1v1结构化对话提纲为管理者提供了详细的30-60分钟谈话框架。包含四个核心环节:开场寒暄(3-5分钟)建立融洽氛围;动机与成长探讨(10-15分钟)了解员工成就感、发展需求和对齐目标;挑战解决(10-15分钟)共同分析工作痛点和优化方案;管理偏好沟通(5-10分钟)协商最佳反馈方式。最后5分钟明确行动项和支持承诺。附带的提醒清单强调倾听、建立信任、目标对齐等关键管理行为。整个流程注重双向沟通,旨在激发员工主动性并定制个性化管理方案。

2025-06-25 11:14:07 504

原创 线上问题的定位与优化-pprof、holmes和pyroscope

文章主要围绕线上问题定位与优化展开,重点介绍了在Golang技术栈中如何利用性能分析工具(如pprof)及其改进方案(holmes和pyroscope)来解决复杂的性能问题。pprof适用于基础性能分析,但手动操作限制了其在复杂场景中的应用。holmes和pyroscope通过自动化和持续采样弥补了这一不足,分别适用于异常现场捕获和长期性能监控。

2025-03-02 11:21:30 1586

原创 微服务监控与Go服务性能分析

在微服务架构下,服务监控至关重要,能够帮助快速发现问题,提升稳定性。同时,在Go服务中,性能瓶颈的排查依赖于pproftracedelve等工具,针对 CPU、内存、Goroutine、GC 等关键部分进行优化,以保证系统的高性能和稳定性。接口性能分析是保障微服务稳定性和高效运行的核心环节。通过关键指标监控、瓶颈分析、压测、优化策略,可以有效提升接口的吞吐量、降低延迟和错误率,确保系统稳定可靠。结合等工具,可以精准定位问题,持续优化微服务接口性能。

2025-02-18 17:30:27 1121

原创 电商系统-产品经理

电视产品经理的工作体系:

2024-12-25 00:06:35 534

原创 深入理解延迟队列:原理、实现与应用

延迟队列是一个在实际业务中非常有用的组件,通过Redis实现的延迟队列具有高性能、可靠性好、实现简单等优点。在实际应用中,需要根据具体业务场景选择合适的实现方案,同时注意性能优化和可靠性保证。延迟队列的实现没有银弹,关键是要理解业务需求,在性能、可靠性、复杂度等方面做出合理的权衡。通过本文介绍的实现方案和最佳实践,相信读者能够更好地理解和使用延迟队列。

2024-12-20 23:15:58 2135

原创 短 URL 系统是怎么设计的?

短链系统是一个集数据追踪、用户体验优化于一体的实用性服务,通过巧妙的算法和高效的存储机制,为用户提供便捷的链接服务。

2024-12-20 22:39:10 1575

原创 2500 行代码!!使用gozero 开发一个分布式ID生成服务

分布式ID生成策略Snowflake 算法:依赖第三方库,快速生成全局唯一ID号段模式:通过数据库事务更新 max_id,批量获取ID段本地缓存机制定期同步数据库 bizTag 信息减少数据库查询,提高系统性能支持自动缓存刷新SDK 设计预获取 ID 列表,维持 1000 个 ID 缓冲异步补充 ID,保证业务持续性支持平滑获取分布式 ID。

2024-12-14 22:41:28 972

原创 全局唯一ID生成方案详解

性能要求可用性要求ID长度限制是否需要递增是否需要包含业务含义是否需要分库分表没有最好的方案,只有最适合的方案。应该根据具体业务场景和需求来选择合适的ID生成方案。

2024-11-28 00:25:39 1580

原创 系统分析与重构指南:现代软件工程的质量提升策略

系统分析与重构是一个持续的、系统性的过程。通过科学的方法论、先进的技术手段和严谨的实施流程,企业可以不断优化软件系统,提升技术竞争力。关键在于:建立前瞻性的技术视野,保持对系统架构的敏感性,并始终以提升用户体验和系统性能为根本目标。

2024-11-21 01:11:34 994

原创 分布式系统稳定性建设-性能优化篇

系统稳定性建设是系统工程的核心内容之一。

2024-11-20 00:04:40 1912

原创 分布式系统稳定性建设-高可用篇

分布式系统稳定性建设-高可用篇

2024-11-18 08:59:47 1421

python3.x爬虫代码

python3.x爬虫代码

2016-07-20

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除