自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+
  • 博客(659)
  • 资源 (2)
  • 问答 (2)
  • 收藏
  • 关注

原创 告别慢成狗的大模型JSON调用:TypeSafe AI 首个系统1模型 Jev 架构与实战深度解析

系统 1(快系统):自主、直觉、迅速、并行运作,例如认出熟人的脸庞、瞬间判断是否有危险;系统 2(慢系统):深思熟虑、消耗能量、逐步串行推演,例如解复杂的偏微分方程、写一篇议论文。当前市面上的 GPT-4o、Claude 3.5、o1 都在卷系统 2(长上下文、思维链、创意对话)。但软件系统的绝大多数核心逻辑,需要的是高吞吐、毫秒级响应、确定性的系统 1!Jev 不会聊天,不写散文,也不支持多轮问答。它接收程序的状态输入,在单次前向传播中并行返回强类型的决策(Choice, Score, Bool)。

2026-09-19 11:37:50 251

原创 知识库召回率从50%到82%:做完5万分片评测集,我发现了RAG落地的最大盲区

坚持评测解耦:不看大模型表演,只用精确分片召回率衡量检索地基;粗排求广,精排求准:Top-50 宽召回负责拉升召回上限,本地 Cross-Encoder 负责解决同主题跨书撞车;混合检索势在必行:纯向量检索难以完美覆盖特异性专有名词。要干掉最后 18% 的实体漂移,下一步的唯一正道是引入BM25 稀疏检索,构建Dense + Sparse 的双轨 Hybrid 架构!

2026-09-16 09:37:31 178

原创 Claude平台降本增效实战:缓存调优、指令精简与算力校准

正如业内所共识的那样,技术的发展永远是从“能跑起来”走向“精细化工程治理”。欢迎在下方留言探讨,分享你的工程权衡与思考!

2026-09-14 18:48:56 202

原创 从验证到规划:pstack如何支撑月均两千PR的高质量工程交付

正如业内所共识的那样,技术的发展永远是从“能跑起来”走向“精细化工程治理”。欢迎在下方留言探讨,分享你的工程权衡与思考!

2026-09-14 12:33:03 116

原创 用ChatGPT Writing Style与Google Drive构建个人写作风格库,让AI输出真正像你写的

正如业内所共识的那样,技术的发展永远是从“能跑起来”走向“精细化工程治理”。欢迎在下方留言探讨,分享你的工程权衡与思考!

2026-09-14 08:39:57 154

原创 Arc主网9月16日公开上线:Circle入局L1,稳定币金融与开发者生态的早期博弈

正如业内所共识的那样,技术的发展永远是从“能跑起来”走向“精细化工程治理”。欢迎在下方留言探讨,分享你的工程权衡与思考!

2026-09-13 21:33:30 238

原创 从提示词到成品:掌握ChatGPT Images 2.5的14个核心技巧与44个实战范例

正如业内所共识的那样,技术的发展永远是从“能跑起来”走向“精细化工程治理”。欢迎在下方留言探讨,分享你的工程权衡与思考!

2026-09-13 18:36:56 172

原创 从零开发知识库:资料导入之后,真正困难的是什么?

初看之下,知识库似乎只是“导入资料、建立索引、接入大模型”。知识库与通用大模型并不是替代关系。大模型负责理解和组织,知识库负责提供当前问题需要的材料。我正在开发 Digital,一个面向专业书籍、技术文档和配套代码的知识库实践项目。后续我会持续记录项目中的架构选择、实现过程、测试结果、失败案例和维护成本。#知识库 #RAG #Python #大模型 #AI开发。

2026-09-12 17:53:35 110

原创 用Kimi K3构建自主竞品分析师:让AI代理在你睡觉时监控对手并唤醒团队

正如业内所共识的那样,技术的发展永远是从“能跑起来”走向“精细化工程治理”。欢迎在下方留言探讨,分享你的工程权衡与思考!

2026-09-12 12:03:43 92

原创 从评估到强化学习:六场直播构建可训练AI代理的开源实践全解析

不要过早进入强化学习:没有高质量的 SFT 暖机,模型在强化学习中的随机采样很难命中正确解法,导致训练崩溃;始终保持奖励函数的确定性:依赖另一个 LLM 打分往往会带来严重的评分漂移,编译器的退出码与单元测试是最好的度量;注重模型蒸馏:先在百亿级模型上探索出可行策略,再通过在线自蒸馏迁移至 7B/8B 轻量模型,是降本落地的必由之路。

2026-09-12 11:11:58 110

原创 从理论到构建:AI代理工程师的实战进阶路径与核心思维模型解析

在真实的商业落地中,务必谨记“只在关键决策点引入非确定性,其余环节全部由确定性代码防线锁定”。

2026-09-12 10:09:31 182

原创 从理论到构建:AI代理工程师的实战进阶路径与核心思维模型解析

正如业内所共识的那样,技术的发展永远是从“能跑起来”走向“精细化工程治理”。欢迎在下方留言探讨,分享你的工程权衡与思考!

2026-09-12 09:47:21 172

原创 从零构建首个AI代理完整指南:一年前看到能省两周弯路

正如业内所共识的那样,技术的发展永远是从“能跑起来”走向“精细化工程治理”。欢迎在下方留言探讨,分享你的工程权衡与思考!

2026-09-12 08:33:50 47

原创 AN OPENAI ENGINEER JUST SHOWED HOW GPT-6 ASTRA AGENTS SHOULD ACTUALLY RUN IN PRODUCTION

正如业内所共识的那样,技术的发展永远是从“能跑起来”走向“精细化工程治理”。欢迎在下方留言探讨,分享你的工程权衡与思考!

2026-09-10 21:03:06 62

原创 Buat New Trenches, Kalian Bisa Baca Panduan Meta Ini

正如业内所共识的那样,技术的发展永远是从“能跑起来”走向“精细化工程治理”。欢迎在下方留言探讨,分享你的工程权衡与思考!

2026-09-10 17:03:03 109

原创 翻译自 英语

正如业内所共识的那样,技术的发展永远是从“能跑起来”走向“精细化工程治理”。欢迎在下方留言探讨,分享你的工程权衡与思考!

2026-09-10 12:03:16 157

原创 翻译自 英语

正如业内所共识的那样,技术的发展永远是从“能跑起来”走向“精细化工程治理”。欢迎在下方留言探讨,分享你的工程权衡与思考!

2026-09-09 21:19:59 195

原创 告别子Agent重复返工!一文搞懂LangChain多智能体Fork与Isolated上下文编排

别做“两个乐观主义者互相点头”的假审查凡是负责 Lint、测试用例通过率、代码质量检查的 Subagent,严禁使用 Fork 模式!一旦审查者知道了编写者的思路,就会默认顺水推舟,漏掉核心边界 Bug。利用 Fork 终结代码探查内耗让 Worker 去修改代码时,大胆开启 Fork 模式,现代大模型的 KV Cache 机制会帮你把成本压到最低,同时直接将前序推导作为前缀,开发效率立竿见影。终局一定要折叠(Unwind)

2026-09-09 11:30:32 216

原创 告别AI保姆困境:Agent架构演进之从单步Loop到拓扑Graph的全景工程实践

你是否也曾遭遇过这样的尴尬现实:在 IDE 或终端中引入了一套号称“全自主”的 Coding Agent 或自动化任务系统。然而在实际工程开发中,你却根本无法离开工位哪怕五分钟。模型每做一次微小的代码变更,都要弹窗请求你的授权确认;每次运行失败,你都得肉眼去排查到底是哪一步踩了坑。这种现象在业界极其普遍。

2026-09-06 09:28:56 213

原创 告别臃肿脚手架!GPT-6 Astra时代下的Coding Agent重构实录:Skills与AGENTS.md精炼实践

很多开发者从旧模型切换到 Astra 时,最常抱怨的一句话是:“它怎么写了个开头就停下来了?Eric Provencher 在长文中指出,这是因为 Astra 具有更强的人机协作分寸感。面对一条边界模糊的需求,它倾向于快速交付第一版实现,然后等待你的审查。如果你希望它持续深入地完成端到端任务,你必须改变提问习惯,将过去对过程的指手画脚,升级为对最终成果的验收准则(Definition of Done)大模型的发展史,就是一部不断淘汰冗余胶水代码与人为约束的历史。精简 Skills。

2026-09-05 23:29:38 318

原创 写代码正在变得越来越廉价!吴恩达发布5项AI工程核心技能图谱:如何高效驾驭 Coding Agent?

纯代码的廉价化”绝非软件工程的终结,而是工程师角色的全面升级。从键盘敲击者晋升为“人机协同研发体系的架构师与总指挥”你的 Spec 就是新的代码;你的架构审美决定了系统的上限;你的验证体系守住了产品的底线。

2026-09-05 18:05:45 420

原创 硬件虚拟化观测基础:BPF工具与性能分析策略

本文深入介绍Xen与KVM两种硬件虚拟化配置下的BPF观测能力,涵盖超调用(hypercall)、stolen时间、VM退出等关键指标,结合AWS EC2实例演进历程(PV→PVHVM→Nitro)给出guest与host两侧的分析策略,并展示多个基于BCC与bpftrace的实用工具(如xenhyper、cpustolen、kvmexits),帮助开发者系统掌握硬件虚拟化性能观测方法。

2026-07-29 08:26:43 485

原创 G1 GC并行线程调优:从日志诊断到性能提升

本文从G1 GC的并行线程入手,解释Parallel Workers和Concurrent Workers在Stop-the-World和并发标记阶段的作用。通过GC日志中的“Using X workers of Y”和初始化参数,诊断线程数过少或过多导致的性能问题,并提供从默认值起步、逐步调整的实践建议,帮助开发者平衡CPU利用率和暂停时间。

2026-07-28 14:28:47 346

原创 Bash数组进阶:追加、切片、排序与mapfile

深入Bash数组的高级操作:使用+=追加元素,通过read -a和mapfile读取数据,利用切片提取子数组,对数组进行排序,以及使用unset删除元素。本文还讨论了空赋值与无下标引用的陷阱。

2026-07-28 12:23:41 483

原创 单体 vs 微服务:LLM 推理服务架构选型与 LLM Twin 实践

本文对比了单体架构与微服务架构在 LLM 推理服务中的优劣,重点分析 GPU 资源利用率、独立扩展能力和团队协作复杂度。结合 LLM Twin 项目的具体设计方案,展示了如何通过微服务拆分业务逻辑与 LLM 推理、集成 RAG 流程,并给出从单体迁移到微服务的实践建议。

2026-07-28 10:58:37 254

原创 Python内存优化入门:从对象开销到高效数组与NumExpr

本文面向中级Python开发者,系统性地介绍从对象结构到专用工具的内存节省方法。先揭示Python原生对象(int、list等)的高昂内存开销,接着讲解如何用array模块紧凑存储数值类型以大幅降低RAM占用。再通过实测对比展示NumExpr如何通过块状计算和并行化减少大型NumPy向量的临时内存占用。最后介绍sys.getsizeof与pympler.asizeof的局限和用法,以及字节与Unicode字符串的存储差异,帮助读者构建系统性的内存优化观。

2026-07-28 09:28:43 27

原创 Guest虚拟机观测实战:Xen超调用与CPU Stolen时间

本文详细介绍如何从Guest虚拟机侧使用BPF工具对Xen PV超调用进行追踪,包括利用tracepoints统计调用频率、使用funclatency测量flush延迟,并解析xenhyper工具源码。同时介绍Xen回调中断的观测方法以及cpustolen工具对CPU stolen时间的分析。涵盖实用命令、参数解读与常见误区,适合系统性能工程师和虚拟化运维人员。

2026-07-28 08:26:25 32

原创 数据库与知识库集成:从静态RAG到Agentic检索

AI Agent需要访问外部知识库以获取实时或领域特定信息。本文从结构化数据的SQL查询到非结构化数据的RAG,重点介绍Agentic RAG——智能体如何主动选择检索策略、优化查询并综合多源信息,提升答案的准确性和相关性。

2026-07-27 18:13:31 298

原创 巧用Trace ID与Span:Java分布式系统故障排查实战

本文通过一个电商订单丢失的真实案例,系统讲解分布式追踪中的核心概念——Trace ID和Span。介绍OpenTelemetry、Jaeger、Zipkin等工具的采集与可视化原理,并展示如何利用Trace Tree定位Kafka反序列化失败的根本原因。同时补充Sentry如何捕获异常并关联Trace ID,帮助开发者实现故障的快速闭环。

2026-07-27 14:28:43 188

原创 Bash关联数组详解:键值对、高效查找与多维数组模拟

Bash 4.0+支持的关联数组以字符串为索引,实现键值对存储。本文介绍如何声明、赋值、遍历关联数组,并通过查找脚本展示快速检索数据的能力。同时演示如何利用关联数组模拟多维数组,突破一维限制,提升Shell编程效率。

2026-07-27 12:24:21 158

原创 实战:在 AWS SageMaker 上部署 LLM 推理服务并集成 FastAPI 业务层

手把手教程,从 IAM 角色配置到 SageMaker 端点部署,再到 FastAPI 业务服务搭建,完整实现 LLM 推理管道的端到端部署。最后讲解基于 SageMaker 的自动扩缩策略,确保系统应对流量峰值的同时控制成本。

2026-07-27 10:58:15 212

原创 大规模文本数据的内存压缩:Trie树与特征哈希技巧

面对大量字符串的存储与查询,常规list/set会消耗数GB内存。本文详细介绍Trie(前缀树)结构,并以Marisa trie为例展示如何将1.2GB的字符串集合压缩至39MB。同时介绍scikit-learn中的FeatureHasher,通过哈希避免维护大规模词汇表,并对比稀疏矩阵在内存与计算上的优势。

2026-07-27 09:28:48 36

原创 KVM Host侧观测:VM Exits深度分析工具

本文介绍如何在KVM Host侧观测虚拟机退出事件(VM Exits),重点分析基于bpftrace实现的kvmexits工具。文章先对比传统perf kvm stat live工具,然后详细拆解kvmexits的原理、输出解读和源码实现,并讨论host侧追踪面临的挑战(如缺乏guest符号表)及未来可能的解决方向。适合KVM虚拟化性能调优的开发者阅读。

2026-07-27 08:26:23 36

原创 同步与异步调用:优化AI Agent工具的执行效率

本文从性能与架构角度,详细讲解同步调用(阻塞等待)和异步调用(非阻塞并行)的核心概念,并通过Python示例(文件读取、批量销售报告)展示如何在AI Agent中应用异步模式。讨论如何根据任务特性选择合适模式,以及LangChain、Semantic Kernel等框架对同步/异步工具的支持。帮助开发者写出更高效、可扩展的Agent工具。

2026-07-26 18:14:19 127

原创 序列化陷阱:Protobuf与gRPC版本兼容性问题调试指南

深入分析微服务通信中因Protobuf枚举值变更、字段增减等序列化变化导致的静默故障,介绍日志安全记录、CI模式验证、Confluent Schema Registry及protoc/grpcurl等调试工具,帮助开发者构建数据契约演进的防御措施。

2026-07-26 14:28:55 111

原创 组命令 vs 子shell:深入理解Linux Shell中的命令组合方式

详细对比bash中组命令({})和子shell(())的语法、用法及在重定向和管道中的应用,通过代码示例深入剖析二者在环境隔离、变量修改和性能方面的关键差异,并给出编写高效脚本的优选建议。

2026-07-26 12:35:21 212

原创 bash进程替换:管道中变量赋值问题的解决方案

本文深入分析管道命令中子shell导致变量赋值(如read)失效的根源,引出bash进程替换机制。通过<(...)和>(...)两种语法详解、底层/dev/fd原理、以及完整的pro-sub脚本示例,演示如何用进程替换替代管道来保留父shell的变量修改。同时对比组命令与子shell区别,帮助读者彻底理解并正确使用这一高级技巧。

2026-07-26 12:24:57 180

原创 从零构建高性能文本检测模型:经验与教训

本文分享了在开发文本检测CNN模型过程中遇到的挑战和解决方案,包括数据审视、定制分析工具、评估指标选择以及假设驱动的研究方法,最终实现了超越现有方案的性能。

2026-07-26 09:28:25 117

原创 Vector与Performance Co-Pilot:基于BPF的远程性能监控可视化工具

本文深入讲解Netflix开源的Vector工具与Performance Co-Pilot(PCP)框架如何结合,通过BCC PMDA远程监控BPF指标。对比热力图与传统命令行工具的优势,介绍安装配置、内部机制及实践步骤,帮助开发者高效构建可观测性系统。

2026-07-26 08:27:06 128

原创 网络再保险中的Python高性能实践:防御代码与MLOps

本文基于网络再保险的风险评分项目TIDE,结合Gallagher Re的实战经验,深入讲解如何通过防御性编程、数据质量验证、测试框架以及系统化平台思维(MLOps)来提升数据科学系统的性能和可靠性。适合金融行业数据科学家和ML工程师阅读。

2026-07-25 09:29:55 123

Manning.F#.Deep.Dives.2014.12.pdf

Manning.F#.Deep.Dives.2014.12

2023-08-08

Manning.Neo4j.in.Action.2014.12.pdf

Manning.Neo4j.in.Action.2014.12.pdf

2023-08-08

通讯录 代码大全

基本上实现了通讯的基本信息,用了列表框,并实现了按钮颜色的设置在其中还可以对其进行简单的修改

2011-10-23

系统设计 算法实现 线性规划

系统设计用vc6.0实现、造船和选址等问题

2011-10-23

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除