Elastic 中国社区官方博客

关于 Elastic Stack 及相关的任何技术

  • 博客(3149)
  • 资源 (9)
  • 收藏
  • 关注

原创 Elastic 线下 Meetup 将于 2026 年 11 月 7 号下午在南京举行

<think>我们只需要根据内容生成摘要,不超过150字。摘要应涵盖活动基本信息、时间地点、主题亮点等。注意字数限制。</think>2026 Elastic Meetup 南京站由Elastic与新智锦绣联合举办,11月7日在南京浦口举行。聚焦ES向量搜索、AI Agents、零外泄安全分析、大模型记忆中心及集群巡检,多位技术专家分享实战,含茶歇抽奖,诚邀开发者报名参加。

2026-09-01 15:43:16 1183

原创 Elastic 9.5: Columnar 、 VectorDB 索引模式与自动校准,以及由 AI 驱动的告警分类整理

Elastic 9.5平台正式发布,带来多项创新功能:1. 新增Columnar Mode列式存储模式,可显著减少存储空间并提升查询速度;2. 推出Vector DB索引模式和自动校准功能,实现开箱即用的向量搜索;3. 原生支持Prometheus和PromQL,便于迁移监控工作负载;4. 强化AI Agent构建能力,包括可观测性监控和人机协同审批;5. 安全方面引入Attack Discovery功能,可自动验证告警并生成检测规则;6. 增强端点防护能力,支持Windows on ARM设备。该版本还改

2026-08-05 10:09:22 960 1

原创 Elastic:如何成为一名 Elastic 认证工程师,Elastic 认证分析师及 Elastic 认证可观测性工程师

Elasticsearch 无疑是是目前世界上最为流行的大数据搜索引擎。根据 DB - Engines 的统计,Elasticsearch 雄踞排行榜第一名,并且市场还在不断地扩大:能够成为一名 Elastic 认证工程师也是很多开发者的梦想。这个代表了 Elastic 的最高认证,在业界也得到了很高的认知度。得到认证的工程师,必须除了具有丰富的 Elastic Stack 知识,而且必须有丰富的操作及有效的解决问题的能力。拥有这个认证证书,也代表了个人及公司的荣誉。针对个人的好处是,你可以..

2020-10-28 11:54:13 28432 19

原创 Elastic:开发者上手指南

你们好,我是Elastic的刘晓国。如果大家想开始学习Elastic的话,那么这里将是你理想的学习园地。在我的博客几乎涵盖了你想学习的许多方面。在这里,我来讲述一下作为一个菜鸟该如何阅读我的这些博客文章。我们可以按照如下的步骤来学习:1)Elasticsearch简介:对Elasticsearch做了一个简单的介绍2)Elasticsearch中的一些重要概念:cluster,n..........................................................

2020-02-25 20:01:55 174770 105

原创 Elastic:培训视频 - ​在生产环境中配置 Fleet Server 和 Elastic Agent 之间的安全

在这篇文章中,我将会把我写的有些内容录制成视频,供大家参考。希望对大家有所帮助。优酷的视频频道地址在这里。Elastic 简介及Elastic Stack 安装:优酷,腾讯 Elastic Stack docker 部署:优酷,腾讯 Elasticsearch中的一些重要概念(Cluster/Shards/Replica/Document/Type/Index):优酷,腾讯 开始使用El...............

2020-01-06 15:31:54 19690 12

原创 Elasticsearch 简介

Elasticsearch是一个非常强大的搜索引擎。它目前被广泛地使用于各个IT公司。Elasticsearch是由Elastic公司创建并开源维护的。它的开源代码位于https://github.com/elastic/elasticsearch。同时,Elastic公司也拥有Logstash及Kibana开源项目。这个三个开源项目组合在一起,就形成了 ELK软件栈。他们三个共同形成了一个强大的...

2019-08-08 16:04:31 177281 32

原创 将 Vercel 数据导入 Elastic:无需安装任何东西的无服务器可观测性

通过API key与Vercel Drains,可将日志、Trace、SpeedInsights、WebAnalytics及审计日志无缝导入ElasticCloud,实现无服务器可观测性。无需部署agent,基于OpenTelemetry的OTLP直接传输,数据自动分流入Elasticsearch。Kibana提供仪表板、告警与SLO模板,支持端到端Trace追踪与服务地图,全面覆盖真实用户性能与故障排查,助力快速定位问题根源。

2026-09-11 09:48:31 149

原创 Elastic Agent Builder 中能够引用证据的 AI 根因分析

本文展示如何通过三个自定义ES|QL工具(rca_failure_shapes、rca_version_split、rca_evidence_sample)增强Elastic AgentBuilder的AI根因分析能力。在一次故障事件中,工具成功排除部署和巧合故障,精准定位fx-rates缓存过期为根因,并生成可验证报告:每个结论均附带trace_id、文档_id及对应查询。72秒内完成11次调用,实现可复现、可审计的自动化根因分析,提升SRE效率与决策可信度。

2026-09-10 17:50:37 382 1

原创 Elasticsearch 向量数据库:几分钟内完成部署,以经济高效的方式扩展至数千亿规模

Elasticsearch向量数据库是一款无服务器、开箱即用的向量搜索服务,专为RAG、AI代理和语义搜索优化。它自动处理嵌入生成、索引调优与存储压缩,支持JinaAI等模型的托管GPU推理,通过bfloat16、BetterBinaryQuantization等技术降低存储成本并提升性能。内置混合搜索与过滤向量检索,结合企业级安全与可预测定价,助力开发者快速构建高效可扩展的AI应用。立即免费试用,几分钟即可上手。

2026-09-10 08:34:02 346

原创 jina-reranker-v3.5:通过混合注意力与自蒸馏实现更快的列表式重排序

jina-reranker-v3.5是一款0.6B参数的列表式重排序模型,在BEIR上以63.20 nDCG@10超越Qwen3-Reranker-4B(62.28),参数量少7倍。通过混合注意力调度、针对性训练数据与三阶段自蒸馏,其在半结构化检索中nDCG@10提升9.6,长文档重排序速度最高快1.56倍。在多语言、专业领域及紧凑模型中均达Pareto前沿,显著提升效率与精度,适用于企业级高效检索。

2026-09-09 17:53:55 383

原创 Elasticsearch Python DSL 客户端开发

本文介绍如何使用 Python Elasticsearch DSL 模块高效构建和管理DSL请求。通过对比原始字典方式与DSL模块,展示了其在查询构建、语法简洁性、可读性和维护性上的优势。文中涵盖标准与异步搜索、文档持久化、分面搜索、按查询更新及ES|QL集成等核心功能,并强调可逐步迁移现有代码,无需重构整个应用。

2026-09-09 15:48:21 208

原创 Elasticsearch:如何从 workflow 调用一个工具

本文介绍了Workflow调用工具的方法,以Kibana中创建find_cheapest_ticket_from_cn_us工具为例,通过申请API key、配置HTTP步骤调用MCP服务器上的工具,并输出最便宜机票信息。展示了Workflow可集成工具,也可作为Agent工具或调用Agent。

2026-09-09 10:03:29 381

原创 一字段,一份副本:Elasticsearch 列式存储如何丢弃倒排索引

Elasticsearch 9.5引入columnar索引模式(技术预览),采用列式存储,每个字段仅存一次,默认不建倒排索引,通过改进docvalues批量读取和轻量级skipper提升查询性能。新增multi_value、nullability、on_failure映射属性控制存储行为,支持多种索引模式共存,旨在优化日志和分析场景的成本与效率。

2026-09-09 08:27:11 528

原创 教程:使用 ES|QL 进行威胁狩猎

演示用ES|QL分析APT攻击中的认证、进程、网络数据,检测入侵、横向移动、提权、外泄,支持转换、过滤、丰富、统计,通过查找索引丰富上下文,构建时间线等。摘要需简洁,不超过150字。</think>本教程演示使用ES|QL进行高级威胁狩猎,模拟APT攻击场景,分析认证、进程与网络日志,检测初始入侵、横向移动、权限提升及数据外泄。通过LOOKUP JOI

2026-09-08 10:21:52 158

原创 隐藏在可观测性数据中的安全攻击

分离平台导致威胁不可见、成本重复,统一平台和AI可提升安全检测。字数限制严格。先提取关键点:1.攻击者伪装成正常噪声,可观测性和安全分离导致看不到威胁;2.数据重复存储成本高;3.统一Elastic平台让数据共享,AI可在同一上下文推理;4.结合内部手册提供合规建议。摘要应精炼,不超过150字。注意中文字数。写一个草稿。</t

2026-09-08 08:08:36 445

原创 Elasticsearch 中的查询重写规则:通配符扫描速度提升 2.3 倍

文章讲的是Elasticsearch/Lucene通过查询重写规则优化列式模式扫描:对*google*通配符查询重写为子字符串搜索并加SIMD,速度提升2.3倍;对空字符串term==''重写为长度检查(只读偏移数组),提升1.6倍。还提及规则系统原理和扩展性。摘要应涵盖这些要点。字数限制严格≤150字。</think>Elasticsearch通过Lucene查询重写规则

2026-09-08 07:17:20 520

原创 Elasticsearch:ES|QL 搜索教程

<think>我们根据用户要求,生成不超过150字的文章摘要。摘要应概括教程主要内容:使用ES|QL实现全文搜索、语义搜索、混合搜索、向量搜索和AI驱动搜索,针对烹饪博客数据集,包括创建索引、基本搜索、精度控制、过滤、混合搜索、RERANK、COMPLETION、TOP_SNIPPETS和KNN等。注意字数限制。</think>本教程演示用ES|QL为烹饪博客实现搜索功能,涵盖全文搜索、过滤、精确匹配、语义搜索、混合搜索、向量搜索及AI增强(RERANK、COMPLETION、TOP

2026-09-07 18:11:11 476

原创 如何通过一条 ES|QL 查询为 Elasticsearch 中的每个指标构建指标图表

抱歉,您的问题我无法识别。

2026-09-06 10:06:42 446

原创 在 Elasticsearch 中回填时间序列数据:通过批量 API 加载数月的历史指标数据

<think>我们需要根据给定的内容生成≤150字的文章摘要。内容是关于Elasticsearch 9.5的时间序列数据回填功能。摘要需要简洁,涵盖核心点:支持通过bulk API等发送历史时间戳数据,自动创建过去的后备索引,节省存储,默认禁用,需集群设置启用,简化历史数据迁移。注意字数限制。输出纯文本。</think>Elasticsearch 9.5 推出时间序列数据回填功能,支持通过 bulk API、OTLP 或 Prometheus 端点发送历史指标,自动创建过去的后备索引

2026-09-05 09:07:52 411

原创 在 ES|QL 中引入 SPARKLINE:一眼看清趋势

<think>好的,用户给了一段关于ES|QL新增SPARKLINE功能的博客文章,要求生成不超过150字的摘要。 需要提炼核心信息:SPARKLINE是什么(聚合函数)、能做什么(将聚合结果转为趋势线)、主要应用场景(日志模式分析)、版本信息(9.5技术预览)、关键设计特点(返回数组、填充空桶、与STATS组合使用)。 字数要控制在150字以内,语言要简洁扼要,按照“是什么—能做什么—在哪用—发布状态”的结构组织比较清晰。</think>ES|QL新增SPARKLINE聚合函数,可

2026-09-04 08:34:17 265

原创 不再有分配延迟:在无状态 Elasticsearch 中将快照与分片迁移解耦

无状态快照直接从对象存储读取,不再固定主分片,消除分配延迟;分片可自由迁移,缓存未命中下降>60%,填充吞吐量中位提高约50%;这是云原生架构演进。控制在150字内。</think>无状态快照直接从对象存储读取,主分片不再被固定,可自由迁移,消除了快照导致的分配延迟。横向扩展时新节点能立即接管分片,热点缓解更迅速,集群无需等待备份完成。上线后服务端相关警告消失,缓存未命中率下降超60%,缓存填充吞吐量中位提

2026-09-03 07:45:57 423

原创 安装 Elasticsearch

我们只需要根据内容生成摘要,字数≤150字。摘要应涵盖主要运行方式:ElasticCloud、Docker、Serverless、Start-local,及注意事项。语言简洁。</think>本文介绍了运行Elasticsearch的四种便捷方式:ElasticCloud托管服务(含14天试用)、Docker(适合本地开发与测试)、Serverless(完全托管、免运维)及Start-local(本地快速启动)。同时提示这些并非唯一部署方式,并强调本地命令禁用了安全认证

2026-09-02 16:34:17 202

原创 Elastic:防范由 AI 驱动的社会工程攻击

我们只需要根据内容生成≤150字的摘要。需要简洁概括主要观点。内容讲AI让社会工程攻击更高效,尤其是钓鱼、短信钓鱼、深伪等,传统检测失效,需行为分析、AI辅助响应、透明AI重构防御。摘要要≤150字。试着写。</think>AI正大幅提升鱼叉式钓鱼、短信钓鱼和深伪等社会工程攻击的规模与精准度,传统基于特征的检测难以应对。为有效防御AI驱动的攻击,需以统一遥测进行行为分析,借助生成式AI关联事件并辅以透明、可审计的决策,从追踪单个威胁转向瓦解整个攻击活动。

2026-09-02 14:37:13 345

原创 避免和纠正热点:Elasticsearch Serverless 如何平衡分片

<think>我们根据内容生成摘要。需要≤150字。摘要是关于Elasticsearch Serverless用资源感知再平衡替代基于权重的算法,避免分片共置、OOM、写入热点。概述新机制:独立决策器,如IndexBalanceDecider、HeapUsageDecider、WriteLoadDecider,减少分片移动,配合自动扩展。生产案例验证。未来改进搜索层。压缩到150字。</think>Elasticsearch Serverless用资源感知再平衡替代基于权重的分片算法

2026-09-02 10:29:16 564 1

原创 你的 AI agent 需要一个不在场证明:Elastic 中 Agent Builder 的可观测性和审计追踪

<think>我们根据用户要求,需要根据给定的长文,生成≤150字的文章摘要。文章内容是关于Elastic 9.5中AgentBuilder可观测性与审计追踪的介绍。我们需要提炼核心要点:记录AI agent操作(OpenTelemetry spans)、可查询工具调用和token、审批记录写入不可重写数据流、默认隐私设置等。摘要需简洁且覆盖主要信息。用户要求"生成≤150字的文章摘要",因此需精简。我提供中文摘要。</think>Elastic 9.5可将AI

2026-09-02 07:30:00 386

原创 仪表板活动日志:了解哪些 Kibana 仪表板会被使用

<think>我们需要根据用户提供的内容生成一篇≤150字的文章摘要。用户给的内容很长,是关于Kibana仪表板活动日志的。我们需要提炼核心要点。摘要应简洁,涵盖主要功能、启用方式、用途等。注意字数限制。我们需输出中文摘要。内容:Kibana现在会记录谁查看、编辑或删除了每个仪表板、耗时多久以及哪些操作失败了,这样你就可以在任何人报告之前发现出现故障的仪表板。通过单一解决方案观察、保护和搜索你的数据。从应用监控到威胁检测,Kibana都是满足关键使用场景的多功能平台。立即开始你的14天免费试用。

2026-09-01 11:43:28 458

原创 用于自托管 LLM 调优的 vLLM Prometheus 指标:TTFT、KV Cache 和 GPU 利用率

<think>我们只需要根据所给内容生成一个≤150字的摘要。内容是关于使用Elastic可观测性中的Prometheus指标调优自托管vLLM推理的指南,涉及TTFT、KVCache、前缀缓存和DCGM GPU计数器。摘要应简洁概括核心内容。</think>本文介绍使用Elastic可观测性与vLLM自带Prometheus指标调优自托管LLM推理,通过分析TTFT、KVCache占用率、前缀缓存命中率及DCGM GPU计数器,将“感觉很慢”转化为数据驱动的决策,识别解码瓶颈、优化

2026-09-01 07:00:00 612

原创 从 22.61GB 到 15.63GB:Elasticsearch 9.5 如何用「混合存储」重新定义日志数据库

<think>我们根据要求,生成≤150字的文章摘要。摘要需概括主要内容:ES9.5的LogsDB_Columnar混合存储在压缩和写入性能上显著优于ES8/ES9原生行存,但复杂查询延迟升高;选型需按场景。控制字数。给出最终摘要。</think>基于geonames、http_logs、nyc_taxis三组数据集评测:ES9.5的LogsDB_Columnar混合存储压缩比最高(磁盘节省最高30.8%),写入吞吐翻倍、延迟降低;但复杂聚合查询长尾延迟显著高于原生LogsDB。选型

2026-08-31 13:08:38 462

原创 使用 OpenTelemetry 进行 Android 应用监控:从点击到后端的分布式追踪

作者:来自 ElasticEDOT Android 只需添加一个 Gradle 依赖项,就能为你的 Android 应用增加移动 APM:崩溃报告、会话追踪和分布式追踪都可以在 Kibana 中查看。越来越多的人通过移动应用在智能手机上处理各种事务,无论是私人事务还是工作事务。对于拥有数千甚至数百万用户的移动应用团队及其所依赖的后端服务而言,确保出色的性能和可靠性是一项关键挑战。了解真实用户受到的影响、崩溃模式以及响应时间缓慢的根本原因,是管理移动应用质量的基础。当出现问题时,挑战会进一步加剧。

2026-08-31 07:45:00 835

原创 安心睡过凌晨 3 点的告警:在 Red Hat OpenShift 上使用 Elastic 实现自动化故障事件响应

Elastic 可观测性可以自主处理三种常见故障事件:它会扩展、重启或回滚工作负载,然后确认服务已经恢复,整个过程都由你自己的集群中的推理模型完成。每个运营团队都知道凌晨 3 点的告警。一项服务变慢,一个告警被触发,然后有人被叫醒,开始翻查仪表板、日志和追踪数据,以寻找能够解释服务中断的那个关键数据信号。等他们找到时,客户早已受到影响。这篇文章介绍的是一种不同的方法:自主 SRE,即由 Elastic 可观测性从检测到修复自主处理常规故障事件,而且整个过程都运行在你自己的 Red Hat OpenS

2026-08-31 07:00:00 834

原创 从 582 毫秒的延迟峰值追踪到负责该服务的团队:使用 Kibana Discover

​一个结账服务的 p95 延迟为 582 毫秒,而 SLO 目标为 350 毫秒。在 Kibana 的 Discover 中使用一个 KQL 查询即可找到它。要确定哪个团队负责该服务,则需要使用一个 ES|QL 查询,通过 LOOKUP JOIN 将指标文档与一个小型服务目录索引进行连接。下面将按顺序进行这项调查。一个 数据视图 可以缩小范围,而 过滤条件标签 会让这些条件保持可见。当需要其他人重新还原你搜索过的内容时,这一点比听起来更加重要。KQL 完成了大部分工作。Lucene 查询语法用于处理唯一一

2026-08-30 07:00:00 331

原创 将 1,100 个文件迁移到 Redux Toolkit v2,同时避免冻结 Kibana 单体仓库

Kibana 为 Redux Toolkit v2 设置了默认的软件包名称,并将 v1 放到了一个显式别名上,这颠倒了通常的迁移顺序。Webpack 外部依赖、yarn resolutions 和一条 ESLint 规则确保 React Redux v7 和 v9 互不干扰。

2026-08-30 07:00:00 630

原创 从建议到修复的 4 个阶段:使用 Elastic Workflows 实现人在回路中的自动化

​一个审批关卡会在执行操作之前暂停故障事件响应自动化,并为审核人员提供足够的证据,让其能够在几秒钟内做出决定。无论后续结果是批准还是拒绝,都会记录在一个可审计的记录中。没有证据支撑的 “批准” 按钮并不能算作一种控制手段。人在回路中自动化会将五件事情绑定到一个可检查的记录中:你观察到的证据、你提出的操作、做出决定的人、他们拥有的截止时间,以及实际执行的操作。在本文中,你将使用 Elastic Workflows 构建这个审批关卡,并复用配套文章 使用 Agent Builder 和 Workflo

2026-08-29 08:00:00 666

原创 别再来一个 Log4Shell:深入解析 Log4j 2 反序列化允许列表绕过

​这不是另一个 Log4Shell。Log4Shell(CVE-2021-44228) 是由日志记录字符串触发的 JNDI 查找。而 8 月报告的这个绕过问题是 Log4j 2 的 FilteredObjectInputStream 中存在的 Java 反序列化漏洞。我们在官方 Maven Central 提供的 log4j-api 和 log4j-core 2.26.1 上复现了这一问题。要进一步实现命令执行,还需要另外两个 Log4j 本身没有提供的条件。你需要一个仍然会对 Java 序列化的 Log

2026-08-29 08:00:00 510

原创 Agent 上岗做日志检测,日志赛道降本的叙事快讲不下去了

一次生产故障,诊断 Agent 在几分钟内发起了数百次日志查询。每次查询慢一秒,整条诊断链路就多等几分钟 —— Agent 还没开始推理,SLA 已经烧完了。日志检索的成本模型,正在被一件事彻底改写:查询的发起者,从人换成了 Agent。而这一次,钟摆不会停在历史上的任何一端 —— 因为 Elastic 已经把四个时代的所有形态,做进了同一套引擎里面。

2026-08-28 12:10:05 421

原创 了解你的事实:Elasticsearch AI Indices 让 agents 无需通读内容,就能保留答案

一篇技术实践指南,介绍如何将事实预先计算到 Elasticsearch AI Index 中,让 agents 通过一次 ES|QL 查询直接获得答案,而无需阅读完整文档,从而减少 token 消耗并降低延迟。​为了回答一个问题而将完整文档加载到 agent 的上下文中成本很高,而且每次检索失败都会进一步增加成本。在这篇实践指南中,我们采用的是预先计算事实的方法。Kibana workflow 将每个文档提炼成事实级别的 Knowledge Indicator(KI),存储在 Elasticsearch

2026-08-28 09:40:57 357

原创 机构如何统一智慧城市数据以改善公共服务?

每天,城市都会产生数百万个数据点 —— 从水压读数,到交通信号灯状态变化,再到空气质量警报。很多时候,这些数据分散在相互隔离的 IT 和 OT 环境中,被困在从未设计为能够相互共享数据的系统里,从而拖慢响应速度,并让问题一直隐藏到最终演变成服务中断。

2026-08-28 08:35:05 436

原创 Microsoft Foundry 的 AI agent 可观测性:两个环境变量,无需采集器

​只需设置一次 LLM 追踪,你的 Foundry agent 的每次模型调用、工具执行和交接都会作为一条可查询的追踪记录到达 Kibana,每个跨度都包含 token 数量,并提供适用于 Agent Framework、LangGraph 和 Node.js 的代码。使用 OTel SDK 为你的 Microsoft Foundry agent 添加插桩,设置两个环境变量,这样每次 LLM 调用、工具执行和 agent 交接都会以可查询的追踪记录进入 Kibana,每个跨度都包含 token 数量。

2026-08-28 07:00:00 360

原创 从告警到根因仅需 3 分钟:使用 Elastic Agent Builder 实现自动化根因分析

​自动化根因分析只有在 agent 将故障时间窗口与上一次健康时间窗口进行对比时才有效。跳过这一步,你得到的就只是一个摘要器。只读 skill、受限 role 以及 Elastic Workflow 都已包含在这里。告警触发在 checkout latency 上。3 分钟 22 秒后,一个 Elastic Observability case 已经打开,其中包含根因、背后的证据,以及 agent 对其结论的置信度。整个过程中,没有人需要在 Kibana、聊天工具、工单系统和终端之间来回切换。

2026-08-27 14:30:11 489

原创 驯服 PUNKs:ES|QL 如何查询 Elasticsearch 从未被告知的字段

​在 Elasticsearch 9.5 中,ES|QL 可以查询未映射的字段。它会从 _source 中读取这些字段,或者返回 null,因此即使某个字段从映射中消失,查询仍然可以正常工作,从而避免需要数小时的重新索引。亲自体验 Elasticsearch:深入了解 Elasticsearch Labs 仓库中的示例 notebooks,开始 免费云试用,或者现在就在本地机器上尝试 Elastic。如何让一个分析查询引擎使用它无法知道存在的数据?你 “只需要” 读取查询,因为用户请求的所有内容都

2026-08-27 13:41:00 458

05-Elastic AI时代全新可观测解决方案 - 朱杰 上海 20260321

内容概要:本文介绍了Elastic在AI时代推出的全新可观测性解决方案,旨在通过融合大语言模型(LLM)、机器学习(ML)与OpenTelemetry标准,实现从传统运维监控向智能AIOps的演进。方案覆盖日志、指标、APM、Trace、RUM等全栈数据,构建统一的数据采集、存储、分析与自动化处理架构。通过LogsDB、MetricDB、TSDB等技术优化数据存储与查询效率,结合AI助手实现自然语言交互、根因分析、告警解释与处置建议,显著降低MTTD/MTTR,提升运维效率。同时支持RAG与AI Agent,推动知识库自动生成与智能化决策。; 适合人群:从事IT运维、SRE、DevOps及可观测性平台建设的技术人员,具备一定监控系统使用经验的架构师与工程师; 使用场景及目标:① 实现多源运维数据的统一采集与智能分析;② 利用AI助手加速故障定位与根因分析;③ 构建基于LLM的企业级AIOps平台,提升自动化与预测性维护能力; 阅读建议:重点关注Elastic Observability架构演进、AI集成路径及实际应用场景案例,结合自身运维体系规划向智能可观测性升级。

2026-03-23

04-阿里云 Elasticsearch 技术引擎进阶 -振策 上海 20260321

内容概要:本文详细介绍了阿里云Elasticsearch在引擎架构、AI搜索能力和云原生内核方面的技术进阶。重点涵盖Elasticsearch向量引擎的持续优化,包括支持千亿级文本与向量混合检索、基于Lucene10的底层升级、BBQ量化技术实现高达20倍的资源节约,以及通过FalconSeek自研引擎实现复杂查询性能提升达6倍以上。同时,介绍了存算分离架构OpenStore带来的成本降低与稳定性提升,以及AI能力增强如混合检索(RRF算法)、Retrievers框架、Inference API集成大模型服务等,全面支持RAG、多模态搜索和智能语义理解。此外,还展示了云原生内核的C++高性能实现、完全兼容开源生态、无缝升级路径及其在真实场景下的显著性能优势。; 适合人群:具备一定云计算、搜索技术或大数据分析背景的技术人员,尤其是从事搜索系统、日志分析、AI语义检索等相关工作的研发工程师、架构师及技术决策者;适合工作年限在2年以上的中高级技术人员。; 使用场景及目标:① 构建高性价比的大规模向量与全文混合检索系统;② 提升Elasticsearch集群在高并发、复杂查询下的性能与稳定性;③ 实现RAG、AI增强搜索、多模态语义理解等前沿AI应用落地;④ 降低存储与计算成本,实现弹性扩缩容与自动化运维; 阅读建议:本文为技术深度分享,建议结合实际业务场景关注架构演进路径与性能优化细节,重点关注BBQ量化、FalconSeek内核、混合检索实现机制及Inference API集成方式,便于在企业级搜索系统中进行技术选型与方案设计。

2026-03-23

02-腾讯云 ES 百亿级 AI Search 优化实践 - 吴容 上海 20260321

内容概要:本文介绍了腾讯云Elasticsearch Service(ES)在百亿级AI Search场景下的优化实践,涵盖产品架构、核心技术及典型应用。腾讯云ES提供一站式全托管ELKB服务,支持日志分析、信息检索与AI Search三大场景,通过自研内核实现存算分离、堆外内存优化、索引压缩等技术,显著降低存储成本50%-80%,提升查询性能2-10倍、写入性能2倍以上,并保障99.99%的高可用性。重点聚焦AI Search能力,支持混合检索(Hybrid Search)与检索增强生成(RAG),集成全文检索与向量语义搜索,利用RRF算法融合排序,提升召回率与准确率。同时提供从文档解析、chunking、embedding、rerank到LLM生成的全链路原子化服务能力,支撑智能问答、知识库检索、个性化推荐等应用场景。; 适合人群:云计算、搜索推荐、大数据及AI平台相关的研发与架构师人员,具备一定Elasticsearch和AI应用基础的技术从业者;企业级搜索系统建设者及数字化转型团队。; 使用场景及目标:①构建高性能、低成本的企业级AI搜索系统;②实现混合检索与RAG应用落地,提升搜索准确率与语义理解能力;③应对百亿级数据规模下的高并发、低延迟搜索需求;④降低运维复杂度,实现从数据接入到智能生成的一站式闭环。; 阅读建议:此资料结合了架构设计、性能优化与实际案例,建议结合自身业务场景重点研究混合检索实现方式、RRF融合策略及全链路RAG流程,并参考标杆案例进行技术选型与方案设计。

2026-03-23

01- Elasticsearch 向量搜索及 AI Agents 开发 - 刘晓国 上海 20260321

内容概要:本文系统介绍了Elasticsearch在向量搜索与AI智能体(Agents)开发中的核心技术与应用实践。重点涵盖向量搜索的演进背景、稀疏向量(Sparse Vector)与稠密向量(Dense Vector)的原理与实现方式、混合搜索(Hybrid Search)的架构设计及其在语义搜索、RAG系统和智能推荐中的应用。文章还详细阐述了Elasticsearch如何通过BM25、向量索引、RRF融合算法等技术实现关键词与语义的联合检索,并介绍了最新的向量引擎优化进展,如硬件加速、向量量化、DiskBBQ存储格式等。最后,深入探讨了基于Elasticsearch构建AI Agent的工作流程,包括检索增强生成(RAG)、上下文工程、MCP集成以及Agent Builder工具的使用,展示了Elastic作为企业级AI底座的能力。; 适合人群:具备一定搜索技术或大数据基础,从事搜索推荐、AI应用开发、数据工程等相关领域的研发人员、架构师及技术管理者,尤其是关注RAG、向量数据库与智能体落地的从业者。; 使用场景及目标:①构建支持语义理解与多模态内容检索的智能搜索系统;②实现基于Elasticsearch的RAG架构以提升大模型问答准确性;③开发具备自主决策能力的数据驱动型AI智能体;④优化向量搜索性能与成本,支持高并发、低延迟的生产环境部署。; 阅读建议:此资料兼具理论深度与工程实践指导价值,建议结合Elasticsearch实际环境动手实验,重点关注混合搜索配置、模型导入、Agent Builder搭建等关键环节,并参考提供的API示例与架构图进行系统性学习与调优。

2026-03-23

03-ElasticRelay - 多源实时 CDC 到 Elasticsearch 同步引擎 - 林继繁 上海 20260321

内容概要:本文介绍了ElasticRelay——一款轻量级、高性能的多源实时CDC(变更数据捕获)同步引擎,旨在将MySQL、PostgreSQL和MongoDB的数据直接同步到Elasticsearch,无需依赖Kafka、Flink等中间组件。系统基于Go语言开发,仅需单一二进制文件,内存占用约50MB,支持毫秒级延迟、断点续传、数据零丢失、热配置更新及内置数据脱敏等功能。通过解析数据库的事务日志(如Binlog、WAL、Change Streams),实现高效、可靠的实时数据同步,并提供自动索引创建、智能类型映射、并行大表初始化、DLQ错误处理等企业级能力。; 适合人群:具备一定数据库与数据同步基础知识,从事数据工程、运维、搜索平台建设的技术人员,尤其是希望简化架构、降低资源消耗的中小型团队开发者;; 使用场景及目标:① 替代复杂的Debezium+Kafka+Flink多组件架构,实现快速部署与低延迟同步;② 支持GDPR/隐私合规的数据脱敏处理;③ 实现亿级大表的高效全量+增量同步;④ 构建稳定、可观测的ELT数据管道; 阅读建议:建议结合GitHub开源项目实践部署,重点关注其配置文件结构、检查点机制与Transform引擎设计,同时可关注后续GUI界面与Kubernetes Operator的演进。

2026-03-23

告别中间件繁琐:ES 9.2 Streams 打造 一站式 实时分析平台 - 程地华 线上 20260121

内容概要:本文介绍了Elasticsearch 9.2推出的内置流处理引擎——Streams,该技术实现了数据“入库即计算”的实时分析能力,大幅提升数据处理效率。Streams作为全自动数据加工流水线,能够在数据写入时自动完成清洗、解析与结构化,支持AI驱动的日志智能解析、统一日志流管理、数据质量监控以及精细化的数据保留策略。通过Search AI赋能,Streams可自动识别日志来源并建议字段映射,打破传统Grok规则编写的繁琐流程,实现异构日志的免配置接入。同时,其分级存储机制满足合规审计需求,显著降低存储成本。; 适合人群:具备一定大数据或运维经验的SRE、DevOps工程师、日志平台开发者及系统架构师;关注实时数据分析、日志统一治理的企业技术团队。; 使用场景及目标:①解决微服务架构下多源异构日志(如Nginx、Spark、Hadoop等)的统一接入与自动化解析问题;②在海量日志场景中实现合规驱动的数据分级存储与高效查询;③减轻SRE在多云环境中维护复杂日志管道的负担,提升运维自动化水平; 阅读建议:建议结合文中Demo演示动手实践,重点关注Streams在数据摄入阶段的自动分区、AI解析生成、数据质量检测等功能,深入理解其如何替代传统中间件构建一站式实时分析平台。

2026-01-21

04-搜索范式 - 从排序到过滤的转变 - 王峰 北京 20260110

内容概要:本文探讨了搜索范式从传统排序(ranking)向动态选择(selection)的演进,重点介绍了Jina团队在Elastic框架下开发世界级搜索基础模型的工作。文章详细阐述了重排序模型(reranker)的技术演进,特别是jina-reranker-v3如何通过listwise输入和全局交叉注意力机制实现查询与文档的相关性评估以及文档间的多样性比较,达到当前最优性能。同时提出“足够上下文”的理念,主张通过子模态优化和强化学习方法实现相关性与多样性的平衡,并支持动态确定Top-K数量以适应不同复杂度的查询需求。此外,还展望了多模态重排序的发展方向,在保证强大性能的同时降低模型开销以提升实用性。; 适合人群:从事搜索算法、信息检索、RAG系统优化或大模型应用研发的工程师与研究人员,具备一定机器学习背景的技术人员; 使用场景及目标:①理解现代重排序模型如何超越对比学习,实现更优的上下文构建;②掌握基于序列决策的多样化文档选择机制;③应用于实际RAG系统中提升上下文质量与LLM响应准确性; 阅读建议:此资源聚焦于搜索核心技术的前沿发展,建议结合具体搜索场景进行实验验证,并关注模型效率与效果之间的权衡。

2026-01-11

03-腾讯云ES在搜索场景与AI能力的建设分享-师文博 北京 20260110

内容概要:本文介绍了腾讯云Elasticsearch Service(ES)在搜索场景与AI能力建设方面的技术架构与实践经验。重点阐述了自研云原生日志增强版的存算分离架构,通过Delta(SSD)+Base(COS)混合存储、Segment物理复制与智能缓存机制,实现高可靠、低成本的日志存储与高效检索。针对搜索场景,分享了稳定性保障(跨区容灾、多维告警、智能巡检)、安全性加固(加密、访问控制、网络隔离)以及性能优化策略(Forcemerge管理、索引排序、缓存优化、routing设计等)。同时,详细展示了腾讯云ES在AI能力方面的建设,包括GPU硬件支持、多维监控、向量检索及模型管理等功能,打造一站式AI向量检索平台。; 适合人群:具备一定云计算与搜索技术基础,从事大数据、搜索推荐、日志分析或AI应用开发的工程师及技术决策者,尤其适合工作1-3年以上的研发人员; 使用场景及目标:①了解云原生ES在日志与搜索场景下的架构设计与优化方法;②掌握高可用、高性能搜索系统的建设路径;③探索ES集成AI能力(如向量检索、模型部署)的技术方案; 阅读建议:此资源结合架构解析与实战经验,建议结合自身业务场景对比分析,在实际项目中借鉴其稳定性、性能与AI集成设计思路,并通过压测验证优化效果。

2026-01-11

01-Elasticsearch 向量搜索及 AI Agents - 刘晓国 20260110

内容概要:本文系统介绍了Elasticsearch在向量搜索和AI Agents领域的技术实现与应用,重点涵盖向量搜索的基本原理、语义理解、混合搜索(Hybrid Search)、检索增强生成(RAG)以及Agentic RAG的架构演进。文章详细展示了如何在Elasticsearch中通过稠密向量(Dense Vector)与稀疏向量(Sparse Vector)结合实现高效的语义搜索,并介绍了RRF(倒数排序融合)、Learning to Rank、模型重排序等关键技术。同时,讲解了ELSER、语义文本字段、自动分块、Inference API等特性在RAG中的应用,并展望了基于Elasticsearch构建AI Agent工作流的发展方向。; 适合人群:具备一定搜索技术或大数据开发基础,熟悉Elasticsearch或对AI与搜索融合感兴趣的工程师、架构师及技术决策者;适合从事推荐系统、语义搜索、RAG系统开发的相关技术人员; 使用场景及目标:①构建支持语义理解的智能搜索系统;②实现企业级RAG架构,提升大模型问答准确性;③利用Elasticsearch平台整合向量搜索与传统搜索,打造混合检索方案;④开发基于Agent的自动化信息检索与决策系统; 阅读建议:此资源不仅提供理论讲解,还包含大量实战代码示例与架构图解,建议结合Elasticsearch最新版本动手实践,重点关注模型导入、索引构建、kNN查询、RRF融合与retrievers的使用,深入理解从传统搜索到AI增强搜索的技术演进路径。

2026-01-11

02-MCP 超级大脑:一键干掉传统 RAG 同时接管全链路 AIOps - Luke 北京 20260110

内容概要:本文介绍了MCP(Model Context Protocol,模型上下文协议)作为新一代RAG及全链路AIOps的核心技术,旨在解决传统RAG面临的静态知识库、单层检索和人工编排三大痛点。MCP通过构建AI的“神经系统”,实现AI与实时API、Elasticsearch/Kibana等可观测性平台的直接交互,支持动态调整检索策略和自主决策,使AI从“查资料”升级为“操作系统”。MCP协议定义了Client与Server之间的标准化通信方式,涵盖Resources、Tools和Prompts三类核心功能,推动AI应用向更高效、智能的自动化运维演进。; 适合人群:具备一定AI和系统架构基础知识的技术人员,尤其是从事AIOps、搜索系统、大模型应用开发的相关从业者;适合1-3年经验的研发或解决方案架构师; 使用场景及目标:①替代传统RAG实现动态、实时的知识检索与系统操作;②在AIOps中实现AI对ELK栈的直接控制与数据分析;③构建可扩展的AI工具集成平台,提升企业级AI自动化能力; 阅读建议:此资源侧重于MCP在真实场景中的落地实践,建议结合Elasticsearch、Kibana及Newchat等工具进行实操演练,深入理解MCP如何打通AI与底层系统的全链路交互。

2026-01-11

01-Elasticsearch Mythbusters- 破除迷思,回归工程本质 - 李捷 线上 20260107

内容概要:本文《Elasticsearch Mythbusters: 破除迷思,回归工程本质》系统性地澄清了关于Elasticsearch的四大常见误解——高存储成本、写入查询性能差、存算耦合落后于云时代、向量搜索能力弱。文章指出,这些认知大多基于Elasticsearch早期版本(如5.x/7.x)的局限,而忽略了其在8.x/9.x版本中的重大架构演进,包括LogsDB/MetricDB优化、ES|QL向量化执行引擎、可搜索快照、DiskBBQ向量索引、Serverless模式等技术创新,显著提升了性能、降低了成本。作者强调技术决策应避免“FUD”(恐惧、不确定、怀疑)营销影响,需结合具体场景权衡“空间换时间”与“时间换空间”的工程本质。; 适合人群:从事日志系统、可观测性、搜索推荐或大数据平台建设的架构师、开发与运维工程师,尤其适用于正在评估或使用Elasticsearch及相关技术栈的技术决策者。; 使用场景及目标:①帮助团队理性评估Elasticsearch在现代云原生环境下的适用性,避免因过时信息而误判技术选型;②深入理解Elasticsearch在存储优化、查询性能、向量搜索等方面的最新技术进展,指导架构升级与性能调优;③掌握“空间换时间”等核心工程权衡思想,应用于其他系统设计决策。; 阅读建议:此资源以破除迷思为主线,融合技术演进、性能 benchmark 与工程哲学,建议结合自身业务场景对照阅读,重点关注LogsDB、ES|QL、BBQ等新特性原理与收益,并参考文中的成本对比数据与架构图进行实践验证。

2026-01-08

01-Elasticsearch-KNN详解 - 刘琪 线上 20251218

内容概要:本文详细介绍了Elasticsearch中KNN(K-最近邻)向量搜索的原理、发展历程及其在实际场景中的应用。重点讲解了KNN的基本概念、HNSW(分层可导航小世界)算法的工作机制,以及近似KNN与精确KNN的区别。文章还涵盖了Elasticsearch中KNN的实现方式,包括dense_vector字段类型配置、索引创建、数据写入与查询语法,并通过以图搜图的Demo展示了从模型选型(如ResNet50)、数据预处理到向量检索的完整流程。同时对比了两种KNN搜索方法在准确性、性能和适用场景上的差异,强调了近似KNN在大规模高维数据下的高效性与灵活性。; 适合人群:具备一定Elasticsearch和机器学习基础知识,从事搜索、推荐系统或向量数据库相关工作的研发人员,尤其是工作1-3年的中初级工程师; 使用场景及目标:① 实现基于语义的图像、文本相似性搜索;② 构建推荐系统或FAQ问答系统中的向量检索模块;③ 理解HNSW等近似算法在Elasticsearch中的工程实现与性能调优; 阅读建议:此资源结合理论与实战,建议读者在理解KNN与HNSW原理的基础上,动手搭建实验环境,复现文中索引配置、pipeline构建及查询示例,重点关注num_candidates、k、similarity等参数对召回率与性能的影响。

2025-12-19

03-阿里云AI搜索年度总结和展望 - 张粲宇 西安 20251206

内容概要:本文系统回顾了阿里云AI搜索在2025年度的技术发展与行业趋势,重点阐述了AI搜索从传统信息检索向任务型智能代理(Agentic Search)的演进路径。文章介绍了RAG技术的阶段性发展(Native RAG至Agentic RAG),并深入剖析了AI搜索三大核心要素——数据基建、AI能力与引擎技术的融合创新。通过阿里云Elasticsearch的产品升级与FalconSeek云原生引擎的性能优化,展示了在向量检索、多模态搜索、混合检索等方面的领先能力。结合客户在云文档、日志分析、游戏、电商及智驾等场景的实践案例,验证了AI搜索在降本增效、统一架构与智能化升级方面的显著价值。同时,展望了以大模型和Agent技术驱动的未来搜索形态,提出AI搜索将从被动响应转向主动任务执行,实现复杂问题的多步推理与工具协同。; 适合人群:从事搜索、推荐、大数据与AI平台研发的技术人员,尤其是云计算、企业级服务、智能搜索应用领域的架构师与技术管理者。; 使用场景及目标:①了解AI搜索技术演进脉络及RAG、Agentic Search等前沿方向;②掌握云原生环境下高性能检索引擎的架构设计与优化方法;③借鉴AI搜索在多模态、语义理解、向量检索等场景的落地实践,推动企业智能化升级。; 阅读建议:此资源以技术演进与实际案例相结合,不仅呈现产品能力,更强调底层架构创新与业务场景适配,建议结合自身业务需求重点关注向量检索优化、存算分离架构及AI开放平台集成方案,并参考客户实践进行技术选型与架构设计。

2025-12-06

02-ElasticSearch在专利与教育场景中的语义检索实践 - 王传健 西安1206

内容概要:本文介绍了ElasticSearch在专利与教育两个垂直领域的语义检索实践,重点探讨了如何应对行业特有的数据异质性、语义复杂性和查询多样性挑战。作者分享了从传统BM25检索到混合检索(Hybrid)、多路召回+精排、LLM融合BM25,再到Multi-Agent RAG的技术演进路径,提出了基于意图识别的查询路由机制和精细化的精排服务部署方案,并总结了在数据预处理、索引设计、词典构建与Embedding模型优化方面的实战经验与避坑建议。; 适合人群:具备一定搜索系统或NLP基础,从事搜索推荐、知识库构建、语义检索相关工作的工程师和技术人员,尤其是关注垂直领域AI应用的从业者;; 使用场景及目标:①提升专利检索中的同义词召回率与查全查准平衡;②解决教育场景中题目变体、OCR噪声、多模态输入等复杂问题;③构建高精度垂直领域知识检索系统;④探索LLM与传统检索技术融合落地路径; 阅读建议:本文侧重于工程实践与架构设计,建议结合自身业务场景对比不同技术路线的适用性,重点关注多路召回策略、查询路由设计及模型微调优化方法,并在实际系统中逐步迭代验证。

2025-12-06

01-AI 驱动 - 搜索的未来 - 刘晓国 西安 20251206

内容概要:本文深入探讨了AI驱动下的搜索技术演进,重点介绍了向量搜索的原理及其在Elasticsearch中的实现方式。文章从传统关键词搜索过渡到语义搜索、向量搜索及混合搜索(Hybrid Search),详细讲解了稠密向量与稀疏向量的区别、向量相似度计算方法(如余弦相似度、L2距离等),以及如何利用Elasticsearch进行图像和文本的语义匹配。同时,介绍了检索增强生成(RAG)和Agentic RAG的概念与架构,阐述了如何通过向量数据库结合大语言模型提升回答准确性和上下文相关性,并展示了Elasticsearch在模型管理、自动分块、语义字段处理、重排序(rerank)等方面的能力。此外,还涵盖了硬件加速、量化压缩、并发优化等向量引擎最新进展。; 适合人群:具备一定搜索或大数据

2025-12-06

Elasticsearch 8 四大工程 - 朱杰 20251202

内容概要:本文介绍了Elasticsearch 8的四大核心工程升级,包括全新构建的原生向量引擎、计算引擎ES|QL、云原生Serverless架构,以及面向时序数据(TSDB)和日志数据(LogsDB)的专用数据库优化。重点阐述了Elasticsearch如何通过硬件加速(CPU/GPU)、向量量化、并发优化等技术提升向量检索性能,并介绍ES|QL作为统一搜索与分析语言在语法、函数、性能方面的优势。同时展示了Serverless架构下的存算分离设计、基于对象存储的分片机制与计费模式,以及TSDB和LogsDB在数据压缩、索引优化和存储效率上的显著提升。; 适合人群:具备一定Elasticsearch使用经验的开发者、架构师及运维人员,尤其是关注向量检索、日志与时序数据分析、云原生部署的技术决策者;工作年限在2年以上的技术人员更为适宜; 使用场景及目标:① 构建支持生成式AI的混合搜索系统(文本+向量+稀疏向量);② 实现高性能向量数据库用于语义检索与RAG场景;③ 在大规模日志和指标场景下实现高效存储与查询;④ 探索Serverless化部署以降低运维复杂度并优化成本; 阅读建议:建议结合Elastic官方文档与实际案例进行对照学习,重点关注各新特性在性能测试中的表现及其适用边界,实践中应充分评估硬件支持条件(如GPU)与订阅版本限制(如企业功能)。

2025-12-02

Elasticsearch 新一代查询语言- ES-QL 介绍与实战 -夏乔 - 20251120

内容概要:本文介绍了Elasticsearch推出的新一代查询语言ES|QL,旨在解决现有查询语言(如Query DSL、SQL等)在可读性、性能和功能覆盖上的局限。ES|QL采用管道式声明语法(FROM | WHERE | EVAL | STATS),以表格模型处理数据,支持从搜索到分析再到可视化的全流程统一操作。其拥有独立于Search的查询引擎,通过谓词下推、列裁剪和算子优化提升执行效率,并深度集成于Observability、Security等场景。文章详细讲解了ES|QL的架构原理、执行流程、语法结构及常用命令,并展示了实际应用示例,同时指出其当前的限制与最佳使用建议。; 适合人群:具备Elasticsearch基础的数据分析师、运维人员、安全专家及开发人员,尤其是关注日志分析、指标统计与威胁检测的技术从业者; 使用场景及目标:① 替代复杂嵌套的DSL实现高效的数据过滤、转换与聚合分析;② 在单一语句中完成数据检索、丰富化(enrich/join)、统计计算与结果可视化,提升查询可读性和开发效率;③ 适用于可观测性、安全调查和运营报表等需要快速迭代查询的场景; 阅读建议:学习时应结合Kibana实践ES|QL语法,注意控制查询时间范围、尽早过滤数据并限制返回结果规模,避免全量扫描。同时需明确ES|QL目前不适用于大规模导出或高级搜索功能(如相关性排序、向量检索),应根据场景合理选择Query DSL或ES|QL。

2025-11-20

腾讯云 ES 百亿级 AI Search 优化实践 - 陈曦 - 20251112

内容概要:本文介绍了腾讯云 Elasticsearch(ES)在百亿级数据规模下的 AI Search 优化实践,重点围绕其自研的高性能混合检索引擎、全链路原子服务及多个标杆案例展开。通过存算分离、堆外内存优化、索引压缩、查询裁剪、CBO 查询计划优化、Multi-path 并行检索、量化裁剪和 GPU 加速推理等核心技术,实现了存储成本降低 50%-80%、查询性能提升 2-10 倍、写入性能提升 1-10 倍、稳定性提升 5 倍以上的显著效果。同时,腾讯云 ES 构建了一站式企业级 AI Search 解决方案,支持文本、向量、多模态混合检索与 RAG 应用,深度融合 NER、Embedding、Rerank 等原子能力,并已在微信读书、IMA 智能工作台、天眼查、敦煌数字藏经洞等多个高要求场景成功落地。; 适合人群:从事搜索、推荐、大数据与 AI 相关工作的中高级研发人员、架构师及技术决策者,尤其适用于需要构建企业级智能检索系统的团队; 使用场景及目标:① 构建高性能、低成本的 AI 搜索系统;② 实现文本与向量混合检索、RAG 问答、智能客服、知识库检索等应用场景;③ 优化现有 ES 集群在大规模、高并发下的性能与稳定性; 阅读建议:本文技术深度较高,建议结合实际业务场景重点关注混合检索优化、GPU 推理加速、全链路原子服务设计等内容,并参考标杆案例进行架构对标与性能调优。

2025-11-12

Elastic Support 概述 - 潘宁,赵守连,李洋 20251028

内容概要:本文介绍了Elastic支持服务的整体架构与核心功能,涵盖全球覆盖、产品专长和优质客户体验三大支柱。重点展示了Elastic AI支持助手的演进路径及其在智能搜索、语义理解和生成式AI方面的应用,同时详细说明了支持门户的功能、案例提交流程及严重性分级机制。通过真实用例演示,深入剖析了ELK多产品环境下数据接入失败与时断时续问题的排查过程,涉及配置兼容性、性能瓶颈、分片策略、ILM设计缺陷等多个技术层面,并给出了系统性的优化方案。; 适合人群:使用Elastic Stack(如Elasticsearch、Kibana、Logstash等)的技术人员、运维工程师、架构师以及企业IT决策者,尤其是面临复杂环境故障排查与性能调优挑战的中高级技术人员;同时也适用于关注AI驱动技术支持发展的技术管理者。; 使用场景及目标:① 学习如何高效利用Elastic支持门户和服务体系解决实际问题;② 掌握常见数据接入异常与性能瓶颈的分析思路与调优方法;③ 了解AI支持助手的工作原理及其在技术支持中的应用场景;④ 提升对DSE(指定支持工程师)服务价值的理解,优化企业级支持资源配置。; 阅读建议:建议结合Elastic官方文档与支持门户实践操作,重点关注故障排查逻辑与性能优化策略,在真实环境中验证文中提出的配置调整与架构改进措施,以增强问题诊断能力与系统稳定性。

2025-10-28

Elasticsearch APM 和 EDOT 的实践与探索

内容概要:本文介绍了Elastic APM与OpenTelemetry(OTel)的基本概念、核心组件及其在可观测性领域的应用,重点阐述了Elastic如何通过原生支持OTLP协议实现与OpenTelemetry的无缝集成,并推出专为其优化的Elastic OpenTelemetry发行版(EDOT)。文章详细说明了APM的核心事件类型(Transaction、Span、Error、Metrics),OpenTelemetry的工作原理与优势,以及EDOT的架构、支持的SDK版本和部署实践。同时展示了如何通过Docker Compose搭建演示环境,实现日志、指标和追踪数据的采集与可视化。; 适合人群:具备一定可观测性基础知识,从事DevOps、SRE、后端开发或系统监控相关工作的技术人员,尤其是正在评估或实施OpenTelemetry与Elastic集成方案的团队。; 使用场景及目标:①理解APM在分布式系统性能监控中的作用;②掌握OpenTelemetry作为标准化遥测数据采集框架的优势;③实现从传统APM向OpenTelemetry的平滑迁移;④利用EDOT构建统一、可扩展的可观测性平台; 阅读建议:建议结合官方文档和演示仓库实际操作部署流程,重点关注EDOTCollector配置、环境变量替换与Elasticsearch集成细节,深入理解数据流路径与语义规范一致性设计。

2025-09-25

04-AI 知识库底层架构构建 - 腾讯 KInfra 基于 ES 的特性应用 -王志铭 线上 20260726

Elasticsearch 在 AI 知识库场景下的使用远不止"建索引、查向量"这么简单。选错特性、用错姿势,轻则效果打折,重则性能与成本双双失控。KInfra 在 AI 知识库落地过程中,不仅通过ES实现了多样化的检索策略,还解决了召回超时与存储成本失控,性能大幅提升。 本次分享以腾讯KInfra 的真实生产实践为线索,聚焦于如何在知识库 RAG 检索链路中系统性地理解并用好 ES 的核心特性——从特性的选型逻辑、组合方式,到参数决策背后的取舍依据。

2026-07-28

02-筑基千亿,毫秒破局:腾讯云 ES 重塑 AI Search 新范式 陈曦 线上 20260726

大模型时代 AI Search 跨入千亿级主战场,多租户资源博弈与极端性能要求已迎来正面交锋。腾讯 ES 带来破局解法:聚焦自研冷热用户分离,标量/向量融合索引,执行计划优化等核心演进。在超大规模混合检索场景下,实现业务间零干扰的安全隔离与资源的极致压榨。以毫秒级极致响应、削减 90% 内存成本与自研的技术底蕴,定义下一代高性能 AI Search 的基础设施。

2026-07-28

01- Elasticsearch 向量搜索及 AI Agents 开发 - 刘晓国 线上 20260726

详细介绍 Elasticsearch 向量搜索及最新的进展。使用具体的例子来展示如何使用向量(稀疏向量,密集向量)搜索来进行语义搜索, 使用 AI Assistant 对数据进行分析,MCP,Playground 及 使用最新的 AI agents builder 轻松地创建自己的 Agents。AI agent builder 为 agents 提供更多的上下文,从而更加快速而准确地搜索到我们想要的结果。

2026-07-28

03-从 Prompt 到 Harness - Elastic 在 AI Agent 三大工程上的设计取舍 - 李捷 线上 20260726

舍展开,深入探讨企业级AI Agent从“IDE插件”向“常驻服务”演进过程中的关键技术挑战与解决方案。文章以内容OpenClaw等概要:本文围绕Elastic实际案例为基础,强调在AI Agent三大“看得见(工程——提示词工程、可观测性)、会上下文工程与Harness干活(跨框架协同)、选得工程中的设计取舍展开,深入对(精准检索)”作为Agent探讨企业级AI的结构性需求, Agent从“IDE插件”向系统阐述了如何通过“常驻服务”演进过程A2A协议实现中的核心挑战与Agent间协同、解决方案。重点阐述利用Elasticsearch实现了Agent的可观测性(Observability)、统一记忆管理与跨框架协同(A2A/S混合检索,并构建kills)和精准企业级可观测体系保障高可用、安全检索(Vector Search)三大合规与成本可控结构性需求,提出。; 适合通过Elasticsearch实现人群:具备一定统一记忆管理、AI与系统架构基础混合检索与安全,从事企业级AI Agent隔离,并结合OpenTelemetry研发、运维或技术实现全链路追踪与决策的技术人员,审计,推动AI尤其是关注Agent可观 Agent从玩具级测性、跨工具迈向企业级生产力系统协同与生产系统。; 适合人群:具备一定落地的工程师与架构师。;AI与系统架构基础 使用场景及目标:①理解,从事企业级AI AgentAI Agent在企业研发、运维或环境中所需的可观测性体系安全合规的技术人员,尤其是关注可观设计,包括LL测性、自动化协同M层、框架与数据治理的层与链路追踪;架构师与开发者②掌握基于。; 使用场景及目标:Elasticsearch的① 构建统一记忆管理、高可用、可语义检索与安全审计的企业级常驻Agent系统;隔离方案;③学习② 解决本地Harness Engineering中的任务存储导致的记忆孤编排、权限岛、脑分裂控制与A2A与安全黑盒协同机制,推动问题;③Agent从实验性 实现基于A2A协议的跨Agent协同与闭环自动化;④ 利用Elasticsearch提升检索工具迈向生产级系统; 阅读建议:此资源聚焦企业级Agent工程化落地,建议精度与上下文供给结合文中提到的能力; 阅读建议:本文结合OTel集成、实际案例(如OpenIngest Pipeline配置Claw)与技术与Elastic实战方案(OTel、案例进行动手实践,ELSER、D重点关注可观测性LS),建议读者数据的富化分析结合自身Agent架构与跨终端状态现状,重点关注可观同步的设计思路。测性实施路径、内存检索优化与安全合规设计,逐步推进Agent的工程化落地。

2026-07-28

AI-SecOps-合并版-理论与部署 - Luke 线上 20260722

内容概要:本文介绍了“分层AI SecOps”架构,结合Elasticsearch(ES)机器学习与本地大模型实现安全运营的自动化闭环。第一层利用ES机器学习进行无监督、低成本、常驻的全量日志监控,识别异常行为如请求突增、罕见访问或群体偏离;第二层由本地大模型按需介入,对被标记的异常进行深度调查,判断是否为真实攻击、爬虫或误报,并生成定级通报。系统通过n8n工作流集成Webhook触发、MCP服务反查ES上下文,结合本地LLM推理,最终实现从告警检测到调查报告自动生成的完整流程。部署基于Kubernetes,支持GLM、MiniMax等本地模型,保障数据主权、无速率限制且无Token费用。; 适合人群:具备一定安全运维和AI应用基础,从事SecOps、AIOps平台建设的技术人员及架构师,尤其是关注大模型本地化落地的安全团队; 使用场景及目标:① 实现全天候低代价的日志异常检测与高价值告警筛选;② 构建“轻量监控+重型研判”的分层智能安全响应体系,提升SOC效率并降低人工负担; 阅读建议:该方案强调工程可落地性,建议读者结合开源组件(n8n、es-mcp)动手部署,重点理解ML与LLM的任务分工、上下文传递机制及本地大模型选型策略,以适配自身环境。

2026-07-23

01-AI 搜索行业实践 - 阿里云 ES 的技术进阶 - 汤祯捷 线上 20260708

内容概要:本文介绍了阿里云Elasticsearch在AI搜索领域的技术进阶与创新实践,重点阐述了其自研FalconSeek内核引擎、云原生存算分离架构以及AI驱动的Agentic Search能力。平台全面支持RAG知识库、多模态混合检索(文本、图像、视频)、低代码Agent工作流编排,并深度融合百炼大模型与PAI平台,实现从数据采集、向量检索、智能推理到结果生成的全链路闭环。通过DiskBBQ量化技术和GPU加速,显著降低内存消耗与存储成本,提升向量检索效率,同时提供ES|QL多维分析、冷热数据分层、智能诊断等企业级能力,构建高性能、低成本、易运维的企业级AI搜索分析平台。; 适合人群:云计算工程师、搜索算法研发、AI应用开发者、企业级SaaS服务架构师,以及关注日志分析、智能搜索、RAG和Agent系统落地的技术决策者;具备一定大数据与AI基础知识的研发人员。; 使用场景及目标:① 构建企业内部知识库实现精准与对话式搜索;② 实现跨模态内容检索与智能风控;③ 支持出海营销中的用户画像、情感分析与自动化内容生成;④ 打造基于ELK的日志分析与可观测性系统;⑤ 结合大模型实现RAG与智能Agent工作流。; 阅读建议:此资料侧重于阿里云Elasticsearch在AI时代的技术演进路径,涵盖架构设计、性能优化与实际业务场景落地,建议结合自身业务需求重点关注存算分离、向量检索优化、Inference API集成及Agent开发能力,并参考案例进行技术验证与方案设计。

2026-07-13

02 - ES性能优化的人机协同新范式-腾讯云-房青松 武汉 20260627

引入 AI 做性能优化,效率提升是显而易见的,包括瓶颈定位更快、代码迭代更快、验证周期更短。但真正决定优化质量的,是工程师的判断力,即何时该信任 AI 的分析,何时需要深入 Debug 挖掘细节,如何将这些高质量的细节反哺给 AI 以提升其分析准确性。本议题将完整分享这套"AI 提速 + 工程师兜底"的协作模式,以及工程师核心能力在 AI 时代的新定义。

2026-06-28

03 - 龙虾看得见、会干活、选得对:Elastic 加持 OpenClaw 实战 李捷 武汉 20260627

内容概要:本文围绕AI Agent在企业级应用中的三大核心需求——“看得见、会干活、选得对”展开,结合Elastic与OpenClaw实战案例,深入探讨了如何通过可观测性(Observability)、跨框架协同(A2A/Skills)和精准检索(Vector Search)构建可靠、高效的Agent系统。文章详细分析了当前主流AI Agent的技术现状,提出从IDE插件到企业级常驻Agent的演进路径,并重点讲解了提示词工程、上下文工程与Harness Engineering三大工程关键点。针对本地化Agent存在的物理局限,如信息孤岛、并发锁死、记忆丢失等问题,提出基于Elasticsearch的统一记忆管理方案,实现高可用、跨终端协同、语义检索与安全隔离。; 适合人群:具备一定AI和软件开发基础,从事AI Agent研发、运维或架构设计的技术人员,尤其是关注企业级AI系统落地的工程师与技术管理者。; 使用场景及目标:①构建可监控、可审计的企业级常驻AI Agent系统;②解决Agent在多会话、高并发、跨设备场景下的记忆一致性与检索效率问题;③实现基于A2A协议的Agent协同与自动化闭环诊断; 阅读建议:此资源强调工程实践与系统思维,建议结合Elastic技术栈动手实践文中提到的可观测性接入、Ingest Pipeline配置、混合检索实现等关键步骤,并参考扩展阅读深化对记忆管理与技能路由的理解。

2026-06-28

04 - 从文本到语义-Elasticsearch向量检索在小米的规模化落地与优化实践 周名裕 武汉 20260627

小米基于 ES 向量检索的规模化落地实践,分享从文本搜索到语义理解演进过程中的优化与实战经验。

2026-06-28

01 - Elasticsearch 向量搜索及 AI Agents 开发 刘晓国 武汉 20260627

内容概要:本文系统介绍了Elasticsearch在向量搜索与AI智能体(Agents)开发领域的核心技术与应用实践。重点阐述了向量搜索的演进背景,包括稀疏向量(Sparse Vector)与稠密向量(Dense Vector)的原理、差异及其在语义搜索、多模态检索中的应用。文章还展示了Elasticsearch如何通过混合搜索(Hybrid Search)融合关键词与向量搜索,支持RAG(检索增强生成)系统,并推动AI智能体的发展。此外,涵盖了嵌入模型部署、数据摄入、向量查询构建、硬件加速优化、新型存储格式(如DiskBBQ)、语义文本字段自动分块等关键技术细节,最后深入探讨了基于Elasticsearch构建智能搜索Agent的架构与工作流程。; 适合人群:具备一定搜索技术或大数据基础,从事搜索推荐、AI应用、数据工程等相关工作的研发人员、架构师及技术管理者,尤其适合关注RAG、智能Agent与向量数据库落地实践的技术人员。; 使用场景及目标:①构建支持语义理解的智能搜索系统;②实现基于Elasticsearch的RAG应用以提升大模型准确性;③开发具备自主检索与决策能力的AI智能体;④优化大规模向量搜索性能与成本;⑤实现多模态内容检索与智能问答系统。; 阅读建议:建议结合Elasticsearch实际环境动手实践文中提到的模型导入、数据嵌入、混合查询与Agent构建流程,重点关注RRF融合策略、上下文工程设计及MCP集成方式,以深入掌握AI时代搜索系统的构建方法。

2026-06-28

01-AutoOps - 检测, 诊断并优化 Elasticsearch - 徐浩 线上 20260624

管理 Elasticsearch 不应该总是疲于奔命地救火。本次直播将介绍 Elastic 的 AutoOps,它提供了一种更智能的集群运行方式,能够实时检测问题、自动进行根本原因分析并提供可执行的建议。 AutoOps 分析数百个指标,以便及早发现问题、指导解决问题,并不断优化性能和成本。 结果:更快的故障排除速度、更低的运营成本,以及更多的时间专注于从数据中创造价值。

2026-06-25

01-当 OpenClaw 遇见 Elasticsearch:打造 Agent 长期记忆系统 - 程治玮 线上 20260603

内容概要:本文介绍了如何通过开发OpenClaw memory-elasticsearch插件,利用Elasticsearch增强Agent的长期记忆系统。文章首先阐述了Agent为何需要长期记忆,指出默认无状态设计导致上下文易丢失的问题,并介绍了OpenClaw原有的基于Markdown文件层与SQLite索引层的记忆机制。随后详细说明了该机制在扩展性、检索效率、复杂查询能力和记忆维护方面的局限性。在此基础上,提出构建基于Elasticsearch的插件解决方案,涵盖插件的架构设计、核心功能实现,包括插件声明(manifest)、运行时入口、工具注册(如memory_search、memory_update等)、CLI命令和生命周期钩子(如before_prompt_build和agent_end)的集成。最终通过演示展示了插件如何提升记忆系统的检索性能与可扩展性。; 适合人群:具备一定Agent开发经验、熟悉插件机制与搜索技术的研发人员,尤其是关注长期记忆系统构建的AI应用开发者; 使用场景及目标:①解决Agent本地记忆在多设备同步、团队协作下的扩展性问题;②提升记忆检索的精度与效率,支持复杂的结构化查询与聚合分析;③实现记忆的自动化管理与质量控制; 阅读建议:建议结合GitHub开源代码(https://github.com/cr7258/memory-elasticsearch)进行实践,深入理解插件化架构设计与Elasticsearch在Agent记忆系统中的整合方式,并尝试部署调试以掌握完整流程。

2026-06-03

04 - 智能体查询ES库的探索 -通过API封装实现自然语言查询 - 杨俊波 广州 20260523

本次分享将介绍如何通过 AI 智能体封装企业现有的 ES 数据 API(XDP 数据平台),实现自然语言驱动的数据查询能力。在技术方案层面,将系统阐述面向数据查询的 Agent 架构设计,采用 Plan-and-Execute 模式将复杂查询任务分解为规划、执行、验证的闭环流程,解决意图理解、参数生成、结果解读等核心难题。在工程实践层面,将分享如何通过智能体层封装底层数据接口,包括智能筛选策略决策(结构化字段匹配 vs 关键词检索)、基于向量库的实体识别与关键词召回、LEO 表达式生成等企业级落地方案。同时也会探讨 API 封装模式的优势与局限,以及在查询合法性校验、超时熔断、错误自诊断等方面的鲁棒性建设经验。最后将展示美妆行业真实业务场景的应用效果,验证非技术人员通过自然语言自助分析数据的可行性与价值。

2026-05-25

03-网易互娱基于Kibana的数据可视化平台的建设实践与技术沉淀-张哲-广州-20260523

内容概要:本文介绍了网易互娱基于Kibana构建数据可视化平台的实践与技术沉淀,重点阐述了ELK架构设计、Kibana平台的演进过程及其核心技术挑战的解决方案。文章详细展示了从原始日志采集(通过Flink、Kafka、Pulsar等)到Elasticsearch存储与索引管理的整体链路,并深入剖析了Kibana平台前台功能、多租户设计、元数据分析与升级机制。针对旧版Kibana网关存在的代码耦合高、升级困难等问题,团队自主研发了新一代NGK网关,采用Spring Cloud和Gradle多模块构建,实现高内聚、易维护的架构,并通过Testcontainers实现自动化版本迁移。同时,平台加强了可观测性建设,支持全链路监控与告警,并探索AI能力集成,如自然语言查询、异常模式识别和智能可视化推荐,推动数据平台智能化发展。; 适合人群:具备一定大数据平台使用经验或从事日志系统、数据可视化平台开发与运维的工程师,以及关注Kibana、ELK栈演进与AI融合的技术管理者;; 使用场景及目标:①了解大规模ELK平台在企业级应用中的分层架构设计与性能优化策略;②学习如何解决Kibana版本升级难题与多租户权限管理;③掌握基于NGK网关的高可用、可扩展平台开发方法;④探索AI在日志分析与数据可视化中的落地路径; 阅读建议:此资源以实际工程案例为主线,结合架构图与流程说明,建议读者结合自身平台建设需求,重点关注元数据管理、自动化升级与AI集成部分的设计思路,并参考其测试与监控体系完善现有系统。

2026-05-25

01-Elasticsearch 向量搜索及 AI Agents - 刘晓国 广州 20260523

内容概要:本文系统介绍了Elasticsearch在向量搜索与AI智能体(Agents)领域的技术进展与应用实践。重点阐述了向量搜索如何通过稠密(Dense)与稀疏(Sparse)向量模型实现语义理解、相似度匹配及多模态内容检索,并展示了其与传统关键词搜索融合形成的混合搜索能力。文章还深入探讨了检索增强生成(RAG)架构、智能体开发流程,以及Elasticsearch如何通过语义字段、自动分块、模型推理等能力支撑AI应用落地,同时介绍了硬件加速、向量量化、新型存储格式等性能优化技术。; 适合人群:具备一定搜索技术或AI应用开发经验的技术人员、架构师及数据工程师,尤其是关注RAG、智能体构建与向量数据库实践的从业者。; 使用场景及目标:① 构建支持语义理解与混合检索的智能搜索系统;② 开发基于Elasticsearch的RAG应用与AI智能体,提升大模型上下文质量;③ 优化向量搜索性能与成本,应用于推荐系统、图像搜索、内容发现等场景。; 阅读建议:此资料兼具理论与实战指导价值,建议结合Elasticsearch实际部署环境,逐步实践从模型导入、数据嵌入、混合查询到智能体集成的全流程,并关注最新版本特性如Semantic Text字段、MCP集成与硬件加速能力。

2026-05-25

02-易捷问数+ Elastic :从数据底座到 AI 认知的跨场景智能化实现 -Luke 广州 20260523

内容概要:本文介绍了基于MCP协议的社区开源方案,旨在解决Elasticsearch官方在9.3版本前缺乏原生AI支持的问题,实现从数据底座到AI认知的跨越。通过自主研发的两个开源MCP服务——elasticsearch-mcp和mcp-server-kibana,支持ES 5.x至9.x全版本兼容,提供包括索引管理、映射查看、DSL查询、ILM策略配置及Kibana仪表盘自动化创建等核心功能。系统通过自然语言驱动,实现对Elastic Stack的零代码操作,支持本地stdio和远程HTTP双模式通信,推动AI与运维场景深度融合。; 适合人群:熟悉Elasticsearch和Kibana的技术人员,尤其是从事AIOps、数据平台建设、搜索系统运维与开发的工程师及架构师;适用于希望在不升级集群的前提下引入AI能力的企业技术团队。; 使用场景及目标:①通过自然语言自动创建和管理ILM生命周期策略,提升运维效率;②基于语义指令自动生成和修改Kibana可视化仪表盘,降低使用门槛;③实现跨版本Elastic集群的统一AI控制接口,推动老旧系统智能化升级; 阅读建议:建议结合开源项目代码(npm包@tocharian/elasticsearch-mcp 和 @tocharian/mcp-server-kibana)进行实践部署,重点关注MCP服务与AI客户端(如Claude Desktop)的集成方式,并通过现场DEMO学习自然语言到API调用的映射逻辑,同时注意安全审计与权限控制配置。

2026-05-25

Elastic Agent Builder 介绍 - 核心概念与应用场景 - 夏乔 线上 20260520

随着大语言模型进入企业业务场景,AI 的核心挑战已不再是“能否对话”,而是能否在真实环境中安全读取数据、调用工具、执行流程,并形成可追溯、可治理的业务闭环。 Elastic Agent Builder 正是面向这一目标推出的 Agent 构建与执行框架。它以 Elasticsearch 可靠的数据为上下文基础,将 Agent 推理、Skill 能力封装、Tool 工具调用、Connector 外部系统连接、Workflow 流程编排等能力整合在一起,帮助企业构建可落地的 AI Agent 系统。 无论您是 Elasticsearch 开发者、运维工程师、安全分析人员,还是正在探索企业级 AI Agent 架构的技术团队,本次分享都将帮助您快速建立一套清晰、可落地的 Agent Builder 认知框架。

2026-05-21

01-ElasticRelay - 多源实时 CDC 到 Elasticsearch 同步引擎 - 林继繁 上海 20260513

内容概要:本文介绍了ElasticRelay——一款轻量级、高性能的多源实时CDC(变更数据捕获)同步引擎,旨在将MySQL、PostgreSQL和MongoDB的数据实时同步至Elasticsearch。该工具采用Go语言开发,仅需单一二进制文件即可运行,内存占用约50MB,支持毫秒级延迟、断点续传、数据零丢失,并内置数据脱敏、字段映射、表达式计算等转换功能。通过声明式JSON配置,用户可快速完成部署与管理,无需编写代码,且支持配置热重载,极大降低了运维复杂度和学习成本。相比传统Debezium+Kafka架构,ElasticRelay在部署效率、资源消耗和实时性方面具有显著优势。; 适合人群:具备一定数据库与数据同步基础知识的开发、运维及数据工程师,尤其适用于中小型团队或对实时搜索、数据分析有高时效性要求的技术人员。; 使用场景及目标:① 替代复杂的多组件CDC链路(如Kafka+Debezium),实现数据库变更实时入仓/入索引;② 满足GDPR等隐私合规需求,实现敏感数据开箱即用的脱敏处理;③ 支持大表全量初始化加速、故障自动恢复、动态配置更新等生产级特性; 阅读建议:建议结合GitHub开源项目(github.com/yogoosoft/ElasticRelay)进行实践操作,重点关注其配置结构、检查点机制与数据转换能力,并可通过本地搭建环境验证同步延迟、吞吐性能及DLQ容错表现。

2026-05-13

Elastic China AI Search Tech Day slides-external 0420.zip

Elastic China AI Search Tech Day slides-external 20260418. Elastic 中国 AI 搜索大会议

2026-04-28

06-SmellDoc 基于 Elastic Stack 的微服务异味检测与可观测分析方法 - 邢永超 线上 20260422

内容概要:本文提出了一种基于Elastic Stack的微服务异味检测与可观测分析方法——SmellDoc,旨在解决现有工具在异味检测中覆盖范围有限、可视化深度不足以及检测与运行时监控脱节的问题。SmellDoc通过扩展Elastic APM并集成自研插件apm-springcloud-business-plugin,采集微服务系统的静态结构与运行时多源数据,结合24类微服务异味的检测规则,在Kibana中实现异味的统一可视化展示。系统涵盖三大功能模块:异味知识库(Bad Smell Knowledge Tab)、运行监控(Monitor Tab)和异味检测(Detection Tab),支持从指标采集、数据聚合、异味识别到结果解释的全流程闭环分析。此外,文章还介绍了配套的自适应重构框架SABER,基于MAPE-K模型实现检测与自动化修复的联动,提升系统自愈能力。; 适合人群:具备微服务架构、可观测性技术(如APM、Kibana)基础的软件工程师、系统架构师及从事DevOps与持续治理的研究人员,尤其适合关注微服务质量优化与自动化运维的技术团队; 使用场景及目标:①识别微服务架构中的典型异味(如Mega Service、Cyclic Dependency、Fragile Service等),辅助架构治理;②将异味检测结果与链路追踪、性能指标联动分析,提升根因定位效率;③结合SABER框架探索自动化重构路径,推动微服务系统的自适应优化; 阅读建议:建议结合GitHub开源项目(BSDProject、kibana_bad_smell_detection_plugin)进行实践部署,重点关注插件实现机制(如Byte Buddy字节码增强、Micrometer指标上报)与检测规则的设计逻辑,并通过实际微服务系统验证检测效果与重构收益。

2026-04-22

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除