自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+
  • 博客(221)
  • 收藏
  • 关注

原创 SQL Server 索引知识汇总

本文对SQLServer中的索引进行一个知识总结。

2026-07-22 23:11:48 287

原创 医疗器械行业 Salesforce Territory 完整落地实例

Salesforce的Territory是一个比较难理解的概念,这里通过AI智能体的不断提问,做了一个总结,并且结合一个实际的虚拟案例,说明其到底是什么,以及应该如何配置。

2026-07-18 21:25:30 253

原创 Raw Data Vault vs Business Data Vault

Raw Vault = 企业数据的“原始档案库”:原样收纳、只结构化、不解读、全历史审计;Business Vault = 企业数据的“标准化加工车间”:统一业务规则、整合多源、预生成高效业务查询结构。

2026-07-06 17:49:10 248

原创 CLAUDE.md笔记

这篇文章结合一个完整的前后端 RAG 项目实践,讲清楚 CLAUDE.md 到底该怎么写:什么内容必须放,什么内容绝对不能放,最后给一份可直接复用的完整示例。

2026-06-26 11:13:31 283

原创 Neo4j 多跳查询实战:从社交网络场景理解图遍历

图数据库的核心优势之一,就是天然支持高效的**多跳路径查询**。本文将以「社交网络好友关系」为实例,从零开始讲解 Neo4j 中多跳查询的语法、场景、进阶技巧与性能边界。

2026-06-21 10:37:28 482

原创 Git 本地版本管理学习笔记

很多开发者接触 Git 的第一印象是「GitHub 远程仓库」,但常常忽略了 Git 最核心的本质:它是一套**分布式版本控制系统**,哪怕不联网、没有任何远程仓库,仅凭本地环境就能完整管理代码的每一次变更——记录修改、回溯版本、追溯历史,全在本地完成。

2026-06-21 10:35:45 272

原创 JWT原理 FastAPI Vue3极简实现JWT登录鉴权

前后端分离项目中,传统的Session登录需要服务端存储会话信息,存在**服务器集群无法共享、扩展性差**的问题。而JWT作为目前最主流的无状态登录鉴权方案,彻底解决了这个痛点。本文分为三部分:零基础看懂JWT底层原理、FastAPI后端极简实现登录签发令牌、Vue3前端单文件对接登录鉴权,**所有代码极致精简,无数据库、无冗余业务逻辑**,纯核心功能方便新手快速理解原理。

2026-06-17 11:16:52 329

翻译 Power BI五大常见使用误区

使用Power BI时最容易出现哪些典型错误?举个例子,当一位新人同事第一次接手Power BI项目,有哪些坑你一定会提前提醒他?你会给出哪些建议?本文整理了Power BI项目开发中频繁遇到的各类误区。这份清单并未涵盖所有问题,欢迎大家在评论区补充其他错误写法、不良开发实践。

2026-06-17 10:59:50 42

原创 微软技术直通车:基于AI的智能构建。2026年6月13日北京微软。

2026-06-10 20:31:02 266

原创 RAG Embedding 多义消歧完整解决方案

本文从底层原理、离线知识库优化、线上查询优化、模型选型、检索后处理多个维度完整拆解落地方案。

2026-06-01 17:38:47 482

原创 RAG向量检索核心详解:Cosine、Dot、Euclidean

目前主流向量数据库(FAISS、Milvus、Chroma、Pinecone)全部支持三种核心度量方式:Cosine余弦相似度、Dot Product点积、Euclidean欧氏距离。很多新手做RAG踩坑的核心原因:选错相似度算法,导致语义匹配完全失真、检索结果错乱。本文用通俗逻辑、标准公式、直观案例,一次性讲透三者的原理、区别与RAG最优选型方案。

2026-06-01 17:35:09 350

原创 看完《低智商犯罪》,学习Cypher构建知识图谱

《低智商犯罪》都看了吧,是否现在还在回味剧情里每一个人物的刻画,以及每一个案件的编排。看完后咱们就来简单的学习一下,如何把剧集里的人,事件以及各种关系,构建成一个简单的知识图谱。

2026-05-27 13:59:37 411

原创 LangChain DeepAgents 学习笔记

LangChain的DeepAgents已经发布有段时间了,最近的几个版本基本覆盖了大多数智能体都应该有的功能。本笔记基于 LangChain 的 DeepAgents 框架,演示如何构建了一个具有角色扮演能力的 AI 助手,并集成了自定义技能系统。以此方便后续的knowledge review以及vibe coding的reference。

2026-05-19 14:08:49 517

原创 LangChain Deepagent 版本0.6.1中间件一个bug

目前不清楚这个问题是从哪个版本开始的。所以我把版本回退到了2026年4月1日的版本,因为我看视频教程,教程是在4月8日发布的,所以查看了下github的release记录,4月1日的版本是0.5.1,回退到这个版本,问题解决。本文撰写时间是2026年5月18日,目前langchain deepagent的版本为0.6.1。所以使用pip直接install deepagents的默认版本,大概率会遇到我所说的问题。以下代码演示如何卸载当前版本然后安装指定版本的deepagents。以下是我测试的完整代码。

2026-05-19 01:21:38 458

原创 Neo4j笔记(五):查询的处理流程

上一篇讲述了一篇文章如何通过LLM转换成Cypher,然后在Neo4J里运行,形成知识图谱。此篇接着上篇,继续梳理一个用户查询,如何通过图数据库以及大模型去汇总查询结果。

2026-05-10 00:20:11 502

原创 微软 SQL Server 版本演进史:从诞生到 SQL Server 2025

微软 SQL Server 2025发布应该快半年了,不知不觉发现已经跟这位老朋友一起奋斗了25个年头,SQLServer作为全球最受欢迎的企业级关系数据库之一,自 1989 年诞生以来已经走过了近 40 年的发展历程。本文将带你回顾 SQL Server 从第一个版本到最新 SQL Server 2025 的完整演进历史,并重点介绍每个版本的关键新特性。

2026-05-08 22:51:41 675

原创 提升 Text2SQL 准确率

随着大语言模型的爆发,Text2SQL(自然语言转SQL)技术正在重塑我们与数据库的交互方式。本文将系统性地梳理提升 Text2SQL 准确率的核心方法,涵盖提示工程、模型微调、推理增强三大维度。**所有示例基于微软 AdventureWorksDW2016 数据仓库**。

2026-05-08 00:50:16 367

原创 SQLServer Management Studio(SSMS) 22 Copilot 最佳实践学习笔记

在最新的SSMS 22版本中,加入了微软官方的AI工具GitHub Copilot。此篇结合微软官方的文档,汇总了我们作为机长,应该如何跟这位副驾磨合。

2026-05-07 00:11:36 382

原创 SQLServer RAG笔记4:从服务层到前端交互

在之前的文章中,我们完成了 SQLServer 2025 向量数据库的搭建和基本配置。本文将深入介绍服务层和前端部分的三个核心模块:**Embedding 生成**、**数据入库流程**以及**前端交互关键代码**,完成一个基于SQLServer 2025的向量数据库的RAG系统流程。

2026-05-07 00:08:26 255

原创 SQLServer RAG笔记5:为SQLServer 2025配置Ollama

在第三篇笔记中,我们结合Python代码,通过Ollama的嵌入模型,实现了为SQLServer 2025向量数据库生成向量值。从SQLServer 2025开始,是支持直接把大模型作为EXTERNAL MODEL的。此篇将介绍如何配置Ollama里的嵌入模型作为SQLServer 2025的EXTERNAL MODEL。

2026-05-06 14:53:36 308

原创 SQL Server RAG 笔记3:SQLServer2025 向量数据库

在大模型RAG应用中,提起向量数据库大家想到的更多的是Chroma和FAISS,微软也紧跟时代的步伐,并且在2025年底发布的 SQLServer 2025 也提供了原生向量支持,此篇将介绍如何在SQLServer 2025里搭建向量数据库环境。

2026-05-06 00:19:50 332

原创 详解传统RAG、Text2SQL、Graph RAG:适用场景与问题示例汇总

在AI问答与数据查询领域,传统RAG、Text2SQL、Graph RAG是三种核心的技术路径,它们各自有明确的定位、独特的特点,适配不同类型的查询需求。很多开发者在实际项目中会混淆三者的适用场景,本文将详细拆解每个系统的核心特点,明确其适合回答的问题类型,并搭配10个具体示例,帮助大家快速区分、精准选型。

2026-05-05 22:57:24 303

原创 SQL Server RAG 笔记2:图数据库服务层与前端可视化构建

此篇是 SQL Server 图数据库实战的第二篇,继续构建知识图谱前端,将介绍基于 FastAPI 的服务层架构设计,以及 Vue3 + D3.js 前端图可视化实现。内容涵盖 API 路由设计、数据传输模型、前端组件化架构、D3.js 力导向图布局等核心知识点。

2026-05-05 00:20:38 317

原创 SQL Server RAG 笔记1:图数据库构建

在AI开发中,知识图谱是非常火的一个领域,而提到图数据库大家都会第一时间想到Neo4J,其实在SQLServer中早已有支持,此篇将简单演示如何在SQLServer下构建图数据库,实现知识图谱的管理。

2026-05-04 00:46:31 2090 2

原创 Neo4j笔记(四):一篇文章如何入库的

一直很好奇,一篇文章是如何进入到图数据库的,毕竟一篇文章啥格式都有,而写入到图数据库还必须遵从规则和语法,所以这注定不是一个普通RAG或者SQL的过程。此篇讲带大家一起看一下这里都需要经历哪些过程。

2026-04-29 00:23:51 1041

原创 数据仓库笔记 第六篇:PSA 层 SCD2 处理方式

**SCD2(Slowly Changing Dimension Type 2)** 是维度建模中处理历史变更的行业标准且最常用的方案。相比快照方式,SCD2只写入真正发生变化的数据行,通过 `有效期` 字段精确记录每条数据的生命周期,用极低的存储成本实现完整的历史追溯能力。这一篇用详细的代码解释其工作流程。此笔记使用的数据库为SQLServer,相应的示例脚本都围绕于此,其它数据库的相应实现会略有不同。

2026-04-28 00:22:36 1040

原创 数据仓库笔记 第五篇:Data Mart 层(数据集市)

什么是 Data Mart?Data Mart(数据集市)是数据仓库的**面向主题的子集**,专门为特定业务部门或分析场景服务。我个人建议,前端BI工具,无论是Power BI或者是Tableau,都从这一层取数据,这样一来可以提高前端报表性能,同时也可以降低前端工具的建模难度。此笔记使用的数据库为SQLServer,相应的示例脚本都围绕于此,其它数据库的相应实现会略有不同。

2026-04-27 00:08:19 176

原创 数据仓库笔记 第四篇:Star Schema 层(维度建模)

Star Schema(星型模型)是 **Ralph Kimball** 提出的维度建模方法,是数据仓库**面向分析的核心层**。此笔记使用的数据库为SQLServer,相应的示例脚本都围绕于此,其它数据库的相应实现会略有不同。

2026-04-27 00:07:31 478

原创 数据仓库笔记 第三篇:常用缓慢变化维处理方式介绍

数据仓库可以帮助我们追溯数据的历史变化,其中最主要的一个方法就是缓慢变化维。此篇主要介绍最常用的缓慢变化维:Type1, Type2, Type3。此笔记使用的数据库为SQLServer,相应的示例脚本都围绕于此,其它数据库的相应实现会略有不同。

2026-04-27 00:06:49 370

原创 数据仓库笔记 第二篇:PSA 层(持久化暂存区)详解

PSA(Persistent Staging Area,持久化暂存区)是数据仓库的**第一层持久化存储**,直接接收从业务系统抽取的数据,并**长期保存所有历史版本**。作为数据库的第一层,叫法很多,也有叫stage,也有叫OBS,标准不是非常的统一。在我的系列笔记里都统一使用psa的这个叫法。此笔记使用的数据库为SQLServer,相应的示例脚本都围绕于此,其它数据库的相应实现会略有不同。

2026-04-27 00:06:08 355

原创 数据仓库笔记 第一篇:数据仓库的定义、历史与意义

数据仓库(Data Warehouse,简称 DW 或 DWH)是一个**面向主题的、集成的、非易失的、随时间变化的**数据集合,用于支持管理决策。此笔记使用的数据库为SQLServer,相应的示例脚本都围绕于此,其它数据库的相应实现会略有不同。

2026-04-27 00:05:21 476

原创 Neo4j笔记(三):数据建模与程序连接实战

环境:macOS + Neo4j + Python

2026-04-26 09:41:28 285

原创 Neo4j笔记(二):Cypher CRUD 完全指南

环境:macOS + Neo4j Browser,此篇简单介绍Cypher的CRUD操作。

2026-04-26 09:40:48 247

原创 Neo4j笔记(一):安装与快速入门

环境:macOS,Docker / Homebrew / Neo4j Desktop 三种安装方式,以及基础概念,快速入门。

2026-04-26 09:40:09 509

原创 Power BI学习笔记第20篇:面试题汇总 · 第三篇:高级应用与最佳实践篇

这一篇不考你记没记住概念,考的是你有没有真正踩过坑、解决过实际问题。答得好不好,一听就知道。

2026-04-26 09:15:50 486

原创 Power BI学习笔记第19篇:面试题汇总 · 第二篇:数据建模与 DAX 篇

数据建模和 DAX 是区分"会用 Power BI"和"真正懂 Power BI"的分水岭。面试官问到这两块,眼睛都在放光——因为答不好的人太多了。

2026-04-26 09:15:03 474

原创 Power BI学习笔记第18篇:面试题汇总 · 第一篇:基础概念篇

面试官问的每一道基础题,都是在试探你对 Power BI 全貌的理解有多深。答不上来?要么是你没动手做过,要么是你没想过为什么要这么做。

2026-04-26 09:14:12 579

原创 Power BI学习笔记第17篇:Power BI Dashboard 常用布局方案推荐

此篇汇总Dashboard常见的布局方式,作为后续设计的参考。

2026-04-25 09:08:21 417

原创 Power BI学习笔记第15篇:企业级报表开发与最佳实践

本文系统介绍了企业级报表开发的最佳实践框架,主要内容包括:1)报表分类与设计流程;2)数据模型架构设计、命名规范和文档标准;3)行级和对象级安全控制;4)实时、增量和全量刷新策略;5)模型、DAX和报表性能优化方法;6)CI/CD部署流程和版本管理;7)使用指标和性能监控体系;8)自助分析架构设计。文章通过表格、流程图和代码示例,全面阐述了企业报表开发从设计到运维的全生命周期管理要点。

2026-04-25 00:42:29 267

原创 Power BI学习笔记第14篇:Power Query 高级数据处理

本文详细介绍了Power Query的高级数据处理技术,主要包括:1) M语言基础与查询步骤链;2) 高级数据获取方法,如多文件合并、动态数据源和Web API调用;3) 复杂数据清洗技巧,包括文本处理、日期转换和数据类型推断;4) 高级合并与连接操作;5) 数据透视与逆透视;6) 自定义函数编写;7) 高级分组聚合;8) 错误处理机制;9) 性能优化策略。文章还总结了Power Query的最佳实践,强调参数化、批量处理和查询折叠的重要性,为高效数据转换提供了全面指导。

2026-04-25 00:41:26 394

空空如也

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除