自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+

mingo_敏

计算机视觉和模式识别,深度学习

  • 博客(871)
  • 资源 (13)
  • 收藏
  • 关注

转载 PyTorch Cookbook(常用代码段整理合集)

本文代码基于PyTorch 1.0版本,需要用到以下包import collectionsimport osimport shutilimport tqdmimport numpy as npimport PIL.Imageimport torchimport torchvision1 基础配置1-1 检查PyTorch版本torch.__version__ ...

2019-04-27 15:58:29 3369 4

原创 Linux常见命令汇总

Linux下统计当前文件夹下的文件个数、目录个数统计当前文件夹下文件的个数,包括子文件夹里的ls -lR|grep "^-"|wc -l统计文件夹下目录的个数,包括子文件夹里的ls -lR|grep "^d"|wc -l统计当前文件夹下文件的个数ls -l |grep "^-&quot

2018-12-06 11:08:08 1877 11

原创 本博客目录及版权申明

【C++ Primer 学习笔记】系列:第一部分 基本语言第二部分 容器和算法 【C++ Primer 学习笔记】: 容器和算法之【顺序容器】 【C++ Primer 学习笔记】: 容器和算法之【关联容器】 【C++ Primer 学习笔记】: 容器和算法之【泛型算法】第三部分 类和数据抽象第四部分 面向对象编程与泛型算法第五部分 高级主题【Java: 23种设计模式】系列 Java: 23

2015-11-25 17:37:30 1751 1

原创 SenseNova U1‑8B‑MoT RTX4090 Ubuntu22.04完整部署指南

硬件:RTX 4090 24GB|系统:Ubuntu 22.04 LTS。

2026-08-25 14:00:25 9

原创 深度学习论文: Synthetic Object Compositions for Scalable and Accurate Learning in Detection, Segmentation,

人类视觉可依据格式塔原则将场景拆解为独立语义对象,对应计算机视觉中的目标检测、实例分割与视觉定位任务,广泛支撑机器人感知、自动驾驶、图像编辑等应用。现有人工标注数据集受限于高昂标注成本,存在类别长尾、场景组合覆盖不足的固有缺陷。现有合成数据方案分为两类。仿真渲染类可输出高精度真值,但受三维资产约束,目标多样性不足,适用场景受限。文生图结合伪标签的方法场景丰富,但引入生成与标注噪声,标注可靠性差。

2026-08-20 10:58:09 14

原创 Z-Image:重新思考文生图模型的效率边界

阿里巴巴通义实验室开源了Z-Image-Turbo图像生成模型,仅60亿参数、8步采样即达到开源模型第一的1161 Elo评分。其核心技术包括:1)S3-DiT单流架构实现跨模态高效交互;2)Decoupled-DMD蒸馏技术将推理步数压缩至8步;3)DMDR强化学习提升生成质量。该模型以1/5参数量达到对标模型87.4%的生成质量,且推理成本最低(5美元/千图),支持中英双语渲染,并通过量化适配消费级硬件。这一成果证明了通过架构创新和训练优化,而非单纯扩大规模,同样能实现高效高质量的图像生成。

2026-08-17 10:56:59 27

原创 深度学习论文: Fully Distributed Multi-View 3D Tracking in Real-Time

深度学习论文: Fully Distributed Multi-View 3D Tracking in Real-TimePyTorch代码:PyTorch代码:多相机多目标跟踪(MCMT)是智慧城市、智慧仓储的核心感知技术,上千路相机组网的落地需求持续高涨。现有方案分为集中式、去中心化、纯分布式三类,相机又分为重叠/无重叠视场两种拓扑,重叠视场的三维几何信息可有效缓解跟踪遮挡难题。集中式方案虽精度高,但单节点承载全部计算与通信,大规模部署时带宽、延迟、稳定性缺陷突出;

2026-08-14 09:25:52 43

原创 十年磨一剑:我的CSDN创作之路

博主:mingo_敏 | 坐标:魔都上海 | 加入CSDN:2010年9月。

2026-08-08 11:34:49 190

原创 Milvus 使用指南(v2.5.x)

Milvus 向量数据库使用指南摘要 本文档是 Milvus 向量数据库(v2.5.x)的实战手册,涵盖从基础概念到完整代码实现的全流程。主要内容包括: 基础概念:解释向量数据库的核心价值、相似性搜索流程、关键术语和三种距离度量方式(L2/COSINE/IP)。 部署方式:提供三种部署方案: Milvus Lite(轻量级嵌入式,适合开发测试) Docker Compose Standalone(单机生产环境) Distributed(K8s集群,企业级) 核心功能: Collection与Schema设计

2026-08-05 14:56:16 657

原创 DeepAgents : 上下文工程(Context engineering)

DeepAgents通过上下文工程优化AI代理性能,核心在于精准管理五类上下文:启动时注入的静态配置(启动上下文)、运行时传递的固定参数(调用上下文)、自动压缩机制(压缩上下文)、子任务隔离(隔离上下文)及跨会话存储(长期记忆)。关键心法是控制模型输入、工具交互和生命周期的信息流动,避免冗余与超限。实践表明,清晰的接口描述比示例堆砌更有效,而上下文管理的质量直接决定代理稳定性,远胜于单纯依赖模型升级。

2026-08-01 11:31:16 185

原创 DeepAgents : 检索(Retrieval)

大语言模型面临上下文窗口限制与知识固化问题,检索增强生成(RAG)通过动态获取外部知识突破瓶颈。知识库构建支持文档加载与现有系统集成,形成智能体式或两步RAG架构。两步RAG流程固定,适合稳定场景;智能体式RAG由模型自主决策检索时机,灵活性高;混合RAG加入验证环节,适用于复杂查询。代码示例展示了基于LangGraph文档的智能体问答实现,体现动态检索与知识引用的结合。不同架构可根据业务需求在控制力、灵活性与延迟间权衡选择。

2026-08-01 11:29:22 190

原创 DeepAgents : 记忆机制(Memory)

摘要: DeepAgents采用“记忆即文件”机制,通过作用域和权限管理实现智能体记忆。核心设计包括: 命名空间隔离:支持用户级、智能体级、组织级隔离,按需配置读写权限; 写入策略:热路径即时更新或后台整合提炼,平衡效率与知识沉淀; 安全防护:敏感路径(如组织策略)设为只读,防止提示注入攻击; 扩展能力:结合对话历史检索和Skills机制动态加载记忆,避免上下文膨胀。 关键实践包括避免并发冲突、控制记忆粒度及权限最小化。

2026-07-31 08:52:48 241

原创 DeepAgents : Skill 机制与实践

摘要: DeepAgents的Skill机制通过渐进式披露解决Agent任务复杂度提升带来的上下文膨胀和维护困难问题,实现领域知识的轻量化复用。其核心包含三层加载机制(元数据/指令体/辅助资源),支持创建标准化Skill目录、编写结构化SKILL.md文件,并通过代码挂载快速接入。实践建议包括优化Skill描述唯一性、保持引用扁平化、按决策树结构编写指令,并区分场景决定适用性(推荐固化工作流和频繁更新的领域知识)。高级功能支持捆绑可执行脚本和远程文件加载。

2026-07-31 08:50:17 214

原创 深度学习论文: Synthetic data generation framework for quality control automation in rotogravure printing

本文提出了一种面向凹版印刷质量控制的合成数据生成框架,用于解决工业场景中缺陷样本稀缺的问题。该框架可自动生成高保真印刷缺陷图像(如鱼眼白点、条纹、套印偏差、折痕),并同步提供边界框与像素级标注。通过物理建模和分层仿真技术,该方案能逼真模拟各类缺陷的视觉特征。实验表明,仅使用合成数据训练的RFDETR模型在真实测试集上达到80.9%的mAP,验证了方法的有效性。该框架无需大量真实样本,为印刷产线缺陷检测提供了一套低成本、可快速部署的自动化解决方案。相关PyTorch代码已开源。

2026-07-30 16:26:31 324

原创 DeepAgents : 多模态输入与输出(Multimodal inputs and outputs)

DeepAgents支持构建多模态工作流,支持图像、视频、音频和文档等文件类型。用户可通过三种方式引入多模态数据:直接附加媒体文件、使用内置read_file工具或自定义工具返回多模态结果。系统提供标准化的内容块格式处理多模态输入,但内置的上下文压缩机制主要针对文本优化,可能导致较早轮次的媒体内容被丢弃。建议将大型媒体文件存放在外部存储中并使用路径/URL引用,而非直接嵌入原始数据,以保持消息历史的轻量高效。针对需要大量图像处理的任务,可考虑使用子代理处理并返回精炼的文本结果。

2026-07-30 09:09:08 185

原创 DeepAgents : 权限(Permissions)

DeepAgents 权限系统通过声明式规则控制智能体对文件系统的访问权限。摘要如下: 核心功能 通过FilesystemPermission规则列表精确控制智能体对文件/目录的读写权限 仅适用于内置文件系统工具(ls/read/write等),不适用于自定义工具和Shell命令 权限规则结构 operations:指定"read"/"write"操作类型 paths:使用Glob模式匹配绝对路径 mode:设置allow/deny/interrupt三种处理方式 关键特性 支持人工审批中断机制(inter

2026-07-30 09:02:48 239

原创 DeepAgents : 后端(Backends)

DeepAgents 提供多种后端实现,支持智能体运行逻辑、沙箱环境调度和会话状态持久化。预置后端包括:StateBackend(默认线程内存储)、FilesystemBackend(本地磁盘)、StoreBackend(跨线程持久化)、ContextHubBackend(LangSmith存储)、SandboxBackend(隔离执行)和LocalShellBackend(无隔离开发环境)。CompositeBackend支持路径路由到不同存储后端。各后端适用于不同场景,开发者可根据安全需求灵活选择,如生

2026-07-29 12:11:41 305

原创 DeepAgents : 工具(Tools )

DeepAgents工具模块实现智能体与外部环境的高效交互,支持自定义函数、LangChain工具及MCP服务的无缝集成。开发者可通过tools=参数快速注入工具集,结合内置文件操作、任务调度等运行时工具构建复杂工作流。框架兼容Google、OpenAI等主流大模型,并提供多模态返回能力(文本/图片/音频等)。示例演示了Tavily搜索工具封装、MCP异步服务调用及沙箱环境工具(如文件读写、子任务派发)的使用,突出其灵活性和开箱即用特性。

2026-07-29 12:10:10 414

原创 从“能用”到“好用”:深入 LangChain 中间件,打造企业级 Agent

本文展示了一个使用LangChain构建的智能研究助手Agent的完整配置代码。该Agent具备多项高级功能,包括: 核心配置:基于GPT-5.5模型,配备搜索、文件操作和代码执行工具 中间件增强: 文件系统管理:通过虚拟文件系统扩展上下文容量 自动上下文压缩:防止对话超出token限制 子任务委派:支持创建专业子Agent处理特定任务 双重容错机制:对模型调用和工具执行进行自动重试 人工审批:关键操作(如写文件)需人工确认 这些组件协同工作,使Agent能够稳健处理复杂研究任务,同时通过中间件机制有效控制

2026-07-28 12:56:02 374

原创 深度学习论文: Select-Mosaic: Data Augmentation Method for Dense Small Object Scenes

本文提出Select-Mosaic数据增强方法,针对密集小目标检测场景改进了传统Mosaic技术。该方法通过细粒度区域选择策略,优先将小目标最密集的图像区域放置在拼接后最大区域,显著提升了模型对密集小目标的检测能力。实验结果表明,Select-Mosaic在保持原Mosaic优势的同时,能有效提高检测精度。核心创新在于引入目标密度计算和选择性拼接机制,通过概率控制实现与传统Mosaic的混合使用。该方法特别适用于航拍图像等密集小目标场景,相关PyTorch代码已开源。

2026-07-24 19:28:59 31

原创 小目标检测的困局与破局:从原理到实战

小目标检测是计算机视觉落地工业场景时最易翻车的核心难题。同一套检测模型,大目标的 AP 可达 60% 以上,小目标 AP 却常年卡在 20%~30%,精度差距超过 30 个百分点。本文结合 2025 年最新综述,系统拆解小目标检测的四大核心痛点,梳理六大主流优化方案,给出可直接落地的实战调优路线。

2026-07-24 18:19:06 25

原创 ICME 2026 高精度制造跨场景缺陷检测与细粒度缺陷分级挑战赛

文章摘要 ICME 2026工业缺陷检测挑战赛针对半导体制造中的两大核心难题:跨产线场景泛化能力不足与缺陷分级体系缺失。赛事设立两条赛道:赛道一聚焦跨场景缺陷检测,要求模型在域偏移条件下实现精准缺陷定位与分类;赛道二侧重细粒度缺陷分级,需按工业标准划分缺陷严重程度。比赛构建了包含7类缺陷的大规模显微图像数据集,赛道一含3,800+图像,赛道二含2,600+分级标注样本。21支决赛队伍提交方案显示,跨场景检测的关键在于误报控制(冠军方案采用多VLM集成),而分级任务的核心挑战在于区分有序风险等级边界(最优方案

2026-07-22 08:45:20 226

原创 DINOv3:Meta 新一代自监督视觉基座,彻底解决稠密特征退化

2024年Meta发布的DINOv2凭借无标注纯图像自监督学习,打破CLIP类弱监督模型依赖图文配对数据的限制,仅靠单张图片就能产出优质全局+局部特征,在分割、3D匹配、遥感、病理等无标注冷门领域爆火。但DINO系列(尤以DINOv2)在长时训练中面临稠密特征退化:迭代至1M轮时,[CLS]全局分类特征持续增强,但Patch级空间语义相似性急剧破坏——特征图糊化,同类物边界模糊,背景噪声激增。

2026-07-21 19:55:40 61

原创 深度学习论文: A Masked Autoencoder Approach to Unsupervised Steel Surface Defect Recognition

本文提出了一种基于掩码自编码器(MAE)的无监督钢材表面缺陷识别方法。通过非对称编解码结构,模型仅编码可见图像块并重建缺失像素,学习泛化特征表示。在NEU钢材缺陷数据集上,采用权重共享双分支联合预训练策略,结合CLAHE增强和随机掩码技术。预训练完成后,利用编码器提取特征,经UMAP降维后通过沃德链接凝聚层次聚类实现无监督缺陷分类。实验结果表明,该方法在无监督条件下能有效区分6类钢材缺陷,为工业质检提供了标注稀缺场景下的可行方案。相关代码已开源。

2026-07-21 16:42:31 43

原创 深度学习论文: FedTR: Federated Learning Framework with Transfer Learning for Industrial Visual Inspection

本文提出FedTR框架,结合联邦学习与迁移学习解决工业视觉质检中的隐私保护与数据稀缺问题。FedTR采用三阶段流程:先在公开数据集预训练基础模型,再通过联邦微调实现多工厂协同训练,最后本地部署模型。实验表明,FedTR在数据同分布与异构场景下均能媲美集中训练效果,同时保护原始数据不出厂。该框架支持端到端视觉任务,兼顾隐私合规与检测性能,为工业规模化应用提供可行方案。

2026-07-21 12:28:27 32

原创 深度学习论文: SigLIP-HD by Fine-to-Coarse Supervision

SigLIP-HD:通过细粒度到粗粒度监督提升视觉编码器性能 本文提出SigLIP-HD方法,旨在不增加计算成本的情况下,通过精细设计的监督策略提升视觉编码器的细粒度感知能力。传统方法通过切分高分辨率图像处理细节,但面临算力激增和工程复杂度问题。SigLIP-HD采用双分支架构:冻结的预训练编码器处理多尺度输入(512+1024)生成高质量教师特征,可训练的学生分支仅使用512分辨率图像学习对齐教师特征。实验表明,该方法在细粒度任务(如OCR)上表现优异,综合得分达57.7,优于传统高分辨率方案。关键创新包

2026-07-20 16:01:34 142

原创 RAG从入门到放弃之三:多模态RAG与部署上线

本文介绍了一套工程可落地的双集合多模态RAG方案,旨在解决企业知识库中视觉信息丢失问题。方案采用CLIP/BLIP/BGE三模型联合编码,通过Chroma双向量集合实现图文联合检索。核心原理包括:1)文本分支通过BGE编码文档切片存入text集合;2)图像分支使用CLIP编码图片向量存入image集合,同时用BLIP生成图片描述作为兜底检索。查询时分别进行文本和图像检索,结果可合并用于纯文本LLM或视觉大模型生成答案。文章还提供了完整的项目代码,涵盖环境配置、离线索引建库和依赖项,支持从本地调试到生产级部署

2026-07-17 18:07:23 59

原创 深度学习论文: MambaPSA: A Mamba-based Replacement for C2PSA in YOLO26

本文提出MambaPSA方法,通过状态空间模型优化YOLO26目标检测器的计算效率。MambaPSA包含两个核心模块:1)替换骨干网络C2PSA的单向Mamba模块,降低12.1%参数量和计算量,CPU推理速度提升17.6%而mAP仅降0.1;2)用于颈部网络的BiViM双向Mamba模块,实验表明在P4层插入能最优平衡精度与体积,避免P3层对小目标检测的负面影响。该方法在保持检测精度的同时显著提升运行效率,特别适合边缘设备部署。代码已开源。

2026-07-17 13:47:14 70

原创 RAG 从入门到放弃之二:从零搭建可运行系统

本文介绍了如何基于LangChain + Chroma + BGE + DeepSeek搭建一个完整的RAG(检索增强生成)系统。主要内容包括: 环境配置与数据准备 使用BGE模型进行向量化 Chroma作为轻量级向量数据库 通过dotenv管理配置信息 离线索引构建 采用RecursiveCharacterTextSplitter进行文档分块 使用BGE模型将文本转化为向量并存入Chroma 在线检索与问答 实现三种检索模式:纯向量检索、混合检索(Hybrid)和重排序(Reranker) 混合检索结合了

2026-07-16 20:46:13 217

原创 RAG 从入门到放弃之一:基础知识与选型逻辑

RAG技术从入门到实践:核心组件与选型指南 摘要:RAG(检索增强生成)技术通过结合检索与生成能力,有效解决大模型知识陈旧和幻觉问题。本文系统介绍了RAG的两大阶段和七大核心步骤:离线索引构建(数据清洗、文本分块、向量化、存储)和在线检索生成(查询向量化、相似检索、增强生成)。重点分析了文本分块策略、向量模型选择、数据库选型等关键环节的实用建议,并推荐了中文场景下BGE-large-zh-v1.5等优质模型。文章还探讨了混合检索、重排序等优化技术,为构建高效RAG系统提供了实践指南。

2026-07-16 17:18:07 428

原创 深度学习论文: ZipDepth: Bringing Lightweight Zero-Shot Monocular Depth Anywhere, on Any Device

ZipDepth:轻量化零样本单目深度估计新方案 本文提出ZipDepth,一种兼顾跨域泛化能力与边缘实时推理的轻量化单目深度估计网络,解决了现有方法在模型大小与泛化能力之间的矛盾。ZipDepth通过以下创新实现突破: 技术架构:结合可重参数化CNN与多域知识蒸馏,在保证轻量化的同时保持零样本跨域能力 硬件适配:无自定义算子,支持主流推理引擎,覆盖服务器到移动端全平台 性能优势: 仅需2张消费级GPU训练 推理阶段参数量仅614万 提供GPU和移动端两套上采样方案 应用价值:适用于无人机、AR设备、车载系

2026-07-15 20:08:30 42

原创 深度学习论文: DictAS: A Framework for Class-Generalizable Few-Shot Anomaly Segmentation via Dictionary Loo

本文提出了DictAS框架,用于解决类通用少样本异常分割(FSAS)任务中的两大行业痛点:类依赖方案落地成本高和现有CLIP方法跨品类泛化受限问题。DictAS通过字典构建、稀疏检索和查询判别正则化三大模块,实现了仅需少量正常样本即可检测未知异常的能力。实验表明,该方法在工业和医学数据集上均达到SOTA性能,推理速度提升11倍,显存占用更低。关键创新包括稀疏概率模块(SPM)动态过滤低相似度特征,以及双重正则化约束显著提升异常区分能力。该方法无需像素级标注训练,支持跨领域泛化,为工业质检和医学病灶检测提供了

2026-07-14 17:08:54 271

原创 深度学习论文: UniGeoRS: A Unified Benchmark for Tri-view Geo-Localization

本文提出UniGeoRS,一个融合真实与虚拟图像的三视角地理定位基准数据集,包含卫星、无人机和地面视角图像,覆盖1154个建筑点位共14.3万张图像。针对跨视角特征差异问题,作者设计了CAME模型,通过排名距离模块挖掘样本邻域关系,结合交叉注意力机制实现异构视角特征对齐。实验表明,CAME在跨视角匹配任务中显著优于现有方法,为地理定位研究提供了新的数据集和有效解决方案。

2026-07-11 18:53:17 66

原创 彻底搞懂大模型参数计算:7B、13B、70B到底怎么来的

本文系统解析了大语言模型参数量的计算方法,重点针对Transformer架构进行逐层拆解。通过Llama2-7B实例演示,详细说明了参数量由嵌入层、多层Transformer Block和输出层三大部分构成,其中Block内的多头注意力和SwiGLU MLP是主要参数来源。文章澄清了常见的计算误区,指出原始Transformer的12Ld²经验公式在SwiGLU等变体架构中不再适用,强调必须根据具体架构逐层精确计算。最后解释了7B/13B等命名是精确计算后的近似取整结果(B代表十亿),并提醒参数量并非模型性

2026-07-11 16:19:37 102

原创 大语言模型对齐训练:PPO、DPO 和 GRPO

大语言模型对齐训练中的三种关键算法对比:PPO(近端策略优化)作为RLHF标准方案,通过概率比裁剪实现稳定训练但计算开销大;DPO(直接偏好优化)跳过奖励模型,直接在策略空间优化偏好数据,更轻量但依赖离线数据;GRPO(群体相对策略优化)改进PPO,通过组内奖励归一化去除价值网络,降低资源消耗,特别适合推理任务。三者各具优势,PPO通用性强,DPO高效轻量,GRPO在保持在线探索的同时优化资源效率,需根据任务需求选择。

2026-07-10 14:48:59 71

原创 大语言模型(LLM)应用开发的工程实践:从 Prompt Engineering 到 Loop Engineering

本文介绍了大语言模型(LLM)应用开发的四层工程实践演进路径: Prompt Engineering - 通过指令设计直接控制模型输出,适合简单任务如客服问答,但易产生幻觉。 Context Engineering - 引入外部数据扩展模型知识边界,面临上下文窗口限制导致的信息丢失问题。 Harness Engineering - 通过外部系统拆解复杂任务为可管理子任务序列,实现流程控制。 Loop Engineering - 构建自驱动闭环系统,实现智能体的持续优化和"无人值守"运行。 文章通过NASA新

2026-07-10 08:25:06 236

原创 手把手带你搭建一个多模态语言模型(附代码详解)

本文展示了一个极简的多模态大模型训练框架,核心思路是冻结预训练的视觉编码器(CLIPVisionModel)和语言模型(Qwen2ForCausalLM),仅训练轻量投影层(32→64维MLP)实现视觉-语言模态对齐。通过不足200行代码,完整实现了以下功能: 视觉特征处理:将32×32图像编码为17个视觉token(16个patch+1个CLS token) 跨模态投影:提供线性和MLP两种投影方案 输入拼接:正确处理多模态输入的嵌入、位置编码和注意力掩码 训练优化:屏蔽非文本token的损失计算 推理生

2026-07-09 15:01:20 543

原创 CLIP ViT 视觉编码器在序列开头额外添加可学习的 CLS token的原因

图像 → 切 Patch → Patch Embedding;拼接 1 个可学习 CLS Token,叠加位置编码;多层 Transformer 自注意力:CLS 和所有 Patch 互相交换信息;取最后一层 CLS 向量 = 图像全局表征;和文本编码器输出的文本 CLS 计算相似度,完成对比学习。

2026-07-09 08:53:25 150

原创 MCP(Model Context Protocol):AI连接外部世界的标准化通用接口

摘要: MCP(Model Context Protocol)是一种标准化通信协议,旨在解决大模型对接外部资源时的碎片化问题。它通过统一接口(类似USB-C)连接数据、工具和提示模板,消除传统方案中重复开发、权限分散、接口不兼容等痛点。MCP采用Client-Server架构,支持资源(只读数据)、工具(可执行操作)和提示模板三类核心能力,并内置权限管控与审计功能。其优势包括一次接入全模型通用、安全可控、灵活扩展,适用于企业知识库、数据分析、自动化办公等场景。作为AI Agent的底层基建,MCP通过标准化

2026-07-08 08:30:40 479

原创 Memory记忆系统:让AI拥有长期经验,实现类人连续交互

AI记忆系统是解决大模型"失忆"问题的核心技术,通过分层存储(瞬时/短期/工作/长期记忆)和分类管理(会话/语义/情景/程序/偏好记忆)实现类人交互体验。记忆系统支撑对话连贯性、个性化服务和复杂任务执行,采用向量库+数据库混合存储,配合语义检索和遗忘机制。当前面临记忆噪声、隐私安全等挑战,但仍是AI进化为自主Agent的关键,典型应用包括智能客服、个人助手等场景。最佳实践需结合短期上下文与长期知识库,平衡效果与成本。

2026-07-07 17:52:42 425

CUDA并行程序设计 GPU编程指南

CUDA并行程序设计:GPU编程指南共分为12章。 第1章 超级计算简史 第2章 使用GPU理解并行计算 第3章 CUDA硬件概述 第4章 CUDA环境搭建 第5章 线程网格、线程块以及线程 第6章 CUDA内存处理 第7章 CUDA实践之道 第8章 多CPU和多GPU解决方案 第9章 应用程序性能优化 第10章 函数库和SDK 第11章 规划GPU硬件系统 第12章 常见问题、原因及解决方案

2019-05-02

爬虫爬取网易汽车车型库【Java代码】

爬虫爬取网易汽车车型库【Java代码】不同品牌/车标(共175个车标)下不同车系(共1650个系列)的的图片(各八张)

2017-04-16

OpenCV3_CVPR_2015.pptx

opencv3新增加的功能,CVPR2015年会议上的PPT,共三个文件

2015-06-17

linux下安装Anaconda3+pytorch+tensorboardX依赖包

linux下安装Anaconda3+pytorch+tensorboardX依赖包, 安装见 https://blog.csdn.net/shanglianlm/article/details/88749803

2019-03-23

Quartz 示例代码

Quartz 是一个完全由 Java 编写的开源企业级作业调度框架。Quartz允许开发人员根据时间间隔来调度作业。它实现了作业和触发器的多对多的关系,还能把多个作业与不同的触发器关联。

2017-05-02

训练好用于车牌分割的神经网络

训练好用于车牌识别的神经网络,0-9,A-Z(不含I和O),每个字符使用50张图片,训练好用于车牌识别的神经网络。

2017-09-22

OpenVINO视觉加速库依赖包

OpenVINO视觉加速库相关的依赖库,不能在线安装时,可以手动下载安装

2019-04-14

java反射示例代码

Java反射机制:反射机制是在运行状态中,对于任意一个类,都能够知道这个类的所有属性和方法;对于任意一个对象,都能够调用它的任意一个方法和属性;这种动态获取的信息以及动态调用对象的方法的功能。

2017-05-01

CUDA C编程权威指南

CUDA C编程权威指南 第1章 基于CUDA的异构并行计算1 第2章 CUDA编程模型18 第3章 CUDA执行模型56 第4章 全局内存115 第5章 共享内存和常量内存174 第6章 流和并发230 第7章 调整指令级原语258 第8章 GPU加速库和OpenACC281

2019-05-02

Java 核心技术(第八版)高清电子书PDF和代码

Java 核心技术(第八版)高清电子书PDF和代码

2015-07-27

Java反射机制代码

Java反射机制:反射机制是在运行状态中,对于任意一个类,都能够知道这个类的所有属性和方法;对于任意一个对象,都能够调用它的任意一个方法和属性;这种动态获取的信息以及动态调用对象的方法的功能。

2017-05-01

Java爬虫爬取网易汽车车型库

Java爬虫爬取网易汽车车型库

2017-04-15

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除