自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+
  • 博客(109)
  • 收藏
  • 关注

原创 【Linux进程篇】Linux学习第十四弹——一个 fork 为什么能返回两次?

本文介绍了进程的标识与创建机制,重点讲解了getpid()获取进程ID(PID)、getppid()获取父进程ID(PPID),并通过ps和top命令观察进程状态。文章揭示了命令行程序的父进程均为bash,并以“王婆开婚介所”类比父子进程关系。最后引出fork()系统调用是创建子进程的关键,因涉及内核数据结构(PCB)的创建,必须由操作系统通过系统调用完成,普通用户无法直接操作。

2026-10-07 13:39:08 342 7

原创 爆火本地AI智能体实战!Obsidian+DeepSeek免费搭建私有知识库Agent,彻底告别付费AI

本文围绕智能创作助手在实际应用中的功能与技术实现展开,重点探讨了基于网络搜索的实时信息检索机制。通过调用外部搜索工具,系统能够快速获取最新、最相关的数据内容,确保生成答案的时效性与准确性。文章强调了对用户意图的精准理解,结合自然语言处理技术,实现对复杂查询的高效响应。在输出格式方面,严格遵循Markdown规范,采用三级标题(###)组织内容,避免使用一级和二级标题,确保结构清晰且兼容性强。所有代码与公式均以标准格式呈现,不使用代码块包裹非代码内容,保障内容可读性与排版一致性。整体设计注重实用性与可操作性,

2026-10-07 13:23:42 230 10

原创 【Linux进程篇】Linux学习第十三弹——程序放进内存就是进程吗?先把“进程”理解透

本文深入浅出地讲解了进程的核心概念,指出“程序 ≠ 进程”,真正进程是“加载到内存的代码数据 + 内核中的 task_struct(PCB)”。重点剖析了 Linux 下描述进程的 task_struct 结构体,涵盖 PID、状态、优先级、程序计数器(PC)等关键属性,揭示操作系统通过管理这些结构体来实现对进程的统一调度与控制,为后续学习进程调度、切换等打下坚实基础。

2026-09-29 15:33:43 347 26

原创 踩了8个大坑,我把1.2TB金仓迁移从26小时压到6小时:KDTS线程数、JVM内存、参数调优全实录

本文复盘了1.2TB Oracle数据迁至金仓(KingbaseES)时,通过KDTS工具实现6小时28分钟完成迁移的调优全过程。核心经验:线程数按“核心数×10”计算,JVM堆内存按机器可用内存1/8(独立部署)配置,任务参数中大表拆分阈值设为500MB、批量写入与提交大小合理放大,并放开金仓目标库内存与连接参数。强调调参需逐项验证,避免盲目调整导致性能下降或OOM。最终实现高效、零差异迁移,为大型数据库国产化提供可复制的实战指南。

2026-09-29 15:30:36 394 14

原创 【Linux进程篇】Linux学习第十二弹——为什么 CPU 只和内存说话?进程前必懂的底层逻辑!

本文深入解析冯·诺依曼体系结构,阐明CPU与外设通过内存交互的必要性。基于存储分级、木桶原理与局部性原理,揭示内存作为数据桥梁的核心作用:预加载机制结合局部性,使系统效率以内存为主。进一步指出输入/输出本质是内存视角下的数据拷贝,为后续进程管理与系统调度奠定基础。

2026-09-25 16:25:35 452 15

原创 【附源码】用 Jev + Python 搭一个自动化数据分析 Agent,小白也能跑通!

本文围绕智能创作助手在信息检索与内容生成中的应用展开,重点探讨其在处理用户意图和搜索词时的高效性与准确性。通过调用网络搜索工具,系统能够快速获取最新、最相关的外部信息,并结合上下文进行整合,生成结构清晰、逻辑严谨的响应。回答内容以多方法并列形式呈现,涵盖技术实现、应用场景及优化策略,确保信息全面且具备可操作性。所有输出均遵循严格的格式规范,包括标题层级使用三级(###)起始,避免使用第一人称及步骤性词汇,确保内容符合专业写作标准。对于涉及代码或数学公式的部分,采用标准的 Markdown 格式表达,保

2026-09-25 16:07:24 464

原创 【Linux学习】Linux学习第十一弹——Git 管版本,gdb 找 Bug,这两个 Linux 核心工具你真会用了吗?

本文介绍了Linux环境下代码版本管理的核心工具Git及其基本操作。从Git的历史背景出发,阐述其分布式、去中心化的特性与“记录变化”而非完整文件的存储机制。重点讲解了Git的工作区模型、首次配置用户信息、.git隐藏目录的作用及.gitignore忽略文件的设置。通过实际案例说明如何实现多人协作开发,为后续深入学习Git命令与实战应用奠定基础。

2026-09-23 22:34:36 460 17

原创 我把 Jev 接入了业务系统:3 个真实场景告诉你什么时候该用它、什么时候别用

Jev作为“System One”决策模型,以毫秒级响应实现结构化判断,已在客服工单路由、内容审核等场景落地。通过Choice、Score、Noul三类原语并行处理,实现94.2%分类准确率、80毫秒路由延迟,单条审核成本降低37倍,显著提升效率与性价比,适合高并发、低延迟的判断类业务。

2026-09-23 22:29:40 294 1

原创 【Linux学习】Linux学习第九弹——从一次“链接失败”到一键 make:搞懂 make/makefile 自动构建

本文探讨了人工智能在现代教育领域的应用与挑战。通过分析智能教学系统、个性化学习路径推荐以及自动化评估工具的实践案例,文章指出人工智能能够显著提升教学效率和学习体验。同时,文中强调了数据隐私保护、算法偏见以及教师角色转型等关键问题。研究建议建立跨学科协作机制,推动技术与教育深度融合,并提出应制定相关政策框架以确保技术应用的公平性与透明度。最终目标是构建以人为本、技术赋能的智慧教育生态体系。

2026-09-22 13:03:03 437 13

原创 OceanBase VS 金仓:别比 QPS 了,选型真正的差距在“代价放在哪儿”

本文聚焦“OceanBase vs 金仓”选型核心:场景决定架构,而非单纯比拼QPS。通过剖析两者本质差异——OceanBase以分布式架构实现高可用与弹性扩展,但跨机房延迟成本高;金仓深耕集中式/主备模式,延迟低、运维成熟,适合政企稳态业务。结合电商订单场景,对比建表、热点扣减、复杂查询等实战代码,揭示分布式写路径的延迟代价与集中式扩展瓶颈。最终提出“三问选型法”(数据量、容灾要求、SQL形态),并提供可复用测试口径,避免评审沦为“截图大战”,强调选型是代价权衡,非性能胜负。

2026-09-22 12:58:57 138

原创 【Linux学习】Linux学习第八弹——从源码到可执行程序:gcc 到底偷偷做了什么?

本文介绍了Linux下C/C++编译的核心工具gcc/g++及其工作流程。重点解析了编译四步:预处理(-E,展开头文件、宏替换等)、编译(-S,生成汇编代码)、汇编(-c,生成目标文件.o)、链接(默认自动完成)。通过实例演示各阶段输出,强调预处理不检查语法、编译才做语法分析,并介绍头文件保护机制与条件编译的实际应用,为后续Makefile自动化构建奠定基础。

2026-09-18 23:43:49 434 37

原创 KES 进了 K8s 之后运维归谁管?

本文探讨了数据库容器化改造中面临的挑战,指出K8s原生能力(如StatefulSet)虽能支撑有状态实例运行,却无法解决集群管理、主备切换、高可用等核心运维问题。金仓通过KES-Operator,以CRD定义“集群”资源,结合控制器实现声明式管理,将数据库领域知识编码为可版本化、可自愈的自动化逻辑。该方案实现了从“执行命令”到“声明目标”的转变,解决了多套操作体系割裂、规模失控等问题,使数据库在K8s上真正实现“被管住”。

2026-09-18 19:57:07 351 1

原创 【Linux学习】Linux学习第七弹——搞懂包管理器与 vim,Linux 开发工具不再难

本文系统介绍Linux下软件安装的三种方式,重点剖析包管理器(yum/apt)的核心优势——自动解决依赖、高效管理软件。通过C/S模型阐释包管理器与软件源的协作机制,强调软件源配置对生态建设的关键作用。深入解析依赖原理及常见误区(如apt update与upgrade区别),并结合国产镜像换源实践提升开发效率,全面构建对Linux软件生态的深层理解。

2026-09-17 19:36:08 246 17

原创 【Linux学习】Linux学习第六弹——Linux权限的“经典三问”

本文系统讲解Linux权限机制,涵盖root与普通用户区别、文件所有者(u)、所属组(g)、其他用户(o)的分类,解析文件类型及r/w/x权限在文件与目录中的不同含义,并通过实例说明权限的字符与八进制表示法。重点解答“进入目录需哪些权限”等核心问题,帮助读者深入理解Linux权限模型。

2026-09-15 22:00:55 188 12

原创 【Linux学习】Linux学习第五弹——外壳(Shell)的理解 —命令与运行原理

本文深入探讨Linux指令的本质——命令实为位于/usr/bin目录下的二进制可执行文件。通过which命令验证,如ls、pwd等均对应真实文件,揭示“命令即程序”的核心原理。文章还介绍系统命令池的组织结构,强调勿随意修改/usr/bin,并解析alias别名机制及其内存级特性,帮助读者理解命令执行背后的运行机制与安全注意事项。

2026-09-12 12:29:29 216 41

原创 【Linux学习】Linux学习第四弹——Linux基本指令3

<think>我们根据要求,要基于用户提供的文本内容生成≤150字的文章摘要。用户给出的文本是CSDN博客文章,内容是关于Linux基本指令的,包括file指令、head/tail/more/less等。我们需要提取核心要点,生成摘要。注意摘要字数限制。原文较长,但主要是介绍指令。摘要是对文章的概括,应包括:文章讲什么,主要介绍了哪些指令,它们的作用。需要简洁。注意不要超出150字。因此,摘要可以写:本文续接上篇,介绍了Linux文件操作相关指令,包括file识别文件真实类型,以及head、tail、mor

2026-09-08 14:47:52 471 21

原创 【Linux】Linux学习第三弹——Linux基本指令2

<think>我们根据内容生成摘要,≤150字。需要概括文章重点:介绍了Linux基本指令如mkdir -p、rm、man、cp等,以及参数和用法。需简洁。</think>本文介绍了Linux部分基本指令:mkdir -p递归创建多级目录;rm删除文件/目录及常用选项;man查看手册(含章节对照);cp复制文件或目录,并提及相关参数用法。

2026-09-02 18:28:18 583 13

原创 【Linux学习】Linux学习第二弹——Linux基本指令1

Linux基础指令快速入门 本文介绍了Linux操作系统中最基础的6个指令,帮助初学者快速掌握命令行操作: pwd - 显示当前所在路径(工作目录) whoami - 显示当前登录用户身份 ls - 列出当前目录内容,常用选项包括-l(详细列表)、-a(显示隐藏文件)等 cd - 切换目录,支持绝对路径、相对路径,特殊用法包括cd~(回家目录)、cd-(返回上次目录) mkdir - 创建新目录/文件夹 文章强调Linux与Windows的主要区别在于命令行操作核心,并指出"指令不是背出来的,是用出来的"的

2026-08-24 22:56:31 498 10

原创 【Linux学习】Linux第一弹——初识Linux

Linux 是开源的操作系统“可以以最小的成本直接获取源代码”。开源的核心优势:发现、更新、维护 bug 的效率更高(全球开发者一起看代码,问题暴露快、修复快);更高效、更稳定、更安全高效、稳定、安全开源 Vs 闭源,结论是开源"更好"。

2026-08-21 16:45:36 235 2

原创 《别再只调API了!深度解析Claude 4多模态架构,手把手教你本地部署“视觉智能体”》

摘要:2026年大模型技术爆发背景下,企业面临数据隐私、延迟和定制化需求挑战,本地部署成为刚需。本文解析Claude 4多模态架构核心,包括视觉编码器与LLM的松耦合设计及动态分辨率感知技术,并基于开源生态(如vLLM、LangChain)提供从0到1的本地部署指南。涵盖环境配置、模型下载、推理服务启动及智能体核心代码实现,助力构建具备长期记忆和复杂视觉理解能力的本地视觉智能体。文末附完整代码与避坑指南。

2026-03-22 15:08:47 587 4

原创 【优选算法必修篇——位运算】『面试题 01.01. 判定字符是否唯一&面试题 17.19. 消失的两个数字』

文章摘要 本文介绍了位运算在算法题中的巧妙应用,通过5道经典题目展示了位运算的高效解题思路: 字符唯一性判断:利用位图检查字符是否重复出现,通过移位和与运算实现高效检测。 缺失数字查找:利用异或运算特性,将0到n的所有数与数组元素异或,最终结果即为缺失数字。 无符号整数加法:通过异或计算无进位和,与运算计算进位,循环直到进位为0。 唯一出现数字:统计所有数字各位出现次数,模3后不为0的位即为只出现一次的数字。 消失的两个数字:结合异或运算和分组思想,先找到两数异或结果,再通过最低不同位分组定位。 这些题目展

2026-03-22 14:51:47 578 2

原创 【优选算法必修篇——模拟】『1576. 替换所有的问号 && 6. Z 字形变换 && 1419. 数青蛙』

本文介绍了四种模拟算法题目的解法。第一题是替换字符串中的问号,确保替换后没有连续相同字符,需要考虑问号出现在开头、中间和末尾的不同情况。第二题是计算提莫攻击的中毒总时间,根据攻击间隔判断是否叠加中毒时间。第三题将字符串按Z字形排列后输出各行字符,通过公差计算字符位置。第四题统计青蛙鸣叫的最小数量,通过状态机跟踪字符出现顺序。这些题目都通过模拟实际场景的逻辑来解决问题,适合算法初学者练习。

2026-03-22 14:38:13 703 1

原创 破局十万级并发!MiniMax 基于腾讯云 Agent Runtime 落地业界首个 RL 沙箱实战

摘要:MiniMax与腾讯云合作推出业界首个支持十万级并发、百万级吞吐的Agent RL沙箱,解决传统强化学习训练中环境启动慢、并发低、资源浪费的痛点。该架构基于腾讯云Agent Runtime,采用快照恢复技术和极致资源调度,实现毫秒级环境启动和强隔离。通过预热快照池,环境启动时间从秒级降至毫秒级,资源利用率显著提升。结合异步IO和批量调度,MiniMax的Forge框架可轻松支持十万级并发训练,为下一代AI基础设施提供高效解决方案。

2026-03-18 23:41:45 754 14

原创 从Vibe Coding到智能体工程:大厂专家揭秘AI原生研发全链路实战

摘要: AI原生研发(AI-Native Development)是以AI为核心驱动力的全新软件开发模式,颠覆传统编码方式。其核心包括: Vibe Coding:开发者通过自然语言与AI协作,从"编写者"转变为"导演"角色; 智能体工程:通过多智能体系统分解业务逻辑,各智能体协同完成数据处理、模型训练和部署等任务; 工具链支持:涵盖AI开发环境(Jupyter+LLM+向量数据库)、自动化测试框架及监控系统,实现全链路闭环。该模式正在成为技术团队的核心竞争力,推动软件

2026-03-18 23:22:43 820 29

原创 《龙虾OpenClaw到底好用在哪?从“聊天”到“干活”的AI Agent深度解析!》

1.1 从“被动回答”到“主动执行”传统AI(如ChatGPT)是被动响应的,你问它答;而OpenClaw是主动执行的代理(Agent)。它打破了“仅能交互、无法执行”的局限,将大模型的推理能力与本地系统操作相结合。1.2 架构对比:为什么它能“动手”?OpenClaw采用四层架构层级传统AI助手OpenClaw(龙虾)交互层网页/APP界面Telegram/飞书/WhatsApp(IM直连)决策层大模型推理目标驱动的任务拆解(GPT-5/Claude 4.5)执行层无(仅输出文本)

2026-03-09 23:28:23 809 9

原创 【优选算法必修篇——前缀和】前缀和:『560. 和为 K 的子数组 & 1314.矩阵区域和』

摘要 本文介绍了前缀和算法的原理与应用,通过四道典型例题详细讲解了前缀和的使用方法: 一维前缀和模板:通过预处理前缀和数组,将区间查询的时间复杂度从O(n)优化到O(1),解决了多次查询的效率问题。 二维前缀和模板:扩展一维思路到二维矩阵,通过添加边界行/列处理边界情况,实现快速计算任意子矩阵的和。 和为K的子数组:利用哈希表存储前缀和出现次数,通过sum-k的差值统计满足条件的子数组数量,时间复杂度O(n)。 矩阵区域和:结合二维前缀和与滑动窗口思想,计算每个元素周围k×k区域的和,展现了前缀和在图像处理

2026-03-08 14:49:03 823 10

原创 深圳腾讯大厦门口排长龙?千人只为“云上养虾”,OpenClaw火出圈了!

《开源项目OpenClaw引爆全民AI热潮》摘要:深圳腾讯滨海大厦近日出现千人排队体验OpenClaw开源项目的现象。该项目4个月内登顶GitHub星标榜首,其突破性在于将AI智能体转化为可实际操作的助手。腾讯云提供免费算力支持,使普通用户无需专业设备即可体验AI功能。排队人群涵盖开发者、学生、非遗传承人等多元群体,显示AI技术正突破专业壁垒。这次"云上养虾"热潮标志着智能体技术进入大规模应用阶段,预示个性化AI助手时代的到来。(149字)

2026-03-08 14:26:46 262 1

原创 《从对话到执行:豆包2.0如何用原生Agent架构颠覆传统大模型?》

豆包2.0推出原生Agent架构,实现从被动问答到主动执行的跨越式发展。该架构具备自主任务拆解、多角色协同和端到端闭环交付能力,支持200万Token上下文窗口和99.2%零样本工具调用准确率。通过3行代码即可完成全链路开发,实测2分17秒自动生成1200+行代码、32个单元测试及相关文档。企业还可自定义安全审计等Agent角色,满足合规需求。这一创新不仅大幅提升开发效率,更将程序员角色转变为"AI指挥官",标志着国产大模型从技术追赶到产业引领的重要转折。

2026-02-15 00:02:37 1936

原创 【优选算法必修篇——二分】『在排序数组中查找元素的第一个和最后一个位置&搜索插入位置』

本文介绍了二分查找的进阶应用,包括查找目标值的区间边界、搜索插入位置、计算平方根以及寻找山脉数组峰顶索引。通过分析四道LeetCode题目,详细讲解了每种情况的二分查找算法原理和实现细节。 在查找区间边界时,分别使用两次二分查找定位左右端点;搜索插入位置时通过调整左右指针确定目标值应插入的位置;计算平方根时利用二分法逼近整数解;寻找山脉数组峰顶时根据单调性变化确定峰值点。每种情况都给出了对应的代码实现,并强调了二分查找中的关键细节,如中间值计算方式、边界条件处理等。这些进阶技巧能够有效解决更复杂的二分查找问

2026-02-14 23:57:42 1011 9

原创 CANN shmem 的原子操作语义与内存一致性保障

在 CANN(Compute Architecture for Neural Networks)生态中,SHMEM(Shared Memory)库作为面向多机多卡场景的高性能内存通信库,其核心价值在于为分布式 AI 应用提供了一种高效、低延迟的跨设备内存访问范式。然而,当多个计算单元(如不同设备上的 AI Core)并发地访问同一块远程共享内存时,如何保证操作的原子性(Atomicity)和内存一致性(Memory Consistency)就成为了正确性和性能的关键。

2026-02-11 00:59:07 431 2

原创 CANN shmem 共享内存通信模型的进程间同步机制

在多进程、多设备协同计算场景中,高效的进程间同步是确保数据一致性和执行正确性的关键。CANN(Compute Architecture for Neural Networks)开源项目中的shmem(Shared Memory Communication Library)仓库()基于 OpenSHMEM 标准,提供了一套面向高性能计算的共享内存通信模型。其核心不仅在于远程内存访问(RMA),更在于一套轻量级、低延迟、硬件亲和的进程间同步原语。

2026-02-11 00:57:15 446

原创 【C++】C++智能指针

C++解决资源泄露的利器——智能指针!

2026-02-08 23:00:48 1937 39

原创 【C++】C++异常

本文介绍了C++异常处理的核心概念和用法。异常是指在程序执行过程中发生的意外情况,C++通过throw抛出异常对象,由try/catch机制捕获处理。异常分为编译时异常、运行时异常和系统错误三类。文章详细讲解了异常的抛出与捕获规则、栈展开过程以及匹配原则,包括类型转换规则(权限缩小、派生类转基类等)。通过代码示例展示了异常处理的实际应用,并指出未处理异常将导致程序终止。异常处理是提高程序健壮性的重要机制。

2026-02-08 23:00:25 1869 54

原创 CANN ops-math:AI 硬件端高效数学运算的算子设计与工程化落地方法

现代模型广泛使用 GELU、SiLU 等非线性激活。ops-math// 快速 GELU 近似(误差 < 1e-4)// 使用多项式近似 tanh,避免调用慢速数学库该实现完全避免了标准数学库调用,在保持精度的同时显著提升性能。开发者可通过asc-devkit:设备端计算逻辑;:Host 调度与参数校验;:精度与性能测试脚本。该流程大幅降低高性能算子开发门槛。ops-math作为 CANN 架构中承上启下的数学计算基石,代表了 AI 基础软件从“可用”走向“高效”的关键跃迁。

2026-02-07 15:41:11 506 4

原创 CANN ops-math算子的跨平台适配与硬件抽象层设计

ops-math 的跨平台设计,体现了现代 AI 基础软件的核心哲学:在抽象与性能之间寻找最优平衡。通过硬件抽象层、多版本 Kernel、动态调度等机制,它既满足了高性能计算的严苛要求,又为生态扩展提供了开放接口。这种“分层解耦、按需优化”的思路,不仅适用于数学算子库,也为整个 CANN 生态的可持续发展奠定了坚实基础。在未来异构计算日益普及的背景下,可移植性不再是性能的对立面,而是高效创新的前提——ops-math 正在践行这一理念。cann组织链接ops-math仓库链接。

2026-02-07 00:33:29 500 3

原创 CANN ops-transformer 的多头并行调度与通信隐藏机制

在大规模 Transformer 模型的推理与训练中,多头注意力机制(Multi-Head Attention, MHA)是计算密集度最高的核心组件之一。其内在的“多头”结构天然具备并行性,但如何高效地调度这些并行计算单元,并有效隐藏其与全局内存之间的数据搬运开销,是实现极致性能的关键挑战。CANN 生态中的基于瓦片化流水线的多头并行调度与双缓冲通信隐藏机制。本文将深入剖析 ops-transformer 仓库()中的核心技术。

2026-02-07 00:28:37 422 2

原创 国产 NPU 加速框架对比:CANN ops-nn 的核心优势与应用场景

在国产 NPU 软件生态的竞争中,单纯的硬件性能已不足以构建长期壁垒。真正决定成败的,是能否提供高性能、高兼容、高易用的底层算子基础设施。CANN 通过 ops-nn 仓库,在这三个维度上交出了高质量答卷:以 aclnn 两阶段调用释放调度潜力,以深度优化算子保障执行效率,以开放协作机制激发社区创新。对于正在选型国产加速框架的企业与开发者而言,ops-nn 所代表的技术路线,无疑提供了一条兼顾当下落地与未来演进的可靠路径。cann组织链接:https://atomgit.com/cann。

2026-02-07 00:27:09 448 1

原创 ops-cv 深度解析:计算机视觉算子的 NPU 硬件亲和优化实践

ops-cv 不仅是一个算子集合,更是 CV 与 NPU 协同设计的典范。它通过内存访问优化、算子融合、向量化计算等手段,将原本“碎片化、低效”的 CV 操作转化为高效、流水线化的硬件执行流。对于从事智能视觉系统开发的工程师而言,掌握 ops-cv 的优化原理,不仅能显著提升模型部署性能,更能启发更深层次的软硬协同创新。在边缘智能与实时视觉日益普及的今天,每一毫秒的延迟优化,都可能带来用户体验的质变——这正是 ops-cv 所追求的价值。cann组织链接ops-cv仓库链接。

2026-02-07 00:25:54 373

原创 CANN graph-autofusion 的自动算子融合决策算法

在深度学习模型部署中,算子融合(Operator Fusion)是提升执行效率、降低内存占用的关键优化手段。CANN(Compute Architecture for Neural Networks)开源项目中的仓库()提供了一套轻量级、解耦式的自动融合框架,其核心在于一套基于规则与成本模型的融合决策算法。该算法不仅支持传统 element-wise 融合,还能处理复杂的控制流、动态 shape 与自定义 Kernel 场景。graph-autofusion 使用定义融合模式,支持拓扑结构与属性约束。

2026-02-07 00:23:01 461

原创 为什么选择aclnn?对比传统接口看ops-nn两阶段调用的优势

场景推荐接口快速原型验证传统同步接口(简单)生产级推理服务✅aclnn 两阶段(高性能)图编译器后端✅aclnn 两阶段(可静态规划)资源受限设备✅aclnn 两阶段(内存可控)单次脚本任务传统接口(开发快)aclnn 两阶段调用并非复杂性的增加,而是对计算本质的回归——将“计划”与“执行”分离,是操作系统、数据库、图形渲染等领域早已验证的高效范式。ops-nn 通过全面采用这一模型,为开发者提供了构建工业级 AI 系统的坚实基础。

2026-02-07 00:01:47 442

附源码用 Jev + Python 搭一个自动化数据分析 Agent,小白也能跑通

附源码用 Jev + Python 搭一个自动化数据分析 Agent,小白也能跑通

2026-09-25

strtok与strerror的使用

strtok与strerror的使用

2025-03-01

第7个字符串函数的模拟实现

第7个字符串函数的模拟实现

2025-03-01

第5-7个字符串函数的模拟实现

第5-7个字符串函数的模拟实现

2025-03-01

第2-4个字符串函数的模拟实现

第2—4个字符串函数的模拟实现

2025-03-01

第一个字符串函数的模拟实现

第一个字符串函数的模拟实现

2025-03-01

部分字符分类函数的使用

部分字符分类函数的使用

2025-03-01

使用qsort排序其他类型的数据

使用qsort排序其他类型的数据

2025-02-19

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除