摩尔线程blog中心

摩尔线程成立于 2020 年 10 月,以全功能 GPU 为核心,致力于向全球提供加速计算的基础设施和一站式解决方案,为各行各业的数智化转型提供强大的 AI 计算支持。 我们的目标是成为具备国际竞争力的 GPU 领军企业,为融合人工智能和数字孪生的数智世

  • 博客(76)
  • 收藏
  • 关注

原创 摩尔线程与xLLM推理引擎深度协同 国产AI算力生态再添里程碑

xLLM是一款开源的大模型推理引擎,专为国产AI加速芯片深度优化,已在某电商零售核心业务中完成大规模生产环境验证。不同于vLLM、SGLang等基于Python生态的主流框架,xLLM选择了一条从零构建的技术路线——以C++重构推理引擎核心,从系统层面突破性能瓶颈,而非在现有Python框架上做增量优化。本次性能测试基于MTT S5000单卡环境,在三种典型输入/输出长度配置(2.5k-1k、3.5k-1.5k、9k-1k)下,分别测试Batch Size为1、2、4、8、16、32时的推理性能。

2026-07-28 15:45:59 288

原创 学员招募|摩尔学院AI计算工程共创营

2026-07-27 15:42:52 16

原创 首本MUSA技术专著《摩尔线程GPU架构与编程实践》正式出版

随着人工智能、图形渲染、科学计算与高性能计算等领域对算力需求的持续攀升,GPU已从单一的硬件器件演进为覆盖芯片架构、系统软件、开发工具、性能优化及应用生态的完整技术体系。在这一背景下,开发者亟需一套从原理到实践的系统化学习路径,《摩尔线程GPU架构与编程实践》应运而生。在编程实践方面,本书系统覆盖MUSA内核函数、设备与上下文管理、任务流、内存管理、异步执行、同步机制、MUSA Graph等核心编程要素,并结合矩阵乘法、图像分类、大模型训练等典型场景,展示MUSA在真实开发环境中的使用方法。

2026-07-24 16:35:21 191

原创 师资培训丨MUSA全栈开发实战 -上海交大专场

本次培训采用三天沉浸式线下实战教学,赋能高校教师把 MUSA 与 AI 实操内容融入课程,打造国产算力特色教学模块。通过本次师资培训,教师可以了解通用并行计算底层思维,平滑复用既有CUDA教学积淀与实操经验,快速开启国产GPU课程。参训教师将获得全套课程资源包(教材、讲义PPT、实训手册、实训代码),以及摩尔线程行知实训平台账号与算力资源,培训结束后仍可持续实践与教学应用。摩尔线程技术专家授课分享,将产业前沿技术融入教学场景,与上海交通大学教师现场交流课程建设经验与教学方案。邀请码:xNQinDo5。

2026-07-08 15:39:07 255

原创 摩尔线程MUSACODE:重塑国产GPU开发工作流的AI编程智能体

与通用AI编程工具不同,MUSACODE的定位是工程交付Agent——它不只补全代码片段,更能完整驱动从项目分析、代码生成到调试重构、算子优化与交付的全链路开发流程。在开发体验上,MUSACODE坚持“高效与可控并重”:需要修改文件或执行命令的操作会先请求确认,关键修改可审阅(Diff)、可回退,让AI既能放手干活,又始终处于可控范围内。,它以自然语言为入口,由AI Agent驱动整个开发流程——从项目分析、代码生成,到调试重构、算子优化,直至最终交付。评判能力的核心标准,是最终交付的工程成果。

2026-07-07 15:45:28 406

原创 Day-0支持|摩尔线程率先完成腾讯Hy3大模型适配

依靠WorkBuddy、元宝、微信、AI游戏助手等真实业务场景的历练,产品稳定性与用户体验显著提升,腾讯丰富的真实业务场景与混元模型能力迭代形成了相互赋能的良性循环。摩尔线程基于此前对DeepSeek-V4、MiniMax M3.0、Kimi2.6、GLM-5.2等多款国产旗舰模型的Day-0适配经验,已形成一套高效、系统化的复杂推理任务优化方法论。摩尔线程将继续依托MUSA软件栈的生态兼容性,保持对前沿大模型的快速适配能力,以高性能国产算力基础设施,为开发者提供稳定可靠的AI算力支撑。

2026-07-06 20:31:24 249

原创 国产深度握手:摩尔线程全功能GPU获百度飞桨III级兼容性认证

百度飞桨(PaddlePaddle)是百度研发的产业级开源深度学习平台,也是中国首个自主研发的深度学习框架,致力于降低深度学习技术的创新与应用门槛,产品支持从模型训练到多端部署的全流程开发,截至 2025 年底已凝聚超 2300万开发者,服务 76 万家企业。本次适配工作全面覆盖PaddlePaddle主框架最新接口及算子注册体系,进一步增强了Paddle-Paddle-MUSAMUSA与飞桨主线开发版本的协同能力。• 大语言模型与多模态模型:ERNIE-4.5、LLaMA、PaddleOCR-VL 等;

2026-07-02 15:44:22 442

原创 课程推介丨MUSA入门到精通:摩尔线程全功能GPU实战

随着国产GPU算力生态的快速发展,摩尔线程MUSA统一系统架构凭借易用的异构编程模型和完整的软件栈,已在高性能计算、AI训练推理、科学计算、物理仿真、图形渲染等多类场景中实现广泛落地。无论是初次接触GPU开发的新手,还是希望深入调优的资深工程师,均可按需学习,快速获得国产全功能GPU的实战开发能力。课程兼顾高性能并行计算与深度学习两大方向,涵盖底层内核编写、内存优化、官方加速库调用、多卡通信、AI框架迁移等完整开发场景,广泛适配各类国产化项目需求。自主完成访存优化,有效规避Warp分化与共享内存冲突。

2026-07-01 15:54:34 260

原创 摩尔学院 × 启悟学习社区|开放MUSA实战资源 夯实国产AI人才底座

摩尔学院 × 启悟学习社区|开放MUSA实战资源 夯实国产AI人才底座

2026-06-30 15:52:31 392

原创 摩尔线程 × 北京量子院丨“Quafu杯”量子计算真机挑战赛火热进行中

我国在超导、光量子等多条技术路线上取得突破,然而,“硬件迭代快、应用落地慢”仍是行业面临的共性瓶颈——缺乏丰富的算法验证场景、成熟的开发工具链以及可规模化的应用需求,真实量子硬件资源与开发者实际需求之间存在明显断层。摩尔线程将持续依托全功能GPU与夸娥(KUAE)智算集群的强劲算力,携手北京量子信息科学研究院等核心伙伴,持续推动量子计算从实验室走向应用场景——让硬件被用起来,让算法有处可跑,让开发者有真机可练。——让量子算法验证获得充沛的经典计算加速,共同推动量子计算从实验室走向更广阔的应用场景。

2026-06-29 18:03:54 317

原创 摩尔线程 × 北京大学|共建智能图形与仿真联合实验室

该实验室将聚焦图形渲染、物理仿真、空间智能、3D高斯重建(3DGS)与具身智能等前沿领域的关键技术攻关,同步支撑基础科学研究,通过软硬一体化深度协同,推动从底层芯片到上层应用的全栈性能优化,为空间智能与具身智能产业构建坚实的国产化技术底座。双方将以技术攻关为纽带,打通从前沿算法到国产算力平台的优化链路,同步培养兼具软硬一体视野的复合型科研人才,共同构建开放、自主的具身智能与空间智能技术生态。当前,空间智能与具身智能正加速走向产业应用,高保真图形渲染与实时物理仿真是其不可或缺的技术基石。

2026-06-26 15:36:49 247

原创 摩尔线程发布图形显卡驱动v340.150,创作与游戏体验同步升级

同时,新驱动还对《VEIN》《雾锁王国》以及《底特律变人》等多款热门游戏进行了优化,为玩家带来更流畅、更稳定的游戏体验。显卡用户可通过访问摩尔线程官网下载最新版本v340.150的驱动程序,已安装PES控制中心的用户,可通过“检查更新”功能,下载全新发布的Windows驱动程序。这一优化有效应对了早期设备的兼容痛点,让存量设备用户无需更换主板或处理器,即可直接使用摩尔线程系列显卡,切实降低了用户的硬件升级门槛与换机成本。,通过AI重建算法,大幅提升了低分辨率、低画质片源在播放时的画面细腻度与清晰度。

2026-06-24 15:42:40 305

原创 摩尔线程发布端侧智能体LiteGUI:2B小模型超越72B行业标杆

LiteGUI 采用了“无依赖SFT(SFT-Free)”的全新训练范式,通过将大模型的通用知识无损“压缩蒸馏”至 2B-3B 级别的端侧小模型中,配合创新的强化学习机制,彻底解锁了轻量级智能体在复杂、长序列任务中的自主进化能力。: 在完全禁止使用命令行、仅依赖视觉UI操作的严苛限制下,Lite-GUI-2B与Lite-GUI-30B-A3B分别取得了61.76%和89.26%的高分,:Lite-GUI-2B的任务成功率达到13.24%,较原始基座模型Qwen3-VL-2B的6.04%,实现了。

2026-06-23 15:46:25 436

原创 摩尔线程RAGBASE:端侧私有知识库的精准问答与高效推理实践

RAGBASE所代表的,不仅是一套本地知识库工具,更是一种更个人化、更可信赖的人机知识协同范式——让AI在全程保障数据隐私的前提下,真正理解并激活私有数据的价值。整个过程不依赖网络,从根源上解决了数据隐私与云端依赖的痛点——即使在完全断网环境下,也能提供安全、精准、高效的私有知识库服务,展现了端侧RAG技术在安全性、精准度和推理效率上的领先性。从文档上传、基于hash值的文件去重、智能解析,到向量化、双库存储、检索与大模型推理,所有操作均在本地完成,无云端交互。数据不离开终端设备,隐私更安全。

2026-06-11 16:26:36 412

原创 五大能力升级|MTT AIBOOK推送AIOS 1.4.1版本,核心场景流畅度提升30%

精准适配不同操作场景的滑动节奏,完有效缓解滑动滞涩与手感脱节问题,触控响应更加及时,日常办公与页面浏览的操控舒适度提升。,在全核心满载工作状态下,可实现主频额外提升100MHz,处理器极限算力得到充分释放,高强度办公、多程序并行、轻量化创作等场景的响应速度提升。,有效提升网页图形渲染精度、降低高清视频播放功耗,实现网页浏览、在线影音与Web应用运行的高效稳定输出,带来极速、高清、流畅的沉浸式上网体验。,采用全新可视化交互页面,简化系统安装流程,支持极速装机、驱动自动化安装配置,降低用户操作门槛。

2026-06-10 16:15:07 413

原创 摩尔线程开源MusaCoder:面向GPU底层算子生成的专用代码大模型

这一开源举措将有助于提升MUSA在AI开发者社区的可见度,推动MUSA Kernel、编译工具链及运行时生态建设,吸引社区围绕MUSA进行算子优化、KernelBench适配和代码生成模型微调等工作,全面展示摩尔线程在国产GPU、大模型训练、执行反馈强化学习和AI编程工具链方向的综合能力。随着大模型代码生成能力不断提升,行业对代码模型的评估重心正在发生变化:从过去关注“语法是否正确”“能否写出完整代码”,逐步转向更底层、更真实的工程能力,即生成代码是否能够被编译、运行、验证,并在实际执行中带来性能收益。

2026-06-10 15:53:56 568

原创 摩尔线程 × 北京大学|EvoPhys-World登顶WorldScore,国产GPU全栈原生训练

未来,摩尔线程将持续秉持“灯塔计划”的宗旨,深化与高校、科研机构的合作,并携手广大开发者及产业伙伴一道,以全功能GPU与MUSA软件栈为坚实底座,为前沿科研和产业创新提供持续的算力与工程支持,共同推动人工智能技术突破,加速产业高质量发展。从分布式训练框架、丰富的算子支持,到高效的卡间通信与软硬件协同优化,MUSA软件栈支撑了这一以扩散式生成为核心、融合多模态时空建模的新型世界模型,从适配到稳定训练的全链路落地。在对齐验证条件下,MTT S5000与国际主流产品的训练吞吐基本持平、多机扩展效率曲线趋势接近。

2026-06-09 15:51:12 478

原创 摩尔线程 × 中科院计算所丨DeferredGS全栈国产化适配落地

而此次适配的DeferredGS方法,正是集成于计图高斯库中的一项核心技术,代表了当前高斯泼溅在材质解耦与重光照方向的前沿水平。近年来,高斯泼溅作为一种高效的可微三维表示方法,在实现高质量、实时渲染的同时,相比传统神经辐射场方法具备更高的训练效率,已在三维重建、数字人、虚拟现实与数字孪生等领域快速发展。中国科学院计算技术研究所团队提出了高斯泼溅解耦表示与重光照方法DeferredGS(如图1所示),该方法引入了延迟渲染管线,并将场景的几何属性与材质进行解耦,实现了高斯泼溅场景的实时重光照。

2026-06-04 16:11:02 496

原创 开发者挑战赛启动!摩尔线程携手HICOOL诚邀全球极客来战

此次挑战赛兼具技术竞技标杆、生态共建载体、战略落地桥梁与开发者赋能平台四大价值,目标是打破实验室创新与产业落地的壁垒,让全球开发者与创业者深度融入国产算力的产业生态,从技术验证、产品打磨到商业变现全程陪伴,全力成就开发者。赛题聚焦智能体技术在国产环境下的创新落地,构建可覆盖多类工作场景的轻量级个人智能助手,实现自然语言指令的精准理解与高效分发,在响应速度、任务匹配准确度及场景泛化能力上的突破,鼓励开发者打造真正懂用户、懂场景、懂效率的智能体系统,为下一代人机协作方式提供实践范本。大赛整体赛程安排如下。

2026-06-02 16:04:32 350

原创 摩尔线程开源AI智能体框架MTClaw 突破执行效率

一次请求进入MTClaw后,“前台助理”经历“判断→执行→检查”三个步骤,先决定该任务由“轻量模型直办”还是“交给大模型”,执行完成后确认是否需要大模型补充完善。该模式下,单次任务成功率达100%,平均完成时间为7.61秒,相较传统方式,不仅成功率更高(100% vs 99%),还实现约5倍的速度提升。MTClaw不仅适用于桌面控制场景,也有望延伸至代码辅助、自动化测试、多模态任务编排等更广泛的AI智能体应用领域,为国产GPU算力在智能体加速方向上的规模化落地提供可复用的技术基座。

2026-06-01 18:26:25 502

原创 筑基开发者生态:摩尔学院“行知平台”正式上线!

国产算力生态的崛起,不仅需要坚实可靠的硬件基座,更呼唤能够系统化培养开发者的软件栈与学习平台。在AI技术日新月异的今天,开发者的实战能力已成为释放硬件潜能、推动应用落地的关键环节。—— 以“代码即课程”为理念的在线实训环境,旨在为开发者提供从MUSA开发入门、MUSA算子优化到AI综合实战的完整实践路径。点击下方“阅读原文”,登录摩尔学院,从《行知平台操作指导》开始,踏上国产GPU开发者的高手之路!行知平台是一个以实践为核心的MUSA编程实训环境。▼ 对MUSA编程感兴趣,但缺乏实践机会的学习者。

2026-05-29 18:58:14 385

原创 Day-0支持|摩尔线程完成腾讯混元Hy-MT2翻译模型在长江SoC上的极速适配

摩尔线程长江SoC依托MUSA架构,在高性能端侧推理、显存高效调度等方面具备核心优势,能够有效支撑Hy-MT2系列的多语种翻译需求。此次Day-0极速适配,是摩尔线程常态化前沿模型响应能力在端侧与边缘场景的重要落地,进一步完善了“云-边-端”全场景算力支撑体系,夯实了国产算力在端侧AI翻译、离线多语交互、智能终端设备等场景中的基础设施能力。摩尔线程将持续深耕MUSA架构与端边计算优化,保持对前沿大模型的快速适配,以全栈国产算力赋能端侧AI规模化普及,助力多语言智能应用走进更多真实场景。

2026-05-22 16:11:19 204

原创 从代码合入到社区共聚:SGLang × MUSA Meetup圆满落幕,国产GPU开源生态进入“原生支持”时代

目前,基于MUSA的SGLang已支持DeepSeek、Qwen、GLM等主流大模型及Wan、LTX等视频生成模型,在MTT S5000等硬件上实现真正的“开箱即用”与无缝加速,显著降低了开发者的算力迁移门槛。通过与SGLang、TileLang、Triton、Mooncake等开源社区的紧密协作,摩尔线程不仅推动了MUSA平台与主流AI框架的深度适配,更。,未来12个月应优先建立跨层级的统一抽象边界、标准化适配接口与共享的基准测试体系,以开放协作替代重复适配,共同推动国产AI软硬件生态的协同突破。

2026-05-13 17:40:06 520

原创 摩尔线程携手紫光计算机发布《语音识别全栈国产化技术实践白皮书》

然而,传统语音识别方案在面对复杂噪声环境、专业术语、长音频转写及高并发场景时,往往存在延迟高、准确率下降、部署成本难控等问题,亟需新一代软硬协同方案实现突破。以国产全功能GPU为基石,以国家级权威检测认证为技术验证,摩尔线程与紫光计算机通过《语音识别全栈国产化技术实践白皮书》分享的技术方案,在低噪、高噪环境下均实现了超过97%的关键词识别准确率与超过99%的连续语音识别准确率,为行业提供了一条高精度、低延迟、可定制的语音识别实践参考,助力千行百业迈向智能交互新时代。该技术方案采用先进的。

2026-05-13 15:56:28 602

原创 摩尔线程 × 光轮智能|强强联手,共筑国产具身智能仿真底座

与此同时,光轮依托首创物理测量工厂与虚实对标方法论,将真实世界中的质量、摩擦、接触、形变等关键物理参数引入仿真环境,结合SimReady标准体系,确保仿真资产可验证、可复用、可规模化,,构建覆盖场景构建、任务生成、仿真执行到评测验证的闭环,形成以RoboFinals为代表的系统化评测能力,结合摩尔线程国产GPU算力底座与大规模并发能力,实现位姿、物性、视角与环境条件等维度的高效泛化,推动具身数据从有限采集走向规模化生成。,以国产算力与仿真算法的深度融合,为具身智能发展夯实自主可控的基础设施。

2026-05-13 15:56:00 439

原创 倒计时3天!摩尔线程 × SGLang Meetup三大硬核议题抢先看

SGLang核心贡献者Xiaoyu Zhang(BBuf)与摩尔线程技术专家将共同分享SGLang未来路线图、kernel优化实践、Vibe Coding应用探索,以及MUSA移植落地的真实经验。双通道参会形式,开发者可以零距离对话行业技术大牛,抢先直击前沿技术、解锁硬核干货精髓!Triton、TileLang项目技术专家将聚焦算子工程,分享高性能算子生成方法、MUSA专项优化策略,以及MATE算子库的技术协同方案。了解完整议程,即刻扫码报名线下参会,或预约线上直播。与技术大牛面对面,共探AI无限可能。

2026-05-13 15:54:55 156

原创 MUSA获得SGLang主线支持!5月10日北京,AI Meetup等你来

摘要:5月10日北京将举办"SGLang×MUSA"技术沙龙,聚焦国产GPU与全球开源生态融合。摩尔线程MUSA后端正式加入开源推理框架SGLang官方支持体系,开发者可原生调用摩尔线程GPU实现高性能推理。活动将探讨框架适配、算子优化及生态共建等议题,涵盖SGLang核心功能、MUSA移植落地等内容。通过线下交流与线上直播,为AI开发者提供与专家深度对话的机会,推动国产GPU在AI推理领域的发展。(149字)

2026-04-30 16:04:23 284

原创 Day-0支持 | 摩尔线程适配商汤日日新SenseNova U1系列原生理解生成统一模型

摩尔线程MTTS5000智算卡成功适配商汤SenseNovaU1统一模型,实现国产GPU对新型多模态架构的Day-0支持。该模型基于NEO-Unify架构,突破传统拼接模式,实现语言与视觉的统一建模,仅8B规格即可媲美大模型性能。摩尔线程通过MUSA架构的生态兼容性、1000TFLOPS算力及80GB显存支持,以及深度优化的高性能算子库,为多模态推理提供高效硬件支撑。此次合作标志着国产AI生态从算法到芯片的全链路突破,为教育、科研等场景应用奠定基础。

2026-04-28 21:04:11 371

原创 摩尔线程 × 上海AI实验室|基于S5000和KernelSwift实现DeepSeek-V4核心算子Day-0适配

DeepSeek-V4预览版发布当天,摩尔线程通过智能算子迁移系统KernelSwift,在MTTS5000智算卡上实现了80%以上核心算子的Day-0适配。KernelSwift将适配周期从数月缩短至小时级,支持多元国产芯片的"开箱即用"。MTTS5000凭借原生FP8精度支持,为模型提供高效算力底座。经协同优化,21个核心算子均获加速,自动生成算子正确率达100%,展现了国产AI生态的高效协作能力。这一突破为国产算力从研发到应用积累了重要经验。

2026-04-28 15:35:58 377

原创 Day-0支持|摩尔线程TileLang-MUSA率先支持DeepSeek-V4全新TileKernels

摩尔线程宣布其TileLang-MUSA成为TileLang官方主线版本,实现对DeepSeek-V4最新TileLang算子库TileKernels的"Day-0"支持,为国产GPU上的大模型算子迁移和优化奠定基础。TileLang-MUSA已开源,测试覆盖率超95%,显著提升国产GPU开发效率。这一进展标志着国产AI大模型与GPU深度融合,摩尔线程将持续投入开源生态建设,推动国产算力发展。

2026-04-28 15:35:51 218

原创 Day-0支持|摩尔线程适配腾讯混元Hy3 preview大模型

摩尔线程宣布完成腾讯混元Hy3preview模型的Day-0极速适配,通过自研MUSA架构实现软硬件协同优化,在MTTS5000智算卡上高效运行295B参数的Hy3preview模型。该适配展现了摩尔线程对前沿AI模型的快速响应能力,简化了开发者部署流程,为国产算力支持大模型落地提供新范例,将持续优化技术架构助力AI产业发展。

2026-04-24 16:07:49 181

原创 筑基AI4S:摩尔线程全功能GPU加速中国生命科学自主生态

精准医疗与药物研发正被人工智能深刻重塑。作为AI for Science(AI4S)领域的核心阵地,解码生命奥秘的关键已从实验观测转向算力与算法的协同突破。蛋白质结构预测、基因组分析与医学影像,构成了生命科学AI的三类关键技术,其能力直接决定了新药研发的效率与精准医疗的进程。

2026-04-17 15:31:21 443

原创 Day-0支持|摩尔线程极速适配百度文心ERNIE-Image系列文生图模型

摩尔线程完成百度ERNIE-Image文生图模型的Day-0适配,实现国产模型与国产GPU的深度融合。该80亿参数模型在摩尔线程MUSA架构GPU上高效运行,仅需24GB显存即可生成高质量图像,在多项指标超越开源模型。适配工作通过系统算子优化充分释放模型潜力,为开发者提供低成本部署方案,拓展了国产算力在创意设计等领域的应用场景。此次合作展现了国产AI生态协同创新的重要进展。

2026-04-15 15:42:06 280

原创 MUSA开发者大赛 —— GEMM优化挑战赛

MUSA开发者大赛丨GEMM优化挑战赛,诚邀所有开发者,用智慧与代码亲手定义全新的性能巅峰。

2026-01-09 20:51:17 919

原创 MUSA 训练营 | 学 MUSA 赢大奖

为助力用户深入学习 MUSA 相关知识,摩尔学院推出“MUSA 训练营 | 学 MUSA 赢大奖”活动,诚邀各位开发者参与,在提升专业技能的同时,赢取丰厚奖励。

2025-08-18 00:01:29 826

原创 摩尔学院实训课程 - CIFAR-10 on MUSA

本实训将结合 CIFAR-10 图像分类任务,带领学员体验基于摩尔线程全功能 GPU 加速的完整 AI 开发流程,深入理解深度学习技术原理与国产算力基础设施的应用。

2025-07-05 13:11:26 499

原创 GPU 图形计算综述 (四):计算着色器 (Compute Shader)

计算着色器(Compute Shader)是GPU通用计算的核心技术,自2009年微软DirectX 11引入后迅速发展。它具有通用性、并行性(支持多维线程组)、灵活编程、高效内存访问和跨平台等特性,通过SIMD/SIMT架构实现大规模并行计算。应用涵盖图形渲染(后处理、粒子系统)、物理模拟(流体、布料)、科学计算、AI(神经网络加速)、游戏开发(地形生成)等多个领域。计算着色器突破了传统图形管线限制,充分利用GPU并行计算能力,为高性能计算提供了新的解决方案,推动着GPU技术的发展。

2025-06-16 05:20:54 1475

原创 GPU 图形计算综述 (三):可编程管线 (Programmable Pipeline)

2000年微软发布DirectX8.0开启了可编程管线时代。随着几何着色器、曲面细分着色器、光线追踪着色器等新型着色器的相继问世,GPU性能快速发展,2006年英伟达GPU晶体管数量已超越同期英特尔CPU。虽然可编程着色器大大推动了图形技术进步,但其复杂性也提高了编程门槛。

2025-06-05 18:44:46 843

原创 GPU 图形计算综述 (二):固定管线

GPU图形管线的发展,经历了从固定功能到可编程功能的演变,这一过程推动了计算机图形学的重大进步。早期GPU作为CPU协处理器,专注于加速特定图形操作,如顶点变换、光照计算等,所有渲染步骤由硬件预定义,仅能通过图形API设置参数。这种固定管线开发简单、执行效率高,但功能有限,无法实现复杂渲染效果。

2025-05-29 21:22:02 587

原创 GPU 图形计算综述 (一)

伴随着软硬件技术的不断演进,可编程管线(Programmable Pipeline)、并行计算(Parallel Computing)、通用计算(General Purpose Computing)、光线追踪(Ray Tracing)、人工智能(Artificial Intelligence,AI)等前沿技术在GPU所搭建的舞台上相继兴起,并各领风骚。通用计算(General Purpose Computing),泛指基于非图形API(例如CUDA,OpenCL,等等),调起GPU的计算模块的过程。

2025-05-27 09:43:57 476

空空如也

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除