- 博客(3)
- 收藏
- 关注
原创 写CUDA的人,如何“无缝”切换到DCU?——HIP Runtime API深度解读
DTK 26.04的HIP Runtime API已经覆盖了从设备管理、内存管理、流和事件到图执行的完整编程模型。怎么让开发者用最熟悉的方式,把计算任务搬到DCU上。对于写过CUDA的开发者来说,HIP的学习曲线几乎是一条平线——换几个前缀、改几个头文件,代码就能跑起来。对于没写过GPU程序的开发者来说,HIP的API设计直观、文档齐全(光合开发者社区提供了完整的API参考手册),入门门槛也远低于预期。国产加速卡能不能用、好不好用,API是第一步,也是最重要的一步。
2026-07-09 00:00:46
538
原创 国产DCU加速卡赋能科学计算:GROMACS、LAMMPS与OpenFOAM的适配与优化
从GROMACS的生物大分子模拟,到LAMMPS的材料科学计算,再到OpenFOAM的流体力学仿真,DCU加速卡正在逐步覆盖科学计算的主流软件生态。海光DCU凭借其对CUDA和ROCm生态的兼容性,以及DTK等完善的软件栈支持,为国产科学计算软件的迁移和优化提供了坚实的基础。当前,海光通过光合开发者社区提供技术资源与算力支持,光合基金已累计投入5000万元支持240余项应用适配。
2026-07-09 00:00:29
543
原创 从“自己搬砖”到“指挥别人搬砖”:DUSHMEM库如何让多卡通信更简单
多卡通信为什么难?因为数据在卡之间搬动,需要有人协调——谁来发、谁来收、什么时候发、什么时候收。传统方式让CPU当“中间人”,慢且占资源。让DCU自己管自己。用对称内存让所有PE共享一个逻辑上的全局地址空间用put/get实现单边通信,接收方不需要参与用原子操作保证多PE同时访问时的数据一致性用集合通信实现PE之间的协同用Device端API让通信逻辑直接在Kernel里完成。
2026-07-08 23:22:06
540
1
空空如也
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅