- 博客(127)
- 收藏
- 关注
原创 大模型计算量、显存计算方法推导
分析transformer模型的参数量、计算量、中间激活、KV cache。该帖子是很经典的计算大模型FLOPs和显存的,值得细读。
2026-02-08 23:25:40
81
原创 Huggingface更改模型和数据的默认存储目录
只需要下面的环境变量即可,模型即可从默认的/root/.cache/huggingface转换到下面的目录,可以根据自己的目录修改,这样下载的文件就改掉了。
2025-02-15 14:49:07
406
原创 Huggingface不能访问解决办法 hf-mirror平替
Huggingface是大模型下载的主要网站,但是如果不能科学上网,将无法访问,可以用Hf-mirror进行替换:
2025-02-15 14:46:54
1114
原创 DeepSpeed实战系列篇2:RTX 3090服务器Reward模型微调
本文主要讲述了DeepSpeed服务器实战的stpe2,奖励模型的微调
2023-07-22 11:34:02
1237
原创 MiniGPT4系列之三模型推理 (Web UI):在RTX-3090 Ubuntu服务器推理
下面就是见证奇迹的时刻了,你可以打开浏览器和模型聊天了。可以在通过内网IP地址:端口号访问服务了,具体地址和端口号要根据自己的设置修改。此时可以在服务器上访问这个地址就可以,但服务器通常没有界面,需要做个映射。至此,已完成除训练外的所有工作,congratulations!主要是端口占用,需要找到该端口对应的pid,kill掉即可。虽然出现ERROR,但后面经验证毫无影响,不要担心。可以看出21001端口对应的pid为810758。
2023-07-15 12:05:29
1689
3
原创 MiniGPT4系列之一部署篇:在RTX-3090 Ubuntu服务器部署步骤详解
本文主要介绍minigpt4在ubuntu服务器 RTX-3090部署的全过程
2023-07-12 23:27:44
2542
7
原创 解决ubuntu cuda版本nvcc -V和nvidia-smi不一致问题
本文主要解决ubuntu cuda版本nvcc -V和nvidia-smi不一致问题
2023-07-12 23:05:50
15411
7
原创 边缘计算:万字长文详解高通SNPE inception_v3安卓端DSP推理加速实战
利用SNPE在安卓手机端利用CPU、GPU、DSP完成神经网络推理加速
2023-03-04 01:03:01
5349
1
原创 完美解决强化学习服务器Jupyter notebook gym 执行env.render报错问题
Jupyter notebook服务器中执行强化学习,env.render报错问题解决办法
2022-10-01 21:38:41
3463
1
原创 Execution failed for task ‘:app:processDebugMainManifest‘.> Manifest merger failed : Apps targeting
边缘计算
2022-10-01 21:11:52
6477
原创 解决Could not find org.jetbrains.kotlin:kotlin-gradle-plugin * 错误方法
安卓开发 边缘计算
2022-10-01 21:06:54
22109
1
原创 边缘计算:基于tflite实现安卓边缘端在线训练on device training(端侧训练)万字长文详解
本文涉及当下最热的边缘计算,基于tflite,边缘端训练、推理等最先进功能,欢迎转发
2022-09-24 17:42:41
2704
5
转载 中科大强化学习笔记超全指南
前几期小编给小伙伴们整理了有关人工智能200G资料包,今天为大家整理了知乎上计算机技术硕士们分享的有关强化学习学习由入门到深化的整套学习资源。强化学习,又称再励学习、评价学习或增强学习,是机器学习的范式和方法论之一,用于描述和解决智能体(agent)在与环境的交互过程中通过学习策略以达成回报最大化或实现特定目标的问题强化学习问题在信息论、博弈论、自动控制等领域有得到讨论,被用于解释有限理性条件下的平衡态、设计推荐系统和机器人交互系统。一、强化学习视频01莫烦莫烦.
2022-05-26 22:00:39
792
转载 强化学习实战-吃豆人Pacman经典案例分析
前言:上篇介绍了什么是强化学习,本篇实战讲解强化学习,提供所有的实战代码,可以自行下载运行。本篇使用强化学习领域经典的Project-Pacman项目进行实操,Python2.7环境,使用Q-Learning算法进行训练学习,将讲解强化学习实操过程中的各处细节。如何设置Reward函数,如何更新各(State,Action)下的Q-Value值等。有基础的读者可以直接看Part4实战部分。文章略长,细节讲解很多,适合新手入门强化学习。1. 强化学习关于强化学习的基础介绍,可以阅读我上一篇帖子,本..
2022-05-26 15:19:54
8548
2
空空如也
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅