【LLM】droidrun 基于视觉的安卓机器Agent

基础介绍

droidrun 是基于ReAct的视觉LLM Agent。

安装

环境依赖:

  1. 开了usb调试的安卓机或者模拟器,我用了小米11ultra和雷电9;
  2. Python 3.10以上;
  3. Windows 11。

安装 droidrun 依赖

方法一:

pip install droidrun

方法二【我用的这个】:

git clone https://github.com/droidrun/droidrun.git
cd droidrun
## 我直接明文写入代码里面了 =-=!,写入api_key之后再安装
pip install -e .

目前项目分支支持 deepseek 了,代码在droidrun/agent/providers/deepseek_provider.py
在这里插入图片描述
可选的,重新安装。

pip uninstall droidrun
cd droidrun
pip install -e .
pip install -e . --force-reinstall

安装ADB

下载ADB,并放入环境变量。输入adb version有返回说明没有问题。

安装 DroidRun Portal App

droidrun 获取视觉的app,下载地址。安装方式推荐使用 droidrun 安装,安装不成功会有报错开启对应权限。环境推荐使用模拟器,出现框框说明安装成功。

droidrun setup --path=./droidrun-portal-v0.1.0.apk

在这里插入图片描述
在这里插入图片描述
在这里插入图片描述

使用

 droidrun "打开微信,给xxx发你好" --provider deepseek --model deepseek-chat

实测能打开 app 但是操作很慢,最后没法发送成功。测试机没有 Put 的权限,虚拟机没法输入等等。
在这里插入图片描述

使用小结

缺点:

  1. 基于视觉的Agent,大量消耗LLMtoken,还慢;
  2. 还不算智能。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值