腾讯InstantMesh30秒图片生成3D模型;微软实时生成会说话的头像VASA;由 AI 创作的恶搞视频片段Sitcom Simulator

✨ 1: InstantMesh

30 秒内从一张图片生成 3D 模型

在这里插入图片描述

InstantMesh是一个基于单张图片,利用先进的稀疏视图大型重建模型(LRM)架构,快速生成3D网格(Mesh)的工具。这个框架允许用户将2D图片转换成3D模型,通过自动化处理简化了3D内容的创建过程,对于游戏设计、动画、建筑可视化等领域非常有用。

地址:https://github.com/TencentARC/InstantMesh

✨ 2: VASA-1

微软实时生成会说话的头像

在这里插入图片描述

单张人像照片 + 语音音频 = 超逼真的说话人脸视频,具有精确的口音同步、逼真的面部行为和自然的头部运动,实时生成。

地址:https://www.microsoft.com/en-us/research/project/vasa-1/

✨ 3: Sitcom Simulator

能够自动生成由 AI 创作的恶搞视频片段

在这里插入图片描述

Sitcom Simulator 是一个高度可定制的工具,能够自动生成由 AI 创作的恶搞视频片段,也称之为模因视频。这个工具通过编程命令即可安装使用,并支持各种自定义设置,让用户可以根据个人想法创造出独一无二的视频内容。

地址:https://github.com/joshmoody24/sitcom-simulator

✨ 4: SadTalker

能够将单张静态人像图片与音频(比如一段对话或音乐)结合,生成一段看起来这个人像在说话或表达情感的真实动态视频

在这里插入图片描述

SadTalker是一个基于深度学习的工具,它能够将单张静态人像图片与音频(比如一段对话或音乐)结合,生成一段看起来这个人像在说话或表达情感的真实动态视频。这种技术被广泛应用于数字媒体、娱乐、虚拟主播和个性化视频制作等领域。

地址:https://github.com/OpenTalker/SadTalker

✨ 5: Stable Diffusion 3 API

Stable Diffusion 3 API现已推出,提供先进的文本到图像生成能力和改进的模型架构。

在这里插入图片描述

Stable Diffusion 3 API是由Stability AI推出的一项开发者平台API服务,它提供了先进的文本到图像生成能力。这个API基于Stable Diffusion 3模型,该模型采用了全新的Multimodal Diffusion Transformer(MMDiT)架构,实现了更加精准的文本理解和拼写能力,与现有的文本到图像生成系统如DALL-E 3和Midjourney v6相比,在排版和提示符遵循性方面表现更佳。

更多AI工具,参考国内AiBard123Github-AiBard123

  • 16
    点赞
  • 6
    收藏
    觉得还不错? 一键收藏
  • 打赏
    打赏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

go2coding

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值