推荐 4 个 yyds 的开源项目！

鸡腿爱学习

于 2024-08-16 11:14:54 发布

阅读量874

点赞数 9

文章标签：开源自动化人工智能 langchain 面试运维

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/2401_84206094/article/details/141254638

版权

OpenAI 文本转语音 API

OpenAI 近日正式宣布将文本转语音 API 添加到了开发者 Playground 中，此次集成的新功能，赋予了开发者前所未有的便捷性。

只需输入文本消息，即可在六种预设声音中生成音频。
会根据文本自动匹配对应语言的语音，不需要选择语言国家。
方便开发者轻松构建应用。

在线体验：https://platform.openai.com/playground/tts

用户不仅能够灵活选择输出音频的格式（包括mp3、opus、aac、flac、pcm等），以满足不同场景下的需求，还能轻松调整音频参数，确保生成的语音内容既符合个性化要求，又具备高度的专业性和适应性。

智谱开源视频理解大模型

智谱开源视频理解大模型 CogVLM2-Video，GPT4V 级别，基于开源 Llama3-8B 版本。

CogVLM2-Video 通过引入多帧视频图像和时间戳作为编码器输入，解决了现有视频理解模型在处理时间信息丢失问题上的局限。
模型利用自动化的时间定位数据构建方法，生成了3万条与时间相关的视频问答数据，为训练提供丰富的时间定位数据。
CogVLM2-Video 在多个公开评测集上展现了卓越性能，包括在VideoChatGPT-Bench和Zero-shot QA以及MVBench等量化评估指标上的优异表现。

体验链接：http://cogvlm2-online.cogviewai.cn:7868/

PaintsUndo

PaintsUndo 输入静态图像，自动帮你生成整个绘画的全过程视频

只需要提供一张图片，PaintsUndo会根据提供的图像自动生成对应的绘画全过程视频。
不仅限于某一种类型的图像，PaintsUndo可以应用于各种不同类型的图像，生成相应的绘画过程视频。
该项目主要是为了研究和再现数字绘画中的绘画行为，从而为数字艺术创作提供新的工具和方法。
同一张静态图像可以生成多种不同风格和细节程度的绘画过程视频。

链接：https://lllyasviel.github.io/pages/paints_undo/

阿里开源音频大模型

阿里开源音频生成大模型 FunAudioLLM，项目地址：https://fun-audio-llm.github.io

能理解和生成各种人类语音
主要模型构成：SenseVoice 和 CosyVoice。
SenseVoice：语音识别模型，这个模型可以识别多种语言的语音，识别说话人的情感，检测音频中的特殊事件（比如音乐、笑声等）。它可以快速而准确地转录语音内容。
CosyVoice：语音生成模式，这个模型主要生成自然且情感丰富的语音。它可以模仿不同的说话人，甚至可以用几秒钟的音频样本来克隆一个人的声音。

（完）

AI算法交流群(知识星球)来了，这是一个面向全体学生和机器学习/算法工程师/研究员的技术沟通和求职交流的平台。

在这里你可以了解最前沿AI技术资讯、Paper、大模型、多模态，算法竞赛、实战项目、获取AI算法的校招/社招准备攻略、面试题库、面试经验分享、Offer选择、内推机会、学习路线、求职答疑和海量学习资料等内容。

同时，你也可以与来自港科大、北大、清华、中科院、CMU、腾讯、百度等名校名企开发者互动交流~

AI算法交流群方向涉及搜广推、深度学习，机器学习，计算机视觉，知识图谱，自然语言处理，大数据，自动驾驶，机器人，大模型、多模态等多个方向。

如何学习AI大模型？

我在一线互联网企业工作十余年里，指导过不少同行后辈。帮助很多人得到了学习和成长。

自己也整理很多AI大模型资料：AI大模型入门学习思维导图、精品AI大模型学习书籍手册、视频教程、实战学习等录播视频免费分享出来。

在这里插入图片描述

第一阶段：从大模型系统设计入手，讲解大模型的主要方法；

第二阶段：在通过大模型提示词工程从Prompts角度入手更好发挥模型的作用；

第三阶段：大模型平台应用开发借助阿里云PAI平台构建电商领域虚拟试衣系统；

第四阶段：大模型知识库应用开发以LangChain框架为例，构建物流行业咨询智能问答系统；

第五阶段：大模型微调开发借助以大健康、新零售、新媒体领域构建适合当前领域大模型；

第六阶段：以SD多模态大模型为主，搭建了文生图小程序案例；

第七阶段：以大模型平台应用与开发为主，通过星火大模型，文心大模型等成熟大模型构建大模型行业应用。

在这里插入图片描述

👉学会后的收获：👈
• 基于大模型全栈工程实现（前端、后端、产品经理、设计、数据分析等），通过这门课可获得不同能力；

• 能够利用大模型解决相关实际项目需求：大数据时代，越来越多的企业和机构需要处理海量数据，利用大模型技术可以更好地处理这些数据，提高数据分析和决策的准确性。因此，掌握大模型应用开发技能，可以让程序员更好地应对实际项目需求；

• 基于大模型和企业数据AI应用开发，实现大模型理论、掌握GPU算力、硬件、LangChain开发框架和项目实战技能，学会Fine-tuning垂直训练大模型（数据准备、数据蒸馏、大模型部署）一站式掌握；

• 能够完成时下热门大模型垂直领域模型训练能力，提高程序员的编码能力：大模型应用开发需要掌握机器学习算法、深度学习框架等技术，这些技术的掌握可以提高程序员的编码能力和分析能力，让程序员更加熟练地编写高质量的代码。

在这里插入图片描述

1.AI大模型学习路线图
2.100套AI大模型商业化落地方案
3.100集大模型视频教程
4.200本大模型PDF书籍
5.LLM面试题合集
6.AI产品经理资源合集

👉获取方式：
😝有需要的小伙伴，可以保存图片到wx扫描二v码免费领取【保证100%免费】🆓

本文转自 https://blog.csdn.net/2401_85378759/article/details/141126453?spm=1001.2014.3001.5501，如有侵权，请联系删除。

鸡腿爱学习

关注

9
点赞
踩
18

收藏

觉得还不错? 一键收藏
0
评论
推荐 4 个 yyds 的开源项目！

在这里你可以了解最前沿AI技术资讯、Paper、大模型、多模态，算法竞赛、实战项目、获取AI算法的校招/社招准备攻略、面试题库、面试经验分享、Offer选择、内推机会、学习路线、求职答疑和海量学习资料等内容。• 基于大模型和企业数据AI应用开发，实现大模型理论、掌握GPU算力、硬件、LangChain开发框架和项目实战技能，学会Fine-tuning垂直训练大模型（数据准备、数据蒸馏、大模型部署）一站式掌握；同时，你也可以与来自港科大、北大、清华、中科院、CMU、腾讯、百度等名校名企开发者互动交流~
复制链接

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。