<?xml version="1.0" encoding="utf-8" ?><rss version="2.0"><channel><title><![CDATA[RA AI衍生者训练营的博客]]></title><description><![CDATA[]]></description><link>https://blog.csdn.net/RamendeusStudio</link><language>zh-cn</language><generator>https://blog.csdn.net/</generator><copyright><![CDATA[Copyright &copy; RamendeusStudio]]></copyright><item><title><![CDATA[AI教我做事之AIAgent开发-3 实施人工智能战略的步骤]]></title><link>https://blog.csdn.net/RamendeusStudio/article/details/146390682</link><guid>https://blog.csdn.net/RamendeusStudio/article/details/146390682</guid><author>RamendeusStudio</author><pubDate>Thu, 20 Mar 2025 10:43:11 +0800</pubDate><description><![CDATA[人工智能就像拥有一个超级聪明的助手，它可以学习、适应并不知疲倦地工作以理解您的数据并帮助您做出更好的决策。从定义明确的目标到选择合适的工具并有效扩展，每个步骤都至关重要，以确保您的 AI 计划取得可衡量的成果。而是要以符合您的业务目标、增强您的流程和增强您的团队能力的方式嵌入 AI。在这篇博客中，我们将讨论人工智能对您的业务的真正意义、它如何为您创造奇迹以及将其付诸实践的步骤。没有废话，只有您需要了解的内容。明确的人工智能实施策略可确保您不仅顺应趋势，而且做出能够为您的业务增加真正价值的深思熟虑的选择。]]></description><category></category></item><item><title><![CDATA[AI教我做事之AIAgent开发-1 AI Agent是什么？]]></title><link>https://blog.csdn.net/RamendeusStudio/article/details/146390325</link><guid>https://blog.csdn.net/RamendeusStudio/article/details/146390325</guid><author>RamendeusStudio</author><pubDate>Thu, 20 Mar 2025 10:34:07 +0800</pubDate><description><![CDATA[AIAgent 的定义AI Agent 是一种软件程序，可以感知环境、做出决策并采取行动，以实现预定的目标。研究表明，它通常基于人工智能技术，特别是大型语言模型（LLM），能够自主完成任务，如自动化客户服务或数据分析。开发AIAgent 的步骤定义问题：明确 AI Agent 需要解决的任务或目标，例如回答客户查询或自动化调度。选择技术：选择适合的 AI 框架和编程语言，如 Python，并使用如 TensorFlow 或 PyTorch 的工具。数据收集和准备。]]></description><category></category></item><item><title><![CDATA[4.1-2 做漫画的神器MangaMaker]]></title><link>https://blog.csdn.net/RamendeusStudio/article/details/146372178</link><guid>https://blog.csdn.net/RamendeusStudio/article/details/146372178</guid><author>RamendeusStudio</author><pubDate>Wed, 19 Mar 2025 15:30:11 +0800</pubDate><description><![CDATA[MangaMaker这个插件真的让人惊讶，还记得小时候我们经常看的日本漫画风格吗？现在你自己也可以做了。提供多种漫画风格布局的页面，每个单独提供异步的AIGC能力配置，在RA/SD中你可以有趣的摆完这个插件的能力。唯一要注意的是，自动化的一些内容前提需要配置正确。请仔细阅读相关配置内容。]]></description><category></category></item><item><title><![CDATA[4.1-4 SadTalker数字人 语音和嘴唇对应的方案]]></title><link>https://blog.csdn.net/RamendeusStudio/article/details/146372148</link><guid>https://blog.csdn.net/RamendeusStudio/article/details/146372148</guid><author>RamendeusStudio</author><pubDate>Wed, 19 Mar 2025 15:29:33 +0800</pubDate><description><![CDATA[SadTalker是一个强大的数字人相关的RA/SD插件。它本身是一个非常独立的产品。你只需要提供一段视频，一段文字，简单的配置，在RA/SD中简单的生成即可。视频中人物的嘴唇很好的应对了你要发声的文字内容。效果很赞。仔细学习后体验下吧。]]></description><category></category></item><item><title><![CDATA[4.1-1 IS-NET-Pro视频转图片的插件]]></title><link>https://blog.csdn.net/RamendeusStudio/article/details/146372106</link><guid>https://blog.csdn.net/RamendeusStudio/article/details/146372106</guid><author>RamendeusStudio</author><pubDate>Wed, 19 Mar 2025 15:28:24 +0800</pubDate><description><![CDATA[IS-NET-Pro这个插件真的让人惊讶，可以视频转帧图片，也可以将帧图片序列转换成视频。同时还有抠图等功能。当然你需要了解一些视频和图片关系的基本概念，比如一帧视频对应了多少个图片是由FPS决定的。这个插件在启动的时候，会下载一个模型。RA中已经默认帮你下载好。我们将准备好的目录给出，设定输出视频的FPS。我们主要介绍视频转序列帧。]]></description><category></category></item><item><title><![CDATA[4.1-3 制作光影幻术]]></title><link>https://blog.csdn.net/RamendeusStudio/article/details/146372073</link><guid>https://blog.csdn.net/RamendeusStudio/article/details/146372073</guid><author>RamendeusStudio</author><pubDate>Wed, 19 Mar 2025 15:27:24 +0800</pubDate><description><![CDATA[本文不是介绍一个单一的插件，而是一个组合使用。涵盖了Segmention插件和GroundingDINO的使用，ControlNet的使用和QRPattern模型的使用.需要勾选GroundingDINO，然后在output中生成的3张结果mask图中选择一张。首先使用Segment Anything插件，将一个图片中人物的造型，弄出一个蒙版来。看的出来，是不是若影若仙风景中有个女子的轮廓？最大1，值越大，最终效果约明显。是不是这么美丽的一副风景画，中间是一个刚才我们设定的美女轮廓？这样的话，感觉也可以。]]></description><category></category></item><item><title><![CDATA[大语言模型的压缩技术]]></title><link>https://blog.csdn.net/RamendeusStudio/article/details/146334373</link><guid>https://blog.csdn.net/RamendeusStudio/article/details/146334373</guid><author>RamendeusStudio</author><pubDate>Wed, 19 Mar 2025 00:00:00 +0800</pubDate><description><![CDATA[尽管人们对越来越大的语言模型一直很感兴趣，但，而对边缘计算日益增长的兴趣促使我们使用小型语言获得不错的结果。压缩技术提供了一种替代方法。在本文中，我将解释这些技术，并提供一些简单的代码片段作为示例。模型压缩是在不影响机器学习模型有效性的情况下最小化其大小的行为。由于大型神经网络经常因过度参数化而包含冗余计算单元，因此这种方法对它们非常有效。压缩意味着减少参数数量或整体内存占用，从而减小模型大小（例如从 10 GB 到 9 GB）。]]></description><category></category></item><item><title><![CDATA[AI教我做事之RAG开发-21 RAGFlow深度研究]]></title><link>https://blog.csdn.net/RamendeusStudio/article/details/146334209</link><guid>https://blog.csdn.net/RamendeusStudio/article/details/146334209</guid><author>RamendeusStudio</author><pubDate>Tue, 18 Mar 2025 10:07:05 +0800</pubDate><description><![CDATA[RAGFlow 是一个开源的检索增强生成（Retrieval-Augmented Generation, RAG）引擎，基于深度文档理解，结合大型语言模型（LLM）提供准确的问答能力，并支持复杂格式数据的引用。它的设计目标是为各种规模的企业提供流线型的 RAG 工作流，增强 AI 驱动的交互。通过研究RAGFlow 官方文档和GitHub 仓库，可以发现 RAGFlow 提供了 HTTP API 和 Python SDK，方便开发者集成到应用中。]]></description><category></category></item><item><title><![CDATA[AI教我做事之RAG开发-22 RAG平台框架研究和对比]]></title><link>https://blog.csdn.net/RamendeusStudio/article/details/146334133</link><guid>https://blog.csdn.net/RamendeusStudio/article/details/146334133</guid><author>RamendeusStudio</author><pubDate>Tue, 18 Mar 2025 10:04:54 +0800</pubDate><description><![CDATA[概述：RAGFlow 是一个开源 RAG 引擎，专注于深度文档理解和简化的工作流程设计，适合企业快速构建基于检索增强生成的问答系统。功能和特性支持文档检索、问答和知识图谱提取。提供用户友好的图形界面。支持复杂格式数据的处理和与 LLM 的集成。架构：基于 Python，采用模块化设计。易用性：界面直观，配置简单，适合初学者和快速部署。性能：在中等规模数据上表现良好，但处理超大规模数据时可能需要优化。可扩展性：支持一定程度的定制，但扩展性相对有限。社区支持。]]></description><category></category></item><item><title><![CDATA[AI教我做事之RAG开发-23 RAG框架之Pathway平台框架研究]]></title><link>https://blog.csdn.net/RamendeusStudio/article/details/146334007</link><guid>https://blog.csdn.net/RamendeusStudio/article/details/146334007</guid><author>RamendeusStudio</author><pubDate>Tue, 18 Mar 2025 10:02:34 +0800</pubDate><description><![CDATA[Pathway 是一个高性能、低延迟的 Python ETL（Extract, Transform, Load）框架，专为流处理、实时分析、大型语言模型（LLM）管道以及检索增强生成（RAG）设计。它提供了一个简单易用的 Python API，开发者可以无缝集成常用的 Python 机器学习库，例如 LangChain 或其他嵌入模型。Pathway 的代码设计兼顾开发和生产环境，能够高效处理批处理和流式数据。官网地址：https://pathway.com/]]></description><category></category></item><item><title><![CDATA[人类和AI的能力评测和详细对比]]></title><link>https://blog.csdn.net/RamendeusStudio/article/details/146309645</link><guid>https://blog.csdn.net/RamendeusStudio/article/details/146309645</guid><author>RamendeusStudio</author><pubDate>Mon, 17 Mar 2025 10:51:26 +0800</pubDate><description><![CDATA[BEARCUBS的基准测试，旨在评估具备计算机使用能力的网络代理在实时网络环境中的信息搜索和多模态交互能力。文档详细阐述了BEARCUBS的设计理念、构建过程、实验结果及当前代理的局限性，强调其通过实时性和多模态性区别于现有基准的创新性。通过人类与代理的性能对比，文档指出现有代理在可靠来源选择和多模态能力上的不足，并提出了改进建议。BEARCUBS通过定期更新保持挑战性，为未来网络代理研究提供了重要参考。]]></description><category></category></item><item><title><![CDATA[2Img.ai的AIGC课程-5-27 临摹大师-IP-Adapter]]></title><link>https://blog.csdn.net/RamendeusStudio/article/details/146307785</link><guid>https://blog.csdn.net/RamendeusStudio/article/details/146307785</guid><author>RamendeusStudio</author><pubDate>Mon, 17 Mar 2025 09:50:16 +0800</pubDate><description><![CDATA[名称中的 IP 指的是 Image Prompt 图像提示，它和 T2I-Adapter 一样是一款小型模型，但是主要用来提升文生图模型的图像提示能力。IP-Adapter 自 9 月 8 日发布后收到广泛好评，因为它在使用图生图作为参考时，对画面内容的还原十分惊艳，效果类似 Midjourney 的 V 按钮。IP Adapter比reference的效果要好，而且会快很多，适配于各种stable diffusion模型，还能和controlnet一起用。叠加之后， 这个人脸的角度也相似了吧。]]></description><category></category></item><item><title><![CDATA[2Img.ai的AIGC课程-5-26 黑白照片上色-Recolor]]></title><link>https://blog.csdn.net/RamendeusStudio/article/details/146307765</link><guid>https://blog.csdn.net/RamendeusStudio/article/details/146307765</guid><author>RamendeusStudio</author><pubDate>Mon, 17 Mar 2025 09:49:30 +0800</pubDate><description><![CDATA[当然带来的效果质量，只能说中等。当然配上强化要求的关键字，可以针对不同的图片和区域，强化某些部位的颜色展示。就需要你的才华的发挥了。实际上我们针对颜色的处理可以使用语义分割，或者边缘检测后单独处理，reColor相对方便的内置算法，帮我们自动的一体化处理。ControlNet中的 Tile/Blur 中有个上色的与预处理器。重要心得， 模型的不同对于色系影响不是非常大。这里我给的是一张老建筑的照片。你可以给一张黑白色的人物照片，可能效果更明显。比如下图，我用几个高质量的。需要注意，此时的模型要选择。]]></description><category></category></item><item><title><![CDATA[2Img.ai的AIGC课程-5-25 艺术二维码制作]]></title><link>https://blog.csdn.net/RamendeusStudio/article/details/146307740</link><guid>https://blog.csdn.net/RamendeusStudio/article/details/146307740</guid><author>RamendeusStudio</author><pubDate>Mon, 17 Mar 2025 09:48:50 +0800</pubDate><description><![CDATA[之前我们其实也有一节艺术二维码的制作课程。本节和它的区别在于，我们不适用额外的独立模型，而是使用一个ControlNet中的预处理器和控制算法参数的调节，实现同样的效果。总体来看用独立模型能力的方式生成的二维码更好看些，控制力更强，效果更好。但本节仅使用ControlNet也能达到类似的效果也不失为一种额外的方法。本节主要介绍ControlNet中的艺术二维码制作。第二个这样配置 ， 2个配置面板参考图都要用最原始的QRCode。上一节我们介绍了ControlNet中的T2IA自适应。]]></description><category></category></item><item><title><![CDATA[主流向量数据库对比]]></title><link>https://blog.csdn.net/RamendeusStudio/article/details/146237425</link><guid>https://blog.csdn.net/RamendeusStudio/article/details/146237425</guid><author>RamendeusStudio</author><pubDate>Fri, 14 Mar 2025 00:00:00 +0800</pubDate><description><![CDATA[开源状态：是否为开源，影响灵活性和社区贡献。成本：是否涉及使用费用，特别关注云服务的定价模型。扩展性：数据库处理向量数量的能力，分为高（数十亿向量）和非常高（数十亿以上）。性能：包括查询时间和索引时间，基于行业基准测试如 ANN Benchmarks 和 VectorDBBench。支持数据类型：除了向量和元数据，是否支持其他类型如 JSON、数组等。ML 集成：是否支持与机器学习框架（如 PyTorch、TensorFlow）和嵌入模型（如 Hugging Face、OpenAI）的集成。易用性。]]></description><category></category></item><item><title><![CDATA[5-10 借用ControlNet模型制作艺术二维码]]></title><link>https://blog.csdn.net/RamendeusStudio/article/details/146237338</link><guid>https://blog.csdn.net/RamendeusStudio/article/details/146237338</guid><author>RamendeusStudio</author><pubDate>Fri, 14 Mar 2025 00:00:00 +0800</pubDate><description><![CDATA[上一节中我们介绍了ControlNet中使用OpenPose插件的能力本节我们介绍如何用ControlNet来制作艺术性的二维码。大家学习过我们的初级课程的化，应该还记得有标准二维码制作的课程。具体见：4-23 QRTookit 二维码生成。本文在这个基础之上使用一些不同的方式，比如LoRA模型的套用，卡通大模型的混合等实现更加艺术呈现的艺术二维码。把传统古板的不那么好看的传统二维码，变成有各种色彩和有趣画面的艺术二维码总是一种更有趣，更好的选择。]]></description><category></category></item><item><title><![CDATA[5-27 临摹大师-IP-Adapter]]></title><link>https://blog.csdn.net/RamendeusStudio/article/details/146237282</link><guid>https://blog.csdn.net/RamendeusStudio/article/details/146237282</guid><author>RamendeusStudio</author><pubDate>Fri, 14 Mar 2025 00:00:00 +0800</pubDate><description><![CDATA[名称中的 IP 指的是 Image Prompt 图像提示，它和 T2I-Adapter 一样是一款小型模型，但是主要用来提升文生图模型的图像提示能力。IP-Adapter 自 9 月 8 日发布后收到广泛好评，因为它在使用图生图作为参考时，对画面内容的还原十分惊艳，效果类似 Midjourney 的 V 按钮。IP Adapter比reference的效果要好，而且会快很多，适配于各种stable diffusion模型，还能和controlnet一起用。叠加之后， 这个人脸的角度也相似了吧。]]></description><category></category></item><item><title><![CDATA[5-24 色彩与风格——T2IA自适应]]></title><link>https://blog.csdn.net/RamendeusStudio/article/details/146237202</link><guid>https://blog.csdn.net/RamendeusStudio/article/details/146237202</guid><author>RamendeusStudio</author><pubDate>Fri, 14 Mar 2025 00:00:00 +0800</pubDate><description><![CDATA[T2I-Adapter 的特点是体积小，参数级只有 77M，但对图像的控制效果已经很好，且就在 9 月 8 日，它们针对 SDXL 训练的控图模型刚刚发布，是目前最推荐用于 SDXL 的 ControlNet 模型，但需要注意的是 SDXL 类模型对硬件要求较高，官方建议至少需要 15GB 的显卡内存，想体验的小伙伴可在下面地址中自行下载安装到本地。名称中 T2I 指的是的 text-to-image，即我们常说的文生图，而 Adapter 是适配器的意思。RA/SD 衍生者AI训练营。]]></description><category></category></item><item><title><![CDATA[5-26 黑白照片上色-Recolor]]></title><link>https://blog.csdn.net/RamendeusStudio/article/details/146237246</link><guid>https://blog.csdn.net/RamendeusStudio/article/details/146237246</guid><author>RamendeusStudio</author><pubDate>Thu, 13 Mar 2025 17:18:16 +0800</pubDate><description><![CDATA[当然带来的效果质量，只能说中等。当然配上强化要求的关键字，可以针对不同的图片和区域，强化某些部位的颜色展示。就需要你的才华的发挥了。实际上我们针对颜色的处理可以使用语义分割，或者边缘检测后单独处理，reColor相对方便的内置算法，帮我们自动的一体化处理。ControlNet中的 Tile/Blur 中有个上色的与预处理器。重要心得， 模型的不同对于色系影响不是非常大。这里我给的是一张老建筑的照片。你可以给一张黑白色的人物照片，可能效果更明显。比如下图，我用几个高质量的。需要注意，此时的模型要选择。]]></description><category></category></item><item><title><![CDATA[5-21 绘图与造字]]></title><link>https://blog.csdn.net/RamendeusStudio/article/details/146237171</link><guid>https://blog.csdn.net/RamendeusStudio/article/details/146237171</guid><author>RamendeusStudio</author><pubDate>Thu, 13 Mar 2025 17:17:01 +0800</pubDate><description><![CDATA[所谓绘图和造字，核心原理也是将文字或者绘图以一个参照图的形式，中间使用ControlNet对应的分割，影响逻辑，和对应的算法。影响到最终生成的图的目的。ControlNet中打开Canny边缘检测，选择我们手写的那张图作为边缘检测的参考。这种特殊的使用，实际上针对实际的业务需求有更明确的效力。上一节我们介绍了如何在ControlNet下制作三维重建。这一节我们主要介绍ControlNet中的绘图与造字。RA/SD 衍生者AI训练营。我们手写一个字，像这样。]]></description><category></category></item></channel></rss>