<?xml version="1.0" encoding="utf-8" ?><rss version="2.0"><channel><title><![CDATA[曾小健3的博客]]></title><description><![CDATA[]]></description><link>https://blog.csdn.net/zengxiaojian3</link><language>zh-cn</language><generator>https://blog.csdn.net/</generator><copyright><![CDATA[Copyright &copy; zengxiaojian3]]></copyright><item><title><![CDATA[PlantCLEF 2024 植物识别]]></title><link>https://blog.csdn.net/zengxiaojian3/article/details/144220621</link><guid>https://blog.csdn.net/zengxiaojian3/article/details/144220621</guid><author>zengxiaojian3</author><pubDate>Tue, 03 Dec 2024 17:59:01 +0800</pubDate><description><![CDATA[该任务的主要困难在于测试数据（植被地块的高分辨率多标签图像）和训练数据（单个植物的单标签图像）之间的转换。它包含约 140 万张图像，其中还包含一些从 GBIF 平台聚合的带有可信标签的图像，以补充较少图示的物种。但是，请注意，PlantCLEF2022&23 期间使用的物种 ID 可能在此期间发生变化，因为分类学是一个活跃的研究领域，并且为。允许使用额外的数据或元数据，但前提是每次使用外部数据运行时，您都提交仅包含所提供数据的等效运行，以便进行更准确的比较。提供预先训练的模型。的植物识别平台非常活跃。]]></description><category></category></item><item><title><![CDATA[小苏打或可防治免疫系统疾病]]></title><link>https://blog.csdn.net/zengxiaojian3/article/details/144218683</link><guid>https://blog.csdn.net/zengxiaojian3/article/details/144218683</guid><author>zengxiaojian3</author><pubDate>Tue, 03 Dec 2024 16:45:14 +0800</pubDate><description><![CDATA[研究员发现当人类肠胃接触到碳酸类溶液时，会令器官和体液的免疫球蛋白浓度上升，比较有名的免疫细胞有巨噬细胞、T细胞、B细胞等等，尤其是一类被称为M1和M2的免疫细胞数量特别多。该校医学院生理学系保罗实验室的科研团队在过往的临床实验中指出，小苏打内含的抗酸性物质，可以有效平衡胃酸分泌，有效预防胃酸倒流引起的胃炎、咽喉炎，甚至是食道癌。所谓间皮细胞实则上位于人体的空腔，以细胞与细胞之间相互连接的方式形成一道紧密的膜质层，这种薄膜能够覆盖人体各个器官的表面，可以避免因剧烈运动令器官和组织相互摩擦而受伤。]]></description><category></category></item><item><title><![CDATA[什么是softmax 上下溢出问题？softmax的意义以及和logistic函数区别]]></title><link>https://blog.csdn.net/zengxiaojian3/article/details/144214772</link><guid>https://blog.csdn.net/zengxiaojian3/article/details/144214772</guid><author>zengxiaojian3</author><pubDate>Tue, 03 Dec 2024 14:55:35 +0800</pubDate><description><![CDATA[softmax 上下溢出问题？在计算机科学中，溢出（overflow）和下溢出（underflow）是指数据超出其存储类型所能表示的范围的情况。上溢出（Overflow）上溢出发生在数值超过了变量或数据类型的上限。例如，在一个8位无符号整数（范围是0到255）中，如果你尝试存储值256，就会发生上溢出。因为256超出了这个数据类型可以表示的最大值，结果可能会被截断为0（取决于具体的处理方式），这通常会导致错误的结果。2. 下溢出（Underflow）]]></description><category></category></item><item><title><![CDATA[详细说DETR，基于transformer的目标检测相关原理，GIoU]]></title><link>https://blog.csdn.net/zengxiaojian3/article/details/144214147</link><guid>https://blog.csdn.net/zengxiaojian3/article/details/144214147</guid><author>zengxiaojian3</author><pubDate>Tue, 03 Dec 2024 14:37:17 +0800</pubDate><description><![CDATA[详细说DETR，基于transformer的目标检测相关原理GPT-4oPoeDETR 是 Facebook AI Research (FAIR) 提出的一个端到端目标检测框架，它首次将 Transformer 架构 引入目标检测任务，为目标检测领域提供了一种新的范式。与传统目标检测方法（如 Faster R-CNN、YOLO 等）相比，DETR 抛弃了候选框生成、非极大值抑制（NMS）等复杂的后处理步骤，直接通过 Transformer 模型预测最终的目标边界框和类别。以下是 DETR 的详细原理、架构和]]></description><category></category></item><item><title><![CDATA[通义灵码SWE-GPT：从静态代码建模迈向软件开发过程长链推理]]></title><link>https://blog.csdn.net/zengxiaojian3/article/details/144213322</link><guid>https://blog.csdn.net/zengxiaojian3/article/details/144213322</guid><author>zengxiaojian3</author><pubDate>Tue, 03 Dec 2024 13:50:55 +0800</pubDate><description><![CDATA[📔 随着Devin的发布，国内外AI程序员迅速发展，引起了产业界和学术界的广泛关注。AI程序员通常利用LLM-based agent实现，称之为软件工程智能体。]]></description><category></category></item><item><title><![CDATA[一篇78页大模型GUI Agents全面综述~]]></title><link>https://blog.csdn.net/zengxiaojian3/article/details/144211762</link><guid>https://blog.csdn.net/zengxiaojian3/article/details/144211762</guid><author>zengxiaojian3</author><pubDate>Tue, 03 Dec 2024 12:17:59 +0800</pubDate><description><![CDATA[一个✓符号表示出版物明确涉及给定领域，而一个⃝符号表示出版物不专注于该领域但提供了相关见解。同时涵盖GUI自动化和LLM智能体的出版物被突出显示以强调。GUI Agents架构与设计原则详细介绍了大型语言模型（LLM）驱动的图形用户界面（GUI）智能体的基础架构和设计原则。架构和工作流程概述：LLM-Brained GUI智能体的架构包括多个组件，它们共同工作以解释用户指令并执行基于自然语言的任务。工作流程从用户请求开始，包括环境感知、提示工程、模型推理、动作执行和记忆利用，直至任务完成。]]></description><category></category></item><item><title><![CDATA[具身智能基础——模仿学习基础]]></title><link>https://blog.csdn.net/zengxiaojian3/article/details/144211375</link><guid>https://blog.csdn.net/zengxiaojian3/article/details/144211375</guid><author>zengxiaojian3</author><pubDate>Tue, 03 Dec 2024 12:04:09 +0800</pubDate><description><![CDATA[逆强化学习的核心在于，通过观察专家的行为轨迹来推断出一个隐含的奖励函数，解释专家为何会在不同状态下选择特定动作。我们假设专家的每一个决策都是为了最大化某种未知的奖励。逆强化学习通过构建和优化这个奖励函数，使得我们推导出的策略能够逼近专家的行为模式。首先，我们需要记录专家的轨迹，这是专家在完成任务时所经过的一系列状态和对应的动作序列。逆强化学习的目标是找到一个奖励函数，使得在这个函数下，专家的轨迹能获得更高的累积奖励。]]></description><category></category></item><item><title><![CDATA[​QwQ-32B：让AI在开源界内卷到底！]]></title><link>https://blog.csdn.net/zengxiaojian3/article/details/144199708</link><guid>https://blog.csdn.net/zengxiaojian3/article/details/144199708</guid><author>zengxiaojian3</author><pubDate>Mon, 02 Dec 2024 21:54:58 +0800</pubDate><description><![CDATA[它不仅是阿里巴巴Qwen团队最新发布的开源模型，更是AI推理界的一名“哲学学生”——深思熟虑、不耻下问，还能给你一份惊艳的数学答卷。问题：在方程 $1 + 2 * 3 + 4 * 5 + 6 * 7 + 8 * 9 = 479$ 中，添加一对括号使等式成立。无论你是技术大牛、数学爱好者，还是对AI未来充满好奇的“哲学学生”，QwQ都为你打开了一扇通往智能边界的新大门。QwQ（发音/kwju:/，像“quill”）名字萌萌哒，但它可不是来“撒娇”的。逐步拆解问题，计算当前结果，与目标值比较，发现差距。]]></description><category></category></item><item><title><![CDATA[详解llama3和llama3.1的区别和相关创新]]></title><link>https://blog.csdn.net/zengxiaojian3/article/details/144199233</link><guid>https://blog.csdn.net/zengxiaojian3/article/details/144199233</guid><author>zengxiaojian3</author><pubDate>Mon, 02 Dec 2024 21:37:20 +0800</pubDate><description><![CDATA[LLaMa3.1在多个方面相较于LLaMa3进行了显著改进，包括参数规模、上下文处理能力、多语言支持以及性能优化等。这些创新使得LLaMa3.1在自然语言处理领域具有更强的竞争力，并为未来的AI应用奠定了基础。选择使用哪一版本应根据具体需求而定，如果需要处理长文本或多语言任务，LLaMa3.1无疑是更优选择。]]></description><category></category></item><item><title><![CDATA[LLaMa3-72b和Qwen2.5-70b的主要区别和优劣在哪]]></title><link>https://blog.csdn.net/zengxiaojian3/article/details/144199203</link><guid>https://blog.csdn.net/zengxiaojian3/article/details/144199203</guid><author>zengxiaojian3</author><pubDate>Mon, 02 Dec 2024 21:32:38 +0800</pubDate><description><![CDATA[参数量：72亿参数。架构：LLaMa3系列模型基于Transformer架构，专注于提供高效的文本生成和理解能力。应用：广泛应用于自然语言处理任务，如文本生成、对话系统、问答等。总体而言，尽管LLaMa3-72B在某些生成任务上表现良好，但Qwen2.5-70B在多个关键领域（如数学推理、编程能力和长文本处理）中展现出了更强的优势。选择使用哪种模型应依据具体应用需求而定。如果需要处理复杂任务或多样化输入，Qwen2.5可能是更好的选择；而对于一般文本生成任务，LLaMa3也依然是一款强大的模型。]]></description><category></category></item><item><title><![CDATA[大厂纷纷入局，具身智能赛道未来可期]]></title><link>https://blog.csdn.net/zengxiaojian3/article/details/144199037</link><guid>https://blog.csdn.net/zengxiaojian3/article/details/144199037</guid><author>zengxiaojian3</author><pubDate>Mon, 02 Dec 2024 21:25:23 +0800</pubDate><description><![CDATA[在机床加工过程中，能够保持稳定的性能，减少误差，控制精度可达0.01mm，精准实现工件的自动抓取、上料、下料等过程的自动化操作。埃夫特基于其自研控制系统搭建，底层架构的重构，意味着机器人能够更好实现期望的运动轨迹规划动作，并在焊接、喷涂、抛光、涂胶、装配、抓取等工业场景和其他更高级的服务行业场景中，进一步融合环境感知、目标识别、决策制定等复杂功能，为机器人的自主导航、精确控制和复杂任务执行提供了强有力的支持，有望助力人形机器人、服务机器人、工业机器人更好实现复杂任务。]]></description><category></category></item><item><title><![CDATA[RAG技术深度优化：三大策略帮你打造智能回答新高度]]></title><link>https://blog.csdn.net/zengxiaojian3/article/details/144198831</link><guid>https://blog.csdn.net/zengxiaojian3/article/details/144198831</guid><author>zengxiaojian3</author><pubDate>Mon, 02 Dec 2024 21:16:49 +0800</pubDate><description><![CDATA[提高RAG生成答案的准确性需要综合考虑知识内容的优化、生成能力的提升和检索策略的改进。从知识库的结构化处理到生成与检索能力的细化优化，RAG技术的未来充满了无限可能。通过合理的技术手段，我们可以在实际应用中更好地利用RAG，为用户提供更加精准和可靠的智能问答服务。]]></description><category></category></item><item><title><![CDATA[一文看懂：如何通过人机交互流程提升业务数据分析能力]]></title><link>https://blog.csdn.net/zengxiaojian3/article/details/144198809</link><guid>https://blog.csdn.net/zengxiaojian3/article/details/144198809</guid><author>zengxiaojian3</author><pubDate>Mon, 02 Dec 2024 21:15:47 +0800</pubDate><description><![CDATA[数据查询的结果需通过图表和总结语句反馈给用户。]]></description><category></category></item><item><title><![CDATA[让AI眼里有活主动干！清华&面壁等开源主动交互Agent新范式]]></title><link>https://blog.csdn.net/zengxiaojian3/article/details/144198760</link><guid>https://blog.csdn.net/zengxiaojian3/article/details/144198760</guid><author>zengxiaojian3</author><pubDate>Mon, 02 Dec 2024 21:13:43 +0800</pubDate><description><![CDATA[同时，经过训练的模型也在误报率上有了明显的下降，尽管提供不必要的帮助的情况仍然存在。人类标注员在研究开发的标注平台上进行标注，对特定时间下，9个不同的大语言模型生成的多样化预测进行判断，并通过多数投票的方式决定某个回合用户是否具有需求，以及用户倾向于接受什么类型的任务。该研究除了提出以上开创性的主动Agent之外，还通过采集不同场景下的人类活动数据构建了一个环境模拟器，进而构建了数据集 ProactiveBench，通过训练模型获得了与人类高度一致的奖励模型，并比对了不同模型在数据集下的性能。]]></description><category></category></item><item><title><![CDATA[超越GPT-4o！开源科研神器登场，4500万篇论文检索增强生成靠谱回答]]></title><link>https://blog.csdn.net/zengxiaojian3/article/details/144198744</link><guid>https://blog.csdn.net/zengxiaojian3/article/details/144198744</guid><author>zengxiaojian3</author><pubDate>Mon, 02 Dec 2024 21:13:10 +0800</pubDate><description><![CDATA[例如：当被问及机器人学中的大型基础模型时，此响应引用了一篇具有3.07亿参数模型的论文，而截至2024年11月，机器人学中当前最大的基础模型（RT-2）具有550亿参数。团队表示，未来他们会纳入更多论文、升级检索增强算法，也会对各个领域的经典研究问题和论文进行深入整合，增强OpenScholar的专业程度。GPT-4o在90%以上的情况下都引用了不存在的论文，而OpenScholar的结果都是来自确定来源。例如，在描述特定方法时，它可能未能引用提出该方法的原始论文，而是引用了提及该方法的另一篇论文。]]></description><category></category></item><item><title><![CDATA[AI革命降速？专家称OpenAI新模型提升或微乎其微｜黑智编译]]></title><link>https://blog.csdn.net/zengxiaojian3/article/details/144161578</link><guid>https://blog.csdn.net/zengxiaojian3/article/details/144161578</guid><author>zengxiaojian3</author><pubDate>Mon, 02 Dec 2024 21:12:11 +0800</pubDate><description><![CDATA[今年6月，OpenAI的竞争对手Anthropic发布了Claude 3.5模型，Marcus在看到该模型在高级推理、编程和多语言数学等领域的边际显著提升后，认为它的表现“与其他许多模型差不多”。“对于一般知识性问题，目前我们的确看到了大语言模型（LLM）性能的停滞迹象，”企业软件公司Databricks的联合创始人兼执行主席Ion Stoica在接受《The Information》采访时表示，并补充道，“事实数据”比合成数据更为有用。过去，AI领域的快速发展很大程度上归功于新模型不断带来的性能跃升。]]></description><category></category></item><item><title><![CDATA[详解交叉注意力，和普通注意力有什么异同和优劣]]></title><link>https://blog.csdn.net/zengxiaojian3/article/details/144162245</link><guid>https://blog.csdn.net/zengxiaojian3/article/details/144162245</guid><author>zengxiaojian3</author><pubDate>Sat, 30 Nov 2024 22:21:53 +0800</pubDate><description><![CDATA[普通注意力机制（Self-Attention）普通注意力机制（又称自注意力机制）用于同一输入序列内部的元素之间的关系建模。每个元素根据其他元素的特征动态调整自己的表示。计算方式为：对于输入序列中的每个位置，生成查询（Query）、键（Key）和值（Value），通过计算查询与所有键的相似度，得到注意力权重，然后加权求和对应的值。交叉注意力机制（Cross-Attention）交叉注意力机制则用于两个不同输入序列之间的信息交互。一个序列作为查询，另一个序列提供键和值。其计算过程类似。]]></description><category></category></item><item><title><![CDATA[双编码器-单解码器架构的具体实现步骤是什么groundingDINO]]></title><link>https://blog.csdn.net/zengxiaojian3/article/details/144162220</link><guid>https://blog.csdn.net/zengxiaojian3/article/details/144162220</guid><author>zengxiaojian3</author><pubDate>Sat, 30 Nov 2024 22:17:04 +0800</pubDate><description><![CDATA[双编码器-单解码器架构通过上述步骤有效地整合了视觉和语言信息，使得GroundingDINO能够在开放集目标检测任务中表现出色。通过精细化的特征融合和动态查询选择，该模型能够适应不同类别和复杂场景，为实际应用提供了强大的支持。]]></description><category></category></item><item><title><![CDATA[groundingDINO和GroundingDINOv2的区别和优劣]]></title><link>https://blog.csdn.net/zengxiaojian3/article/details/144162153</link><guid>https://blog.csdn.net/zengxiaojian3/article/details/144162153</guid><author>zengxiaojian3</author><pubDate>Sat, 30 Nov 2024 22:12:50 +0800</pubDate><description><![CDATA[总体而言，GroundingDINOv2在多个方面相较于GroundingDINO都有所提升，尤其是在性能和应用范围上。随着技术的发展，新的版本不仅增强了现有功能，还扩展了模型在实际应用中的潜力。对于需要高精度和实时处理能力的场景，GroundingDINOv2无疑是更优的选择。]]></description><category></category></item><item><title><![CDATA[详解目标检测groundingDINO]]></title><link>https://blog.csdn.net/zengxiaojian3/article/details/144162121</link><guid>https://blog.csdn.net/zengxiaojian3/article/details/144162121</guid><author>zengxiaojian3</author><pubDate>Sat, 30 Nov 2024 22:11:17 +0800</pubDate><description><![CDATA[答案。]]></description><category></category></item></channel></rss>