<?xml version="1.0" encoding="utf-8" ?><rss version="2.0"><channel><title><![CDATA[FJN110的博客]]></title><description><![CDATA[]]></description><link>https://blog.csdn.net/FJN110</link><language>zh-cn</language><generator>https://blog.csdn.net/</generator><copyright><![CDATA[Copyright &copy; FJN110]]></copyright><item><title><![CDATA[小白系列·SOTA论文复现：GaussianBeV（3D高斯BEV分割）+ REVFormer（可逆Transformer）原理与代码实战｜全流程·疑难解答]]></title><link>https://blog.csdn.net/FJN110/article/details/163213723</link><guid>https://blog.csdn.net/FJN110/article/details/163213723</guid><author>FJN110</author><pubDate>Sun, 26 Jul 2026 12:21:34 +0800</pubDate><description><![CDATA[想象一下，你想要在电脑里重现你眼前的房间。旧方法（游戏引擎）：你需要像《我的世界》一样，用无数个微小的“三角面片”去“搭建”这个房间。桌子是一个个方块，水杯是一个个圆柱体。这个过程非常繁琐，而且很难表现“柔软”的物体，比如窗帘的褶皱、水杯的透明感、或者空气中的尘埃。新方法 (3D GS)：你不“搭建”了。你直接在空中释放了数百万个微小、半透明、带颜色的“魔法烟雾团”。3D GS 的核心位置(X, Y, Z)：它在3D空间的哪里。大小和形状：它是一个完美的圆球，还是一个被压扁的椭球？颜色。]]></description><category></category></item><item><title><![CDATA[毕业设计级实战：Matlab 指纹识别系统开发（小白系列）｜图像增强→细化→特征提取→修复·全流程·疑难解答]]></title><link>https://blog.csdn.net/FJN110/article/details/163213634</link><guid>https://blog.csdn.net/FJN110/article/details/163213634</guid><author>FJN110</author><pubDate>Sun, 26 Jul 2026 12:20:06 +0800</pubDate><description><![CDATA[从简单的图像预处理，到精准的细节点提取，再到智能的指纹修复——通过这一系列操作，你会发现指纹识别技术并没有那么遥不可及。它本质上是**“让电脑理解指纹的特征，并利用这些特征解决实际问题”**。现在，你可以尝试用自己的指纹照片来测试代码，看看电脑能“看见”多少细节点；也可以故意给指纹图像添加一些“残缺”，测试修复算法的效果。随着你对这些技术的深入理解，你还可以探索更复杂的应用，比如将指纹识别集成到自己的小项目中，或是优化算法让识别更精准。]]></description><category></category></item><item><title><![CDATA[小白系列·图像超分双雄：SRGAN vs Real-ESRGAN 原理剖析 + Paddle/GitHub 实战｜从模糊到 4K·全流程·疑难解答]]></title><link>https://blog.csdn.net/FJN110/article/details/163213601</link><guid>https://blog.csdn.net/FJN110/article/details/163213601</guid><author>FJN110</author><pubDate>Sun, 26 Jul 2026 12:16:22 +0800</pubDate><description><![CDATA[从SRGAN的“对抗+感知”双损失设计，到Real-ESRGAN的“真实退化模拟+RRDBNet”升级，你会发现图像超分技术的核心是“让机器理解并还原人类视觉的真实感”。现在，拿起你手中的模糊老照片或低清图片，按照教程动手试试吧！无论是修复家族老照片、让网上下载的低清图变清晰，还是探索超分模型的微调与创新，你都已经迈出了成为“图像超分达人”的第一步。未来，随着技术的发展，图像超分还将在更多领域发光发热——视频超分、实时超分、跨模态超分……而你，已经站在了这个技术浪潮的起点。]]></description><category></category></item><item><title><![CDATA[【小白系列】图像超分辨率实战：用飞桨 PaddlePaddle 实现 Sub-Pixel 技术，让低清图秒变高清｜全流程拆解 + 疑难解答 其他可选变体：]]></title><link>https://blog.csdn.net/FJN110/article/details/163213544</link><guid>https://blog.csdn.net/FJN110/article/details/163213544</guid><author>FJN110</author><pubDate>Sun, 26 Jul 2026 12:15:20 +0800</pubDate><description><![CDATA[图像超分辨率（Super-Resolution，简称SR）是指将低分辨率（LR）图像恢复为高分辨率（HR）图像的技术。老照片修复：让泛黄模糊的旧照片重现清晰细节；视频增强：提升低画质视频的清晰度；监控图像优化：让监控画面中的细节（如车牌、人脸）更清晰。而Sub-Pixel卷积是实现实时超分辨率的关键技术之一，它能在保证精度的同时，大幅降低计算量，非常适合在普通硬件上运行。通过本文的教程，你已经掌握了Sub-Pixel卷积的原理和基于飞桨PaddlePaddle的超分模型实现流程。]]></description><category></category></item><item><title><![CDATA[毕业设计级项目：手机端AI应用开发全记录（小白系列）｜模型转换→端侧部署→交互实现·全流程保姆级教程 + 疑难解答]]></title><link>https://blog.csdn.net/FJN110/article/details/163213384</link><guid>https://blog.csdn.net/FJN110/article/details/163213384</guid><author>FJN110</author><pubDate>Sun, 26 Jul 2026 12:13:16 +0800</pubDate><description><![CDATA[移动端AI应用开发的核心是模型转换、工程集成和功能扩展。通过本文的教程，你已经掌握了从训练好的模型到手机App的全流程——从选择工具（Paddle Lite）、转换模型，到Android工程创建、代码编写，再到功能扩展和性能优化。现在，你可以尝试将自己感兴趣的AI模型（如图像分割、目标检测）部署到手机上，打造更实用的App。无论是让手机能识别植物种类，还是能检测宠物的情绪，移动端AI都能让你的创意落地。动手试试吧，你的第一款移动端AI App即将诞生！]]></description><category></category></item><item><title><![CDATA[毕业设计级实战：树莓派4B + Paddle Lite 口罩识别智能门禁（小白系列）｜模型转换→摄像头接入→GPIO控制·全流程·疑难解答]]></title><link>https://blog.csdn.net/FJN110/article/details/163213341</link><guid>https://blog.csdn.net/FJN110/article/details/163213341</guid><author>FJN110</author><pubDate>Sun, 26 Jul 2026 12:06:39 +0800</pubDate><description><![CDATA[通过本文的教程，你已经掌握了**“硬件选型→环境搭建→模型转换→功能实现→优化迭代”**的完整流程。从树莓派的系统安装，到Paddle Lite模型的转换与推理，再到继电器的门禁控制，每一步都清晰可操作。现在，你可以根据自己的需求扩展功能：比如添加语音提示（“请佩戴口罩”）、将识别结果上传到云端、或结合人脸识别实现更精准的门禁管理。嵌入式AI的世界充满可能性，而你已经迈出了成为“智能硬件开发者”的第一步。赶紧动手，给你的门禁装上“智慧之眼”吧！]]></description><category></category></item><item><title><![CDATA[AI 创意入门：零基础搞懂风格迁移 + GAN（小白系列）｜从名画滤镜到人脸生成·全流程·附疑难解答]]></title><link>https://blog.csdn.net/FJN110/article/details/163213216</link><guid>https://blog.csdn.net/FJN110/article/details/163213216</guid><author>FJN110</author><pubDate>Sun, 26 Jul 2026 12:02:09 +0800</pubDate><description><![CDATA[风格迁移的核心是**“内容保留，风格替换”**。比如，把城市建筑的“内容”，套上印象派油画的“风格”，最终得到一幅既保留建筑原貌，又充满艺术感的新作品（如图中“Content（内容图）”“Style（风格图）”到“Generated Image（生成图）”的转变）。它就像给图像换了件“艺术外衣”，却没改变它的“灵魂”。layers = {'21': 'conv4_2', # 内容层x = image生成器（Generator）：负责“造假”，从随机噪声中生成逼真的假数据（比如假图像、假文本）。]]></description><category></category></item><item><title><![CDATA[AI 唤醒旧时光：用 DeOldify 给黑白老照片上色（小白系列）｜从环境搭建到效果调优·全流程·附疑难解答]]></title><link>https://blog.csdn.net/FJN110/article/details/163213176</link><guid>https://blog.csdn.net/FJN110/article/details/163213176</guid><author>FJN110</author><pubDate>Sun, 26 Jul 2026 12:00:01 +0800</pubDate><description><![CDATA[DeOldify的艺术效果增强技术让每个人都能成为历史的色彩修复师。从19世纪的肖像照到中期的家庭相册，那些曾被时间褪色的记忆，正通过技术重新焕发生机。随着NGAN技术的不断优化，未来的色彩还原将更加精准，甚至能根据历史资料自动校正色彩偏差。现在就行动起来，找出家中的老照片，用DeOldify赋予它们新的生命。别忘了分享你的修复成果，让更多人看到历史本来的色彩。下一期我们将深入探讨视频上色技术，教你如何让老电影片段重获色彩流动的魅力。项目地址：通过获取完整代码库，开始你的色彩修复之旅。]]></description><category></category></item><item><title><![CDATA[从零开始：RK3399开发板TensorFlow深度学习环境搭建与测试实战——系统烧录、依赖安装与Hello World验证全流程（小白指南+疑难解答）]]></title><link>https://blog.csdn.net/FJN110/article/details/163197586</link><guid>https://blog.csdn.net/FJN110/article/details/163197586</guid><author>FJN110</author><pubDate>Sat, 25 Jul 2026 20:01:55 +0800</pubDate><description><![CDATA[通过以上步骤，你已成功在RK3399开发板上搭建并验证了TensorFlow环境，还完成了一个简单的图像识别实战。这只是嵌入式AI的起点，你可以继续探索更复杂的模型、更丰富的应用场景，让RK3399成为你玩转边缘智能的得力工具！是一款性能强劲的嵌入式硬件，拥有双Cortex-A72大核和四Cortex-A53小核，还集成了专门的AI加速单元，非常适合运行轻量级深度学习模型。这段代码的功能是导入TensorFlow库，定义两个常量并输出它们的和，用于验证TensorFlow环境是否正常。]]></description><category></category></item><item><title><![CDATA[从零构建人脸识别系统：Qt与百度AI的实战融合——环境搭建、API调用、摄像头采集与界面开发全流程（小白指南+疑难解答）]]></title><link>https://blog.csdn.net/FJN110/article/details/163197568</link><guid>https://blog.csdn.net/FJN110/article/details/163197568</guid><author>FJN110</author><pubDate>Sat, 25 Jul 2026 20:00:31 +0800</pubDate><description><![CDATA[当你运行程序，看着摄像头里的人脸被精准框出，属性信息实时更新，甚至能分辨出两张照片是否为同一人时，你已经完成了从“会写C++”到“能开发AI应用”的关键跨越。这个项目虽然简单，却包含了现代应用开发的核心要素：图形界面设计、网络通信、第三方API集成、多线程处理和图像处理。Qt的跨平台特性让你的成果不止于桌面，未来可以轻松移植到嵌入式设备；百度AI的接口则让你无需深入机器学习就能使用前沿的人脸识别技术。这种“框架+API”的开发模式，正是快速实现创意的有效路径。]]></description><category></category></item><item><title><![CDATA[从0到1掌握大模型位置编码：RoPE、T5、ALiBi 原理解析与 PyTorch 实现全流程（小白指南+疑难解答）]]></title><link>https://blog.csdn.net/FJN110/article/details/163197558</link><guid>https://blog.csdn.net/FJN110/article/details/163197558</guid><author>FJN110</author><pubDate>Sat, 25 Jul 2026 19:59:20 +0800</pubDate><description><![CDATA[1. 加载基础模型# 2. 替换注意力模块为带Rotary的版本# 提取Q、K、V# 对Q、K应用Rotary编码（这里简化了位置生成逻辑，实际需对齐模型输入）# 放回原注意力模块计算# 3. 替换模型的注意力模块# 4. 测试模型print("添加Rotary后的模型输出形状：", outputs.last_hidden_state.shape)]]></description><category></category></item><item><title><![CDATA[从0到1掌握YOLO-World：开放词汇多模态目标检测与零样本实战全流程（小白指南+疑难解答）]]></title><link>https://blog.csdn.net/FJN110/article/details/163197551</link><guid>https://blog.csdn.net/FJN110/article/details/163197551</guid><author>FJN110</author><pubDate>Sat, 25 Jul 2026 19:58:23 +0800</pubDate><description><![CDATA[想象一下，你给模型一张“公园”的图片，再输入文字“红色的郁金香”，它能直接在图中框出所有红色郁金香的位置——这就是多模态目标检测：结合图像视觉信息和文本语义信息，同时完成“是什么”（分类）和“在哪里”（定位）的任务。传统目标检测（如YOLOv5、YOLOv8）只能识别预定义的类别（比如训练时学过“猫”“狗”），但多模态目标检测摆脱了“类别预定义”的限制，只要文本能描述，它就能检测，这就是“开放词汇检测（Open-Vocabulary Detection）”的魅力。]]></description><category></category></item><item><title><![CDATA[从0到1掌握ms-swift+Qwen2-VL：多模态大模型SFT微调与推理部署全流程实战（小白指南+疑难解答）]]></title><link>https://blog.csdn.net/FJN110/article/details/163197541</link><guid>https://blog.csdn.net/FJN110/article/details/163197541</guid><author>FJN110</author><pubDate>Sat, 25 Jul 2026 19:57:35 +0800</pubDate><description><![CDATA[如果想让Qwen2-VL适配自己的业务（比如“工业零件缺陷检测描述”），可以用**LoRA（低秩适应）**技术微调模型。收集至少500张带标注的图像（如“缺陷螺丝.jpg”）；为每张图编写文本描述（如“红色的螺丝，表面有裂纹缺陷”）；将数据整理成JSON格式，示例：[{"query": "<image>请描述这张图的缺陷", "response": "红色螺丝表面有裂纹", "image": "缺陷螺丝1.jpg"},]]></description><category></category></item><item><title><![CDATA[从0到1掌握Research Agent：让大模型成为你的智能科研助手全流程实战（小白指南+疑难解答）]]></title><link>https://blog.csdn.net/FJN110/article/details/163197528</link><guid>https://blog.csdn.net/FJN110/article/details/163197528</guid><author>FJN110</author><pubDate>Sat, 25 Jul 2026 19:55:46 +0800</pubDate><description><![CDATA[创建task: "研究生成式AI对医疗行业的影响，包括应用场景、技术挑战、市场规模预测"sub_tasks:- "生成式AI医疗应用场景分类"- "关键技术挑战（数据隐私、模型准确性等）"- "2025-2030年市场规模预测及驱动因素"如果要研究“半导体行业趋势”这类垂直领域，需要对Agent进行定制化调整。从基础的Search-O1到专业化的MetaGPT Research Agent，我们已经走完了智能科研助手的完整构建流程。]]></description><category></category></item><item><title><![CDATA[从0到1掌握Qwen3-VL强化微调：打造定制化多模态大模型全流程实战（小白指南+疑难解答）]]></title><link>https://blog.csdn.net/FJN110/article/details/163197508</link><guid>https://blog.csdn.net/FJN110/article/details/163197508</guid><author>FJN110</author><pubDate>Sat, 25 Jul 2026 19:52:49 +0800</pubDate><description><![CDATA[从SFT到GRPO，我们已经走完了Qwen3-VL强化微调的完整流程。这项技术的核心价值是让模型从“能回答”进化到“会思考、懂偏好”——无论是商业场景的效率提升，还是创意领域的价值创造，强化微调都能让多模态模型发挥更大潜力。现在，不妨从一个小的图文偏好数据集开始，尝试微调一个“宠物识别与描述”的模型，再逐步拓展到工业、教育等实战场景。多模态AI的人性化落地，正从强化微调开始，而你已经掌握了入门的方法——接下来，就用你的创意去解锁更多可能吧！]]></description><category></category></item><item><title><![CDATA[从0到1掌握Qwen2-VL：多模态图文理解与视觉问答(VQA)全流程实战（小白指南+疑难解答）]]></title><link>https://blog.csdn.net/FJN110/article/details/163197498</link><guid>https://blog.csdn.net/FJN110/article/details/163197498</guid><author>FJN110</author><pubDate>Sat, 25 Jul 2026 19:51:40 +0800</pubDate><description><![CDATA[从技术原理到实战落地，我们已经走完了Qwen2-VL的完整学习路径。它不仅是一个模型，更是你在多模态领域建立技术壁垒的“利器”——无论是科研探索，还是工业落地，它的“图文理解+生成”能力都能让你快人一步。现在，不妨从描述一张生活照开始，再尝试视觉问答、批量分析等任务。多模态AI的未来充满机遇，而你已经掌握了入门的钥匙——接下来，就用你的创意去开拓更多可能吧！]]></description><category></category></item><item><title><![CDATA[从0到1掌握InternVL-2.5：多模态图文理解与视觉问答(VQA)全流程实战（小白指南+疑难解答）]]></title><link>https://blog.csdn.net/FJN110/article/details/163197481</link><guid>https://blog.csdn.net/FJN110/article/details/163197481</guid><author>FJN110</author><pubDate>Sat, 25 Jul 2026 19:50:36 +0800</pubDate><description><![CDATA[从技术原理到实战落地，我们已经走完了internvl-2.5的完整学习路径。它不仅是一个模型，更是你踏入多模态大模型领域的“通行证”——无论是做科研探索，还是落地工业级应用，它的“图文理解+生成”能力都能让你先人一步。现在，不妨从描述身边的一张照片开始，再尝试视觉问答、批量分析等任务。多模态AI的未来充满想象，而你已经掌握了入门的技能——接下来，就用你的创意去解锁更多可能吧！]]></description><category></category></item><item><title><![CDATA[从0到1掌握CLIP：多模态图文理解与零样本分类实战全流程（小白指南+疑难解答）]]></title><link>https://blog.csdn.net/FJN110/article/details/163197472</link><guid>https://blog.csdn.net/FJN110/article/details/163197472</guid><author>FJN110</author><pubDate>Sat, 25 Jul 2026 19:48:34 +0800</pubDate><description><![CDATA[CLIP的预训练需要超大规模图文对数据（如LAION-400M）和超强算力，普通开发者很难复现。但可以基于开源的预训练模型做领域微调收集自己领域的“图文对”（如“工业零件图+缺陷描述”）；用对比学习的思路微调模型，让它更适配特定场景。从技术原理到实战落地，我们已经走完了CLIP的完整学习路径。它不仅是一个模型，更是多模态AI的“思维方式”——让图像和文本在语义层面“对话”。现在，不妨从识别身边的物品开始，再尝试图文检索、零样本分类等任务。]]></description><category></category></item><item><title><![CDATA[从0到1玩转多模态：PaddleMIX环境搭建与图文理解+文生图实战全流程（小白指南+疑难解答）]]></title><link>https://blog.csdn.net/FJN110/article/details/163197465</link><guid>https://blog.csdn.net/FJN110/article/details/163197465</guid><author>FJN110</author><pubDate>Sat, 25 Jul 2026 19:47:27 +0800</pubDate><description><![CDATA[简单来说，多模态AI就是让模型同时处理“图像、文本、音频、视频”等多种类型的数据。给它一张猫的图片+“可爱的橘猫”文字，它能识别出“这是橘猫”（多模态理解给它文字“赛博朋克风格的城市夜景”，它能生成对应的图像（多模态生成这种技术打破了“单一数据类型”的限制，让AI更接近人类的感知方式。如果想让模型适配自己的业务场景（比如“工业零件缺陷检测描述”），可以自定义训练BLIP-2。]]></description><category></category></item><item><title><![CDATA[从0到1实战：Windows11 Docker + RK3588部署YOLOv8-Pose人体姿态检测全流程指南]]></title><link>https://blog.csdn.net/FJN110/article/details/163197449</link><guid>https://blog.csdn.net/FJN110/article/details/163197449</guid><author>FJN110</author><pubDate>Sat, 25 Jul 2026 19:46:01 +0800</pubDate><description><![CDATA[通过以上步骤，你已成功在RK3588开发板上实现了YOLOv8-Pose人体姿态检测。现在，你可以根据实际需求，将这一技术应用到健身、工业、娱乐等场景中，打造属于自己的边缘AI应用！，这篇教程将带你用Windows11 Docker环境编译YOLOv8-Pose模型，并部署到开发板上运行。YOLOv8-Pose会输出人体关键节点的坐标（如头部、肩部、四肢关节等），并在图像上用彩色线条连接这些节点，形成人体姿态骨架。执行后，会在终端输出检测结果，并生成标注了人体姿态关键点的图片。]]></description><category></category></item></channel></rss>