<?xml version="1.0" encoding="utf-8" ?><rss version="2.0"><channel><title><![CDATA[donoot的博客]]></title><description><![CDATA[]]></description><link>https://blog.csdn.net/donoot</link><language>zh-cn</language><generator>https://blog.csdn.net/</generator><copyright><![CDATA[Copyright &copy; donoot]]></copyright><item><title><![CDATA[从零构建汽车 4S 服务管理系统：Flask + 原生 SPA 的全栈实践（含会员 VIP、NFC 刷卡收银）]]></title><link>https://blog.csdn.net/donoot/article/details/163593752</link><guid>https://blog.csdn.net/donoot/article/details/163593752</guid><author>donoot</author><pubDate>Sat, 08 Aug 2026 19:28:53 +0800</pubDate><description><![CDATA[本文介绍了基于Python Flask框架开发的汽车4S店综合服务管理系统，采用轻量化架构实现车主档案、服务工单、会员管理、支付结算等核心业务闭环。系统特色包括：1）无Node构建链的原生SPA前端；2）VIP自动升级与历史快照机制；3）NFC键盘模拟收银零驱动方案；4）MySQL行级锁保障账务安全。技术方案聚焦工程落地，通过Flask蓝图分层、SQLAlchemy ORM和响应式前端实现多端适配，支持SQLite/MySQL双数据库无缝切换。该系统为中小型门店提供可私有化部署的轻量SaaS解决方案。]]></description><category></category></item><item><title><![CDATA[别让 AI 把代码“代驾”了：零成本逃离 Trae 依赖的白嫖全攻略]]></title><link>https://blog.csdn.net/donoot/article/details/163588975</link><guid>https://blog.csdn.net/donoot/article/details/163588975</guid><author>donoot</author><pubDate>Sat, 08 Aug 2026 13:01:42 +0800</pubDate><description><![CDATA[摘要：本文针对AI编程工具免费额度耗尽后开发者面临的困境，提出了一套完整的"白嫖"解决方案。首先指导读者紧急抢救现有项目中的AI对话记录和代码注释，然后介绍了四大免费AI编程工具（通义灵码、Windsurf、Cline+Gemini API、Ollama+Continue）及其使用技巧，接着提供了日常白嫖工作流的组合搭配建议，最后强调通过文档输出、小步重构等方法来重新掌握代码主权，避免过度依赖AI导致技术能力退化。]]></description><category></category></item><item><title><![CDATA[《大话文渊慧典》：十二、致谢]]></title><link>https://blog.csdn.net/donoot/article/details/163551405</link><guid>https://blog.csdn.net/donoot/article/details/163551405</guid><author>donoot</author><pubDate>Fri, 07 Aug 2026 08:14:32 +0800</pubDate><description><![CDATA[《致谢：文渊慧典背后的无名英雄们》是一篇饱含深情的项目总结，记录了古籍数字化项目"文渊慧典"三年发展历程中的感恩清单。文章通过六个维度致谢：感谢开源社区的技术基石（PaddleOCR、PyMuPDF等），感谢研究生们用膏药和腱鞘炎换来的标注数据集，感谢王大姐等用户用"毒舌"推动产品迭代，感谢二黑和小菜等核心成员的日夜坚守，感谢家人的默默支持，最后致敬那些穿越千年的古籍文字本身。]]></description><category></category></item><item><title><![CDATA[《大话文渊慧典》：十一、最终成果展示与展望]]></title><link>https://blog.csdn.net/donoot/article/details/163544809</link><guid>https://blog.csdn.net/donoot/article/details/163544809</guid><author>donoot</author><pubDate>Thu, 06 Aug 2026 23:59:10 +0800</pubDate><description><![CDATA[摘要： 历经三年开发，文渊慧典1.0版本正式发布。该系统具备PDF拆页、版面分析、繁体中文识别等核心功能，支持离线运行，已在20家图书馆处理超21万页古籍，累计识别1.08亿字。典型成绩包括刻本识别准确率93.2%，同时用户反馈中涌现出多个学术新发现。报告坦诚指出当前局限：手写体识别率仅70%、生僻字覆盖不全等七大短板。未来三年规划聚焦手写体提升、多文种支持及知识图谱构建，目标形成开源生态。项目组强调"把大事变小事"的核心理念，让普通馆员也能参与文化传承。下一阶段将继续完善系统，推动古籍数字化进程。]]></description><category></category></item><item><title><![CDATA[《大话文渊慧典》：十、落地情况与小范围推广]]></title><link>https://blog.csdn.net/donoot/article/details/163544701</link><guid>https://blog.csdn.net/donoot/article/details/163544701</guid><author>donoot</author><pubDate>Thu, 06 Aug 2026 23:53:55 +0800</pubDate><description><![CDATA[摘要： 文渊慧典团队从零经费起步，选择湖南某县图书馆作为首个试点，通过解决古籍OCR技术难题（如虫蛀文本识别、复杂版式处理）获得用户认可。凭借用户王姐的“人传人”推广，系统逐步覆盖20家基层图书馆，并意外吸引学生使用。团队克服馆长信任、馆员学习门槛等阻力，建立“微信群+远程协助”支持网络。技术最终融入用户日常，如快速检索方志、辅助学术研究，体现了“让技术消失于生活”的理念。下阶段将开源系统，直面不足并规划未来。]]></description><category></category></item><item><title><![CDATA[《大话文渊慧典》：九、项目测试]]></title><link>https://blog.csdn.net/donoot/article/details/163491508</link><guid>https://blog.csdn.net/donoot/article/details/163491508</guid><author>donoot</author><pubDate>Wed, 05 Aug 2026 09:00:05 +0800</pubDate><description><![CDATA[摘要：研发团队对古籍OCR系统进行了严苛的全方位测试，采用两万页真实古籍扫描件构建"魔鬼测试集"，涵盖从高清刻本到虫蛀手稿的五种难度等级。测试包括准确率、性能、异常处理、竞品对比和实地应用五大环节，在老爷机上实现45秒/页的识别速度，异常输入容忍度极高，最终获得86.7%的平均准确率和4.3/5的用户满意度。测试中发现的"清代李嘉诚"等趣闻催生了新功能灵感，团队总结出"用真实数据测真实场景"等五条核心经验，推动系统从实验室工具蜕变为实用生产力工具。]]></description><category></category></item><item><title><![CDATA[论程序员的偷懒艺术：Python跨平台“躺平”指南]]></title><link>https://blog.csdn.net/donoot/article/details/163491297</link><guid>https://blog.csdn.net/donoot/article/details/163491297</guid><author>donoot</author><pubDate>Wed, 05 Aug 2026 08:40:12 +0800</pubDate><description><![CDATA[面对跨平台开发需求，传统语言（如C++、Java）常因系统差异陷入繁琐适配，而Python凭借解释型特性与丰富的生态成为"懒人神器"。作者通过三个案例展示Python的跨平台优势：1）Windows底层API工具PortSentinel，95%代码跨平台通用；2）自动整理脚本用pathlib智能处理路径分隔符；3）AI服务无视显卡差异，依赖PyTorch生态一键部署。文章对比了Go、Java、.NET等语言的跨平台能力，指出工具选择应权衡开发效率与性能需求，强调"偷懒"本质是聚焦业务而非环境适配。]]></description><category></category></item><item><title><![CDATA[从 netstat -ano 到自研安全工具：PortSentinel 实战开发手记]]></title><link>https://blog.csdn.net/donoot/article/details/163482962</link><guid>https://blog.csdn.net/donoot/article/details/163482962</guid><author>donoot</author><pubDate>Tue, 04 Aug 2026 23:09:57 +0800</pubDate><description><![CDATA[作者开发PortSentinel端口安全工具。从发现新电脑存在几十个高危端口的经历出发，作者通过Python+PyQt5开发了三层架构的工具，包含端口扫描、连接管理、OS指纹识别等功能。重点攻克了Windows底层API调用、PyQt5多线程通信、I/O密集型任务处理等技术难点，并构建了包含107+端口知识库和20+CVE漏洞库的风险评估系统。该工具以109秒完成6.5万端口扫描，支持19项右键功能，目前已开源在GitHub。文章分享了开发中的技术细节与踩坑经验，展现了从安全需求到完整工具的实现路径。]]></description><category></category></item><item><title><![CDATA[基于Windows底层API的网络端口扫描与安全监控系统设计与实现]]></title><link>https://blog.csdn.net/donoot/article/details/163482247</link><guid>https://blog.csdn.net/donoot/article/details/163482247</guid><author>donoot</author><pubDate>Tue, 04 Aug 2026 22:22:17 +0800</pubDate><description><![CDATA[PortSentinel：基于Windows IPHelper API的轻量级端口扫描与安全监控工具 摘要 随着网络威胁的演进，开放端口成为勒索病毒（如WannaCry利用445端口）和远程漏洞（如BlueKeep攻击3389端口）的主要入侵途径。针对现有工具（如Nmap命令行复杂、netstat功能单一、商业方案成本高）的不足，本文设计并实现了PortSentinel —一款面向Windows平台的轻量化安全工具。]]></description><category></category></item><item><title><![CDATA[《大话文渊慧典》：八、开发实战与问题解决]]></title><link>https://blog.csdn.net/donoot/article/details/163440137</link><guid>https://blog.csdn.net/donoot/article/details/163440137</guid><author>donoot</author><pubDate>Mon, 03 Aug 2026 13:34:34 +0800</pubDate><description><![CDATA[文章摘要： 《文渊慧典》开发团队分享了项目实战中的八大典型问题与解决方案，包括内存泄漏、CPU满载、DPI欺诈、模型更新陷阱、玄学崩溃、老爷机适配等。通过真实案例（如王大姐4G内存电脑崩溃、扫描件DPI标称不符等），团队总结出三大填坑原则：在低配环境测试、用真实数据验证、保留用户可控性。这些经验凸显了古籍数字化项目中稳定性与用户体验的重要性，最终构建出兼顾性能与鲁棒性的系统。]]></description><category></category></item><item><title><![CDATA[《大话文渊慧典》：七、后处理的魔法]]></title><link>https://blog.csdn.net/donoot/article/details/163439773</link><guid>https://blog.csdn.net/donoot/article/details/163439773</guid><author>donoot</author><pubDate>Mon, 03 Aug 2026 13:23:56 +0800</pubDate><description><![CDATA[本文探讨了OCR技术在后处理阶段的五个关键工序。通过乾隆年间县志识别案例，指出OCR识别仅是起点，后处理才是将"矿石炼成铁"的核心过程。系统采用置信度标注（0.85阈值自动标黄）、古文语言模型纠错（基于四库全书训练的BERT模型）、避讳字自动补全（结合清代避讳规则）、异体字双版本输出（学者版与大众版）及双层PDF"隐身文字术"（透明文字层+原图保留）等创新方法。]]></description><category></category></item><item><title><![CDATA[《大话文渊慧典》：六、技术架构（下）]]></title><link>https://blog.csdn.net/donoot/article/details/163421889</link><guid>https://blog.csdn.net/donoot/article/details/163421889</guid><author>donoot</author><pubDate>Sun, 02 Aug 2026 23:57:18 +0800</pubDate><description><![CDATA[本文深入解析了PPStructure古籍OCR系统中的版面分析技术架构。该系统采用"特种部队"式分工协作模式，由四个核心模块组成：1）布局检测（基于ResNet+FPN的全图区域定位），2）方向分类（轻量级卷积网络判断文字方向），3）文本检测（DB算法精确切分行文字），4）阅读顺序重建（两阶段坐标排序算法）。]]></description><category></category></item><item><title><![CDATA[《大话文渊慧典》：五、技术架构（上）]]></title><link>https://blog.csdn.net/donoot/article/details/163421772</link><guid>https://blog.csdn.net/donoot/article/details/163421772</guid><author>donoot</author><pubDate>Sun, 02 Aug 2026 23:46:00 +0800</pubDate><description><![CDATA[本文以生动对话形式揭秘了文渊慧典古籍数字化系统的技术架构。该系统通过五步流水线处理古籍：1）PyMuPDF高效拆解PDF为高清图像；2）OpenCV进行自适应二值化（解决纸张泛黄）和图像矫正（处理弯曲页面）；3）基于PPStructure的深度学习流水线完成版面分析（含布局检测、方向分类等四个模型），特别针对竖排繁体、夹注等古籍特征进行优化；4）PaddleOCR核心识别模块结合3.5万字库和避讳字处理；5）后处理生成可搜索的双层PDF。]]></description><category></category></item><item><title><![CDATA[小菜救急：用Gradio的gr.State给王大姐搭了个古籍搜索引擎]]></title><link>https://blog.csdn.net/donoot/article/details/163399694</link><guid>https://blog.csdn.net/donoot/article/details/163399694</guid><author>donoot</author><pubDate>Sat, 01 Aug 2026 23:59:38 +0800</pubDate><description><![CDATA[文章摘要：小菜接到王大姐的需求，要为古籍数字化开发两个工具：一个全文检索器和一个众包校对工具。大胖老师和二黑指导他用Gradio的Blocks和状态管理实现功能。检索器支持关键词搜索并定位原书图片，校对工具让志愿者协作修改OCR错误文本。两个案例展示了如何用简单技术解决基层文化机构实际问题，体现&quot;数字中国&quot;和&quot;共建共享&quot;理念。工具最终构成完整的县级图书馆古籍数字化方案，实现技术普惠与文化传承的结合。]]></description><category></category></item><item><title><![CDATA[小菜进阶记：从“纯界面”到“AI大脑”，Gradio 双项目实战]]></title><link>https://blog.csdn.net/donoot/article/details/163399468</link><guid>https://blog.csdn.net/donoot/article/details/163399468</guid><author>donoot</author><pubDate>Sat, 01 Aug 2026 23:44:53 +0800</pubDate><description><![CDATA[本文介绍了如何利用Gradio和Hugging Face的Transformers库快速搭建两个AI应用：古籍图像分类器和多语言翻译助手。主要内容包括： 环境准备：安装gradio、transformers等库，利用pipeline简化模型加载和推理过程。 ]]></description><category></category></item><item><title><![CDATA[小菜学Gradio：从“这东西能干啥”到“我给王大姐做了个图片处理器”]]></title><link>https://blog.csdn.net/donoot/article/details/163399332</link><guid>https://blog.csdn.net/donoot/article/details/163399332</guid><author>donoot</author><pubDate>Sat, 01 Aug 2026 23:31:21 +0800</pubDate><description><![CDATA[这篇文章介绍了如何用Python库Gradio快速构建Web界面工具，无需前端知识即可实现交互式应用。主要内容包括：Gradio的核心概念：通过包装Python函数自动生成Web界面，实现"函数即服务"。]]></description><category></category></item><item><title><![CDATA[《大话文渊慧典》：外三篇-全世界都在数字化，为什么我们的古籍还在靠王大姐翻相册？]]></title><link>https://blog.csdn.net/donoot/article/details/163376370</link><guid>https://blog.csdn.net/donoot/article/details/163376370</guid><author>donoot</author><pubDate>Fri, 31 Jul 2026 23:10:34 +0800</pubDate><description><![CDATA[【摘要】在全球古籍数字化浪潮中，中国基层图书馆仍普遍面临“王大姐困境”——管理员手工翻阅古籍的工作方式与数字化理想存在巨大落差。调研显示，这一现象背后存在三重障碍：技术债（比发达国家晚起步20年）、资源短缺（县馆年均数字化经费不足5万元）和技术适配性差（通用OCR难以识别竖排繁体）。典型案例中，西部某县馆高价购置的扫描仪因网络认证失败沦为摆设，凸显“最后一公里”运维缺失的痛点。]]></description><category></category></item><item><title><![CDATA[《大话文渊慧典》：外三篇-不是我们不行，是赛道不同——中国古籍OCR的“非对称作战”优势]]></title><link>https://blog.csdn.net/donoot/article/details/163376297</link><guid>https://blog.csdn.net/donoot/article/details/163376297</guid><author>donoot</author><pubDate>Fri, 31 Jul 2026 22:53:49 +0800</pubDate><description><![CDATA[摘要：文章通过对话形式，揭示中外古籍OCR领域的根本差异与中国的独特优势。核心观点包括：1）版式复杂度差异：西方OCR处理"一马平川"的横排文本，中国需应对竖排、批注、虫蛀等"蜀道难"式挑战；2）字库规模差距：26字母与3.5万汉字的识别难度不在同一量级；3）用户场景不同：西方服务于技术型学者，中国需满足基层"王大姐"的零门槛需求。文章提出中国"非对称作战"三大优势：海量原始数据、全民级应用场景和开源社区活力，强调应建立符合本土需求的评价体系，在古籍数字化普及赛道上实现超越。]]></description><category></category></item><item><title><![CDATA[插件式可训练模块架构：以《文渊慧典》为例，手把手教你像搭积木一样构建AI训练系统]]></title><link>https://blog.csdn.net/donoot/article/details/163369685</link><guid>https://blog.csdn.net/donoot/article/details/163369685</guid><author>donoot</author><pubDate>Fri, 31 Jul 2026 16:00:39 +0800</pubDate><description><![CDATA[本文介绍了插件式架构在Python中的应用，通过三个实战案例由浅入深地讲解如何构建可扩展的插件系统。案例一展示了基础插件注册与调用；案例二引入钩子机制实现流程自动化；案例三演示完整的可训练插件生命周期。文章还分析了该架构在WYHD项目中的实际应用，并指出其高内聚低耦合、易扩展等优势，适合需要灵活功能扩展的场景。所有代码仅依赖Python标准库，适合初学者学习模块化设计思想。]]></description><category></category></item><item><title><![CDATA[AI智能训练中心实战：以《文渊慧典》开发为例，手把手教你从零搭建属于自己的模型训练闭环 ]]></title><link>https://blog.csdn.net/donoot/article/details/163368477</link><guid>https://blog.csdn.net/donoot/article/details/163368477</guid><author>donoot</author><pubDate>Fri, 31 Jul 2026 15:19:47 +0800</pubDate><description><![CDATA[本文介绍了如何从零搭建一个AI智能训练中心，实现OCR文本纠错的自动化训练闭环。通过三个逐步深入的Python案例，展示了核心功能：纠错模型训练器、OCR特征增强器、一键训练闭环；全文使用纯Python实现，无需第三方库，配套完整可运行代码。这套方案特别适合古籍数字化等需要持续优化OCR结果的场景，随着使用会越来越精准。]]></description><category></category></item></channel></rss>