自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+
  • 博客(225)
  • 资源 (2)
  • 收藏
  • 关注

原创 20260821-20260828 周刊

首发于:https://swhl.github.io/latest/weekly/20260821-20260828-weekly/

2026-08-28 10:25:05 205

原创 20260814-20260821 周刊

首发于:https://swhl.github.io/latest/weekly/20260814-20260821-weekly/

2026-08-21 09:37:30 215

原创 aicommits 工具接入 Codex CLI 使用

首发于:https://swhl.github.io/latest/blog/aicommits-codex-cli/

2026-08-19 17:16:42 251

原创 20260806-20260813 周刊

首发于:https://swhl.github.io/latest/weekly/20260806-20260813-weekly/

2026-08-13 19:16:24 204

原创 谷歌浏览器插件推荐

首发于:https://swhl.github.io/latest/blog/chrome-browser-plugin/插件不在于多,而在于满足自己需求。要能分清是想要,还是需要。

2026-08-12 09:38:37 153

原创 20260730-20260806 周刊

首发于:https://swhl.github.io/latest/weekly/20260730-20260806-weekly/

2026-08-06 22:31:09 291

原创 Code Fence Completer: Obsidian 代码块补全插件

这个小插件,也是源于我日常使用遇到的痛点,借助大模型完成开发。我逐渐意识到,想要做好用的产品和工具,不妨从自身遇到的痛点出发。我也发现大模型非常适合做这种小插件,因为小插件代码量少,功能容易验证。欢迎大家使用。

2026-08-06 10:29:11 148

原创 让Github Star、Fork 和 Watching 显示完整数字的油猴脚本

首发于:https://swhl.github.io/latest/blog/github-full-number-tampermonkey-script/

2026-08-04 10:42:50 164

原创 Github Star History 趋势图工具推荐

从原理上来看,和 Start History 网站说的一样,也是生成了一个令牌,这样才能正常获取到 Star 数。但是这个工具有着更为详细的记录和统计信息。这使得我们可以更加全面窥见仓库 Star 变化趋势。有着同样困扰的小伙伴,推荐使用这个项目来升成 Star 趋势图,再也不用担心哪天这个图不显示了。

2026-08-04 10:33:26 242

原创 Codex(ChatGPT 桌面版)支持SSH连接远程服务器

一直以来,我用 Codex 一般都只是服务器端用 Codex cli 版,mac 端用桌面版。这样有个问题:服务器端我要一直决定是否同意其某项改动,换句话说就是需要一直审批,一直按回车。效率完全卡在是否及时按回车同意了。首发于:https://swhl.github.io/latest/blog/codex-with-remote-ssh/我也调研了好多命令,看看是否可以减少我的审批,变得更加自主一些。遗憾的是,这个命令在运行到容器中的服务器不管用。上周同事也遇到和我同样的困惑,他告诉了我一个好办法:用。

2026-08-03 09:43:30 410

原创 20260723-20260731 周刊

首发于:https://swhl.github.io/latest/weekly/20260723-20260731-weekly/

2026-07-30 21:57:23 199

原创 苹果手机与 NFC 贴纸

苹果手机有着封闭的操作系统,却又有着开放的快捷方式。我对它真是又爱又恨呢!安卓系统看似开放,却难以形成合力,各自都在拉锯。上面的只是我看到的和在用的一些有趣用法,肯定还有更多的。最直接的就是看看自己日常生活中有哪些总是重复做的事情,是不是可以用自动化搞起来。这样我们就有更多的时间去陪伴家人了。

2026-07-29 21:28:27 253

原创 论文速读:OvisOCR2

首发于:https://swhl.github.io/latest/blog/ovisocr2/系列说明:本文为快速阅览笔记,侧重梳理方案骨架与技术演进关系,不深入实现细节;后续若开展相关方向研究,再补充精读分析。论文地址:https://arxiv.org/abs/2607.13639v1模型地址:https://huggingface.co/ATH-MaaS/OvisOCR2在线 demo: https://huggingface.co/spaces/ATH-MaaS/OvisOCR2。

2026-07-28 19:24:33 211

原创 GitPaste: vs-picgo 的轻量平替

这个小工具只是从我解决我的小痛点出发而来,因此可能带有一定的个人色彩,但是我会保证这个东西的专业性,即使是 vibe coding 而来的,我这里会逐渐完善它的,毕竟自己每天都要用的。

2026-07-28 17:07:39 246

原创 论文速读:MonkeyOCRv2

首发于:https://swhl.github.io/latest/blog/monkeyocrv2/系列说明:本文为快速阅览笔记,侧重梳理方案骨架与技术演进关系,不深入实现细节;后续若开展相关方向研究,再补充精读分析。论文地址:https://arxiv.org/abs/2607.11562源码:https://github.com/Yuliang-Liu/MonkeyOCRv2。

2026-07-27 12:53:54 249

原创 20260716-20260723 周刊

首发于:https://swhl.github.io/latest/weekly/20260716-20260723-weekly/

2026-07-23 21:25:32 201

原创 RapidOCR 默认参数与PaddleOCR默认参数对齐探究

params={},从以上效果来看,RapidOCR 当前参数基本是更优一些。当然不排除某些图像,情况不同。所以小伙伴在使用时,效果不好时,可以多调调这些参数。

2026-07-21 21:08:10 288

原创 rapidocr v3.9.2 发布

首发于:https://rapidai.github.io/RapidOCRDocs/latest/changelog/v3.9.2/

2026-07-21 20:39:18 182

原创 20260709-20260716 周刊

首发于:https://swhl.github.io/latest/weekly/20260709-20260716-weekly/

2026-07-16 21:33:08 219

原创 mkdocs-material-format-convert:用于把 Material for MkDocs 扩展 Markdown 语法降级为更通用的 Markdown的小工具

首发于:https://swhl.github.io/latest/blog/mkdocs-material-format-convert/

2026-07-15 22:03:13 213

原创 20260706-20260712 周刊

汉密尔顿将这种状态命名为——久坐生理学:久坐不是“运动不足”的反面,它是一种独立的生活状态,会触一套独立的分子反应,和“运动不足”是两个相互独立的变量。简介:当某个东西在你系统上运行时,无论是一个进程、一个服务,还是某个绑定到端口的东西,总有其原因。这个原因往往是间接的、不明显的,或者分散在多个层级中,很多其他的工具可以告诉你什么在运行,这个工具可以很好的告诉你“为什么运行”,很有意思。开源,社区共同维护。换句话说,真正被广泛排斥的不是“AI 辅助”,而是“把去作者化的生成机制塞进写作工具的核心”。

2026-07-13 08:27:11 249

原创 RapidOCR PP-OCRv6 支持 TensorRT 推理引擎

从以上基准比较来看,ONNX 模型在转换为 TensorRT 对应的.engine模型后,FP32 精度下,检测和识别模型均在误差范围内,推理速度有量级的提升。如果追求极致的推理速度,欢迎试用。值得一提的是,我这里仅测试了小批量的数据下效果,难免存在疏漏。更多全面测试,仍需要使用到的小伙伴多多反馈。rapidocr将在>=v3.9.2集成,欢迎届时使用和反馈。

2026-07-08 07:10:43 229

原创 20260628-20260705 周刊

曾经的信息差红利消失殆尽,观众的审美和认知已经觉醒,而很多从业者依然在走着认师傅、拜求学院教学、熟人内部推荐的老路,和几十年前没有任何区别,或者应该这么说,现在的电影的本质和几十年前的老电影没有任何区别。北京是唯一一个减量发展的城市,如果不能把自己的人生机会,嵌入到北京科技、文化中心的城市定位和产业链条中,就很难能在这座最难的城市卡位和留下人生发展机会。历史从来不是客观公正的,现在也是如此。因为只有把唐朝写得好好的,把黄巢写得坏坏的,才能证明后来者推翻唐朝是“拨乱反正”,而不是趁火打劫嘛。

2026-07-05 14:52:13 165

原创 rapidocr v3.9.1 发布

该版本中 PP-OCRv6 Rec Tiny 模型,因为模型结构没有和 PaddleOCR 中原始结构对齐,导致该模型指标很差,不可用。

2026-07-05 08:50:13 191

原创 RapidOCR 适配 PP-OCRv6 Rec 模型支持 Paddle, PyTorch 和 MNN 记录

首发于:https://rapidai.github.io/RapidOCRDocs/latest/blog/2026/06/30/rapidocr-%E9%80%82%E9%85%8D-pp-ocrv6-rec-%E6%A8%A1%E5%9E%8B%E6%94%AF%E6%8C%81-paddle-pytorch-%E5%92%8C-mnn-%E8%AE%B0%E5%BD%95/

2026-07-05 08:07:06 463

原创 RapidOCR 适配 PP-OCRv6 Det 模型支持 Paddle, PyTorch 和 MNN 记录

首发于:https://rapidai.github.io/RapidOCRDocs/latest/blog/2026/06/27/rapidocr-%E9%80%82%E9%85%8D-pp-ocrv6-det-%E6%A8%A1%E5%9E%8B%E6%94%AF%E6%8C%81-paddle-pytorch-%E5%92%8C-mnn-%E8%AE%B0%E5%BD%95/

2026-07-02 22:06:14 467

原创 RapidOCR 集成 PP-OCRv6 Rec 模型记录

这部分代码已经集成到中。相关工作正在进行中,欢迎持续关注。

2026-06-24 08:09:11 266

原创 rapidocr v3.9.0 发布(集成PP-OCRv6)

RapidOCR v3.9.0 更新摘要:本次升级默认采用 PP-OCRv6 系列模型(det small 和 rec small),性能显著优于 v4 版本,但模型体积增至 29.5MB。当前仅支持 ONNXRuntime 和 OpenVINO 推理引擎,后续将扩展更多支持。接口保持兼容,用户可通过 pip 直接升级,并可选 tiny/medium 不同尺寸模型。使用示例如旧,建议根据实际场景测试效果后决定是否升级。文档详见项目官网。

2026-06-23 21:42:02 436

原创 rapidocr v3.8.0发布了

RapidOCR v3.8.0 更新摘要:新增 RapidOCR Skill 集成、Docker 开发环境支持(#649)、Python API/CLI 的模型目录配置及自动下载功能,并添加 PP-OCRv5 方向分类模块。修复了模型下载链接和包导入问题,更新文档和测试用例。默认模型版本升级至 v3.8.0,同步更新赞助者信息。主要贡献者:@SWHL 和 @LocNgoXuan23。完整变更详见发布日志。

2026-04-08 22:40:43 140

原创 rapidocr v3.7.0发布

RapidOCR v3.7.0 带来多项功能增强与优化:新增 CoreML 和 TensorRT 引擎支持,实验性添加 MPS 支持,优化 OpenVINO 字符列表获取方式。修复 OpenVINO 导入问题,重构代码结构并规范接口。文档方面更新下载量统计和贡献指南,测试环节改进 TensorRT 检测逻辑。项目还更新了模型路径、Discord 集成等基础设施。由 @SWHL、@HighDoping 等开发者共同完成本次迭代。

2026-03-05 08:01:37 275

原创 RapidAISkill发布了

RapidAISkill是一个用于存放AI助手技能指令的仓库,旨在为RapidAI生态项目提供可复用的开发指引。Skill以特定格式(如SKILL.md)描述AI在特定场景下的任务执行规范,适用于Cursor等各类AI平台。仓库采用标准目录结构存放技能文件,目前已包含贡献指南等技能。用户可通过克隆仓库或配置技能路径来使用这些Skill,也欢迎贡献新技能(需包含适用平台说明和详细指引)。项目采用Apache 2.0许可证,相关文档参考Cursor官方技能说明和RapidAI项目。

2026-02-07 12:29:40 366

原创 RapidOCR Python 贡献指南

本文档介绍了如何为 RapidOCR Python 项目贡献代码。主要内容包括:环境准备(Python 3.6+、Git)、代码克隆、虚拟环境配置、pre-commit 钩子安装、单元测试运行、问题复现与功能开发流程。重点说明了代码提交规范(约定式提交)、分支管理以及向主仓库提交 PR 的完整步骤。文档强调在修改代码时需要编写配套单元测试,并保持与现有代码风格一致。最后提供了项目代码风格要求和相关文档链接,帮助开发者快速参与项目贡献。

2026-02-06 20:17:56 465

原创 rapidocr v3.6.0发布了

【代码】rapidocr v3.6.0发布了。

2026-01-29 08:11:57 253

原创 rapidocr v3.5.0发布了

原文链接:https://rapidai.github.io/RapidOCRDocs/main/changelog/v3.5.0/

2026-01-07 10:00:20 265

原创 vscode末尾自动添加新行

最近发现有些代码需要自动添加新行。这种功能我认为仅适用于code文件,像html,python和javascript等等。如果打开某些txt文件,这样岂不是就会在不知情情况下添加了一行?于是,我又调研了一圈,在stackoverflow的评论区发现了蛛丝马迹:(

2025-09-25 09:29:45 484

原创 rapidocr v3.4.0发布了

RapidOCR v3.4.0更新摘要:新增支持PP-OCRv5英文/泰文/希腊文识别模型;添加日志打印开关参数;修复中文路径乱码、PyTorch≥2.6的权重加载问题;统一各阶段运行时间统计范围;重构单元测试结构。包含多项功能增强和错误修复,改进了文档和测试代码。本次更新主要贡献者为@SWHL。

2025-09-06 20:19:16 842

原创 rapid_table v3.0.0发布了

RapidTable v3.0.0 发布,主要支持批量推理功能,并对接口返回值进行了重大调整(从单张图片处理改为批量处理)。此次版本升级包含代码重构、批量处理优化、bug修复和文档更新等工作。开发者表示虽然代码还未达到理想状态,但会持续改进。感谢贡献者们的努力,完整更新内容可查看项目变更日志。

2025-08-29 22:40:15 642

原创 评测PHOCR中文文本识别模型

PHOCR 是一个高性能的开源光学字符识别(OCR)工具包,专为多语种文本识别任务设计,支持包括中文、日文、韩文、俄文、越南文和泰文在内的多种语言。PHOCR 搭载了我们完全自研的识别模型 PH-OCRv1,在准确率上显著优于现有解决方案。上面结果和PP-OCRv5比较来看,差距还是不小的。可能是测试集的不同,导致指标差距明显。但是速度的确快一些。⚠️注意:仅供参考哈。由于评测数据集的限制,以下评测结果不完全代表模型能力,支持给出一个基本参考。小伙伴们还需要在自己场景下真实评测来看哈。还需要自己来看一下。

2025-08-03 11:25:40 467

原创 rapidocr_web v1.0.0发布了

下载地址(需科学上网):https://github.com/RapidAI/RapidOCRWeb/releases/download/v1.0.0/RapidOCRWeb-3.1.1-windows-2022-X64-no-installer.zip。有自己打包需求的小伙伴,可以参考 https://github.com/RapidAI/RapidOCRWeb/blob/main/.github/workflows/package_ocrweb.yml 中代码来打包自己的exe可执行程序。

2025-07-31 22:36:53 719

原创 rapidocr v3.3.0发布了

【代码】rapidocr v3.3.0发布了。

2025-07-27 20:54:09 276

.obsidian.zip

Admonition: 用于高亮块 Better Export PDF: 用于导出PDF Clear Unused Images: 清除不使用的图像 Code Styler: 添加代码块格式 Custom Attachement Location: 用于插入图像的重命名 Fast Image Cleaner: 用于右击删除图像 QuickAdd: 快速添加笔记 Show Current File Path: 显示当前文件路径 Linter: 格式化markdown

2024-11-05

test docker compose的最小demo

test docker compose的最小demo

2022-12-07

cudnn-7.5-linux-x64-v6.0

这里面是一个网盘地址, 这个东西现在不太好找了。所以现在备份一下

2018-07-02

多角度人物跟踪matlab源码

本资源为matlab源码,可以直接运行,调用的是Matlab 的 Computer Vision System Toolbox工具箱代码,可以实时跟踪moving objects 并显示。

2017-09-21

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除