- 博客(207)
- 收藏
- 关注
原创 轻量化本地 Agent 方案分享:PocketBot 开源,支持目标拆解与自动化
PocketBot 在保证内核代码精简、易于阅读和二次开发的前提下,补齐工程化能力:无需额外部署 Redis、向量数据库等中间件,依靠原生 SQLite 即可承载全部数据,普通 PC、小型服务器、低功耗设备都能顺畅部署。它不只是聊天机器人,核心聚焦个人本地任务自动化,支持目标拆解、持久定时任务、长期记忆管理,一套代码同时提供 CLI 终端模式与可视化 WebUI。内置 23 个工具,覆盖九大场景:文件管理、Shell 命令执行、网页检索、长期记忆、目标管理、定时自动化、媒体生成、子智能体调度等。
2026-07-29 15:49:21
370
原创 孟获MengHuo——一站式智能直播信息采集分析工具
开发这款孟获MengHuo直播信息采集系统的初衷,就是为了解决直播内容整理低效、繁琐的痛点,把重复、机械的采集、筛选、整理工作交给软件自动化完成,让大家把更多时间用在内容学习、复盘优化上。软件轻量无广告、本地存储保隐私、功能全面、操作极简,兼顾新手友好度和专业实用性。后续我也会持续迭代更新,优化识别精度、AI分析能力和使用体验,新增更多实用功能。如果你经常需要整理直播内容、做直播复盘、采集直播干货,不妨试试这款工具,彻底解放双手,大幅提升工作和学习效率!六、下载地址。
2026-06-30 20:36:05
226
原创 双安 ShuangAn:一个面向国内工业预测性维护的实验性 AI Agent 框架
双安是一个实验项目,它在探索"LLM + 工业维护"的一种可能形态。如果你也在这个方向上探索,欢迎交流。
2026-06-24 13:41:08
223
原创 JiaJiaOCR-2.2.0:面向Java ocr的开源库
releases 页面,下载 JiaJiaOCR 2.0 + 版本的 jar 包,放入项目依赖目录并引入。该 Jar 包 200MB(集成了模型文件)。落地过程中,Java 开发者常面临。exe/dll 外部文件,要么。的困境 —— 要么依赖。前往 GitHub 仓库。
2026-06-09 21:20:54
330
原创 纯 CPU 推理!0.1B 超轻量级端到端OCR模型,使用 Java 进行文档解析
【代码】 纯 CPU 推理!0.1B 超轻量级端到端OCR模型,使用 Java 进行文档解析。
2026-05-11 10:47:39
209
原创 TalkSheet:AI 驱动的 Excel 分析应用,聊天式操作 + 智能图表
TalkSheet 的诞生,就是想打破这种 “专业壁垒”—— 不做笨重的专业工具,不搞复杂的操作流程,只为普通人提供一款 “轻量、简单、安全” 的 AI Excel 分析助手。未来,我会一直坚守 “轻量易用” 的核心,倾听普通人的真实需求,不堆砌功能、不增加负担,让 TalkSheet 成为每个普通人都能用得起、用得会的数据分析工具!图表支持基础查看,后续将新增 “简单编辑功能”(调整颜色、添加标签)—— 同样以 “轻量易用” 为原则,不添加复杂的设计工具,满足普通人的基础需求即可。
2026-04-15 15:34:14
468
原创 轻量高效、CPU 友好!JiaJia‑Search 混合检索引擎,赋能工厂智能问答 Web 系统落地
JiaJia‑Search 以轻量、高效、CPU 友好为核心,补齐了工业级 RAG 场景的轻量化检索短板;基于该框架搭建的工厂智能问答 Web 系统,则将混合检索能力落地到真实业务,实现工厂文档的上传‑解析‑入库‑智能问答闭环,为工业场景的知识管理、智能运维提供低成本、高可用的技术方案。未来将持续优化 JiaJia‑Search 的性能与功能,并迭代工厂智能问答系统,适配更多工业文档类型与复杂问答场景。
2026-04-13 13:25:11
262
原创 医疗预约痛点破局:基于智能体编排的智能挂号解决方案
是连接患者与诊所的核心入口,但传统模式正面临四大关键痛点:❌ 表单式预约流程繁琐,老年患者操作门槛高;❌ 硬编码规则难以适配多样化用户表达,意图识别准确率低;❌ 部署成本高,小型诊所难以承担定制化开发费用。快速落地,无需正则表达式和硬编码规则,即可实现全流程自动化预约,现已在多家诊所试点验证,预约转化率显著提升,用户操作效率大幅优化。这两天在考虑Agent怎么用在医疗上,于是就在参考了别人的案例后,实现一个简化的中文医疗预约案例项目,如下。的诊所智能预约挂号解决方案,基于。在医疗服务数字化转型中,
2026-04-07 15:03:31
417
原创 jiajia-search:5 分钟搭建工业级混合检索问答,让 RAG 开发效率翻倍
通过结合 multilingual-e5-small-onnx的embedding和 bge-reranker-v2-m3的重排能力,以及融合排序等,它在轻量部署场景下表现突出。而混合检索通过 “BM25 + 向量检索 + 重排” 的组合,能实现 “1+1>2” 的效果 —— 让 BM25 负责 “字面精准”,向量检索负责 “意图理解”,重排模型优化最终结果,在召回率和精确率上实现双重提升,性能较单一方案提升 15-20%。👉 特点:支持多种语言,轻量高效,专为检索优化。上收到你的 Star 和 PR!
2026-03-27 10:05:19
435
原创 JiaJia-Search:多语言轻量级高性能混合检索引擎 | 专为 RAG 全链路检索 & 重排设计
使用轻量级 ONNX 重排模型(bge-reranker-v2-m3)对候选集精细化排序,输出 0~1 归一化分数与相关性等级;前排文档(Top1-3):优先保留检索阶段的精准匹配结果(75% RRF 分数 + 25% 重排分数);后排文档(Top11+):依赖重排模型修正语义相关性(40% RRF 分数 + 60% 重排分数);中排文档(Top4-10):均衡检索与重排结果(60% RRF 分数 + 40% 重排分数);多语言重排模型:bge-reranker-v2-m3-ONNX。
2026-03-26 09:06:31
404
原创 轻量 Embedding CPU实战:实现embedding和语义检索
本文基于 ModelScope 的ONNX 模型,实现了轻量、高效、多语言的文本 Embedding 与相似度检索,完全适配 RAG 系统的核心需求。相比闭源 API,本地 ONNX 推理无成本、无延迟、数据安全,且性能足以支撑中小规模 RAG 应用。后续可进一步集成向量数据库、优化文档切分策略,打造完整的企业级 RAG 检索系统。
2026-03-25 11:05:31
488
原创 Office办公多智能体系统完整实现
我准备研发一套Office 多智能体系统—— 它以多智能体协同为核心,打通文本、语音、图片等多模态输入,覆盖写作、表格、演示、文档处理等全场景办公需求,构建起 “输入 - 分析 - 路由 - 执行 - 输出” 的全链路智能办公闭环。这段时间经过研发和设计,并裁减一些不必要的功能后,于2026年春节过后的第一天,我已初步完整实现了整个office多智能体系统,主要功能包括以下,所有的功能均通过对话窗口形式实现,如果时间允许后面会持续优化,如果有想法的朋友可以联系我。
2026-02-24 14:30:03
138
原创 手把手教你用 Python 从零写一个 AI Agent(无框架,DeepSeek 版)
手把手教你用 Python 从零写一个 AI Agent(无框架,DeepSeek 版)
2026-01-28 16:29:01
698
原创 Office多智能体系统的架构(系列一)
Hello,大家好,我是番石榴AI,老番。我准备研发一套Office 多智能体系统—— 它以多智能体协同为核心,打通文本、语音、图片等多模态输入,覆盖写作、表格、演示、文档处理等全场景办公需求,构建起 “输入 - 分析 - 路由 - 执行 - 输出” 的全链路智能办公闭环。这是office多智能体系统研发系列文章的第一篇。详细流程图简化流程图本文将结合系统的核心流程图,为大家拆解这款智能体系统的设计理念、技术架构与核心优势。具体的细节会一步步探讨。传统办公软件的智能化往往局限于 “单一功能 + 简单交互”,
2026-01-08 09:45:15
1129
原创 别再调用API了!5分钟用SpringBoot和JiaJiaOCR,自建一个企业级OCR服务
作为一名Java程序员,你是不是也想过在项目里加点“AI”魔法,比如让程序能看懂图片里的文字?看,图片里的文字被精准地识别出来了,并且返回了每行文字的坐标和内容。是OpenCV开发的最佳实践,能有效避免内存泄漏,保证服务稳定。一个属于你自己的、免费的、高性能的OCR服务,就这么诞生了!将图片转为灰度图,这是提升OCR识别率非常有效的一步。不是功能太弱,就是文档缺失,最后只能放弃。⭐️,您的支持是我持续创作的最大动力!哈喽,大家好,我是番石榴AI,老番。,value选择一张包含文字的图片。
2026-01-07 09:47:08
505
原创 JiaJiaOCR:面向Java ocr的开源库
在 OCR 技术落地过程中,Java 开发者常面临的困境 —— 要么依赖jni调用 exe/dll 外部文件,要么跨平台部署踩坑不断。🎉📦 版本更新速览🔥 轻量版 (1.0+) - 精简高效⚡ 全功能版 (2.0+) - 功能全面🎯 四大核心功能详解1. 📝 通用OCR:印刷体识别标杆延续 1.0 + 版本的高精度印刷体识别能力,支持中英文、数字、符号混合识别,返回文本内容与坐标,适用于发票、标签、广告牌等印刷体场景。2. ✍️ 手写OCR:突破手写识别难点。
2026-01-06 09:11:50
1362
原创 java版的ocr推荐引擎——JiaJiaOCR 2.0重磅升级!纯Java CPU推理,新增手写OCR与表格识别
JiaJiaOCR 2.0的升级核心,是从"解决Java开发者OCR集成痛点"到"提供全场景文本解析能力"的跨越。纯Java实现保障了跨平台部署的便捷性,新增的手写OCR与表格识别功能则直击实际业务中的高频需求。如果你正在为Java项目寻找轻量、高效、无依赖的OCR解决方案,不妨试试JiaJiaOCR 2.0——5分钟集成,一站式覆盖从印刷体到手写体、从文本识别到表格结构化的全需求。期待你的使用反馈,也欢迎一起讨论,让Java OCR生态更加强大!
2025-12-10 13:43:42
1121
原创 纯 Java 实现的 OCR 推理系统:JiaJiaOCR,告别 exe/dll 依赖!
JiaJiaOCR的目标是为Java开发者提供一个简单、高效、跨平台的OCR解决方案,让OCR集成不再是难题。无论你是个人开发者还是企业团队,都可以轻松接入,快速实现OCR功能。如果你正在寻找Java OCR库,不妨试试JiaJiaOCR——纯Java实现,5分钟即可集成!
2025-12-09 10:53:44
801
原创 实现一种超轻量级的有线表格识别方法(有代码,可部署)
在无意间看到一篇CBMS2021的一篇论文《NanoNet: Real-Time Polyp Segmentation in Video Capsule Endoscopy and Colonoscopy》,该论文是专为视频胶囊内窥镜和结肠镜图像的息肉分割设计的架构,是一种医学图像分割的方法。故打算基于以上模型的架构去实现一超轻量级的有线表格识别方法,模型训练后的大小为。
2025-11-19 08:45:26
361
原创 构建智能医疗诊断助手:基于 LangGraph 和 DeepSeek 的实践指南
在医疗领域,诊断过程是一个复杂、多步骤且需要高度专业知识的流程。随着人工智能技术的发展,我们能够构建智能系统来辅助医生进行诊断,提高效率和准确性。本文将详细介绍如何使用 LangGraph 和 DeepSeek 模型构建一个智能医疗诊断助手,从设计理念到代码实现,为您提供一个完整的实践指南。完整项目见:https://github.com/jiangnanboy/medical-diagnosis-assistant。
2025-11-07 09:09:24
981
原创 视频转ppt/pdf V2.0版(新增转为可编辑PPT功能)
在V1.1基础上,新增加了视频转为可编辑PPT的功能,将文字转为可编辑形式,用户可以在转换后的PPT里进行修改,删除等操作。点击生成PPT(可编辑),针对提取后的内容,生成可编辑形式的PPT,可以对里面的文字进行手动编辑。转换流程是:提取内容 -> 去除重复项 -> 转为ppt/pdf。点击生成PPT(图像),针对提取后的内容,生成图像形式的PPT。在提取内容结束后,可点击去除重复项,去除提取的重复内容。点击生成PDF,针对提取后的内容,生成图像形式的PDF。在视频预览窗口单击视频的时间点,提取单帧视频。
2025-11-06 09:58:50
857
2
原创 基于机器学习优化的主图选择方法(酒店,景点,餐厅等APP上的主图展示推荐)
基于机器学习优化的主图选择方法(酒店,景点,餐厅等APP上的主图展示推荐)
2025-11-03 09:38:34
602
原创 我更新了几款文档智能处理桌面软件
本次针对「OCR识别」「文档比对」「文档图片处理」「视频转PPT/PDF」四款核心工具完成更新,从稳定性、轻量化、易用性三大维度优化体验,搭配全新名称与图标,让功能匹配更清晰,以下为详细内容。
2025-10-17 11:11:15
357
原创 自己动手做一款ChatExcel数据分析系统,智能分析 Excel 数据
在日常办公、业务分析或是学生处理作业数据时,Excel 表格几乎是大家离不开的数据处理工具。但传统的 Excel 分析往往需要掌握复杂的函数和代码知识,这让不少人在面对大量数据时望而却步。而今天,我要给大家介绍的 ChatExcel,正是为解决这一痛点而来,它能让 Excel 数据分析变得便捷又高效。一、项目简介:用智能打破数据分析壁垒ChatExcel 是一款专注于智能表格数据分析的工具,其核心分析能力基于deepseek 大模型构建。这一强大的技术支撑,使得 ChatExcel 能够深度理解 Excel
2025-10-16 13:50:16
940
原创 视频转档软件:高效实现视频与 PPT、PDF 的灵活转换
用户可通过拖拽时间轴或输入具体时间节点,精准圈定需要转换的视频片段(如课程中的重点章节、会议中的核心讨论环节、演讲中的关键观点部分),仅将该区间内的内容转换为 PPT 或 PDF,避免冗余信息干扰,让文档更聚焦核心要点。这款视频转 PPT 与 PDF 软件,以 “全场景转换 + 本地安全运行” 为核心优势,既解决了手动整理视频信息的效率难题,又消除了数据传输的安全顾虑,适用于企业办公、教育教学、个人学习等多种场景,是提升工作与学习效率、保障数据安全的实用工具。一、三大核心转换功能,覆盖多元使用场景。
2025-09-30 17:23:38
617
原创 文档图像处理桌面软件 V2.1.1 版
本软件是文档图像处理桌面工具的迭代升级版本(V2.1.1),在 V2.1 版本的核心能力基础上,重点新增矫正功能,进一步强化文档图像处理的实用性,更好适配日常办公等高频场景需求。漂白处理:优化文档图像色彩对比度,去除纸张泛黄、光线不均等问题,让文字、图案更清晰易读;去阴影优化:精准消除拍摄时因光线角度、遮挡产生的阴影(如手部阴影、桌面投影等),还原文档原始视觉效果;新增矫正功能:覆盖多场景图像修正需求,包括:文档扭曲矫正:自动修复拍摄时因角度偏差导致的文档变形(如褶皱扭曲);
2025-09-11 09:30:22
415
原创 复杂结构化场景下的通用公式识别
在科学文献智能化分析领域,数学公式的光学字符识别(OCR)技术是实现学术内容自动检索、编辑与分析的核心支撑,对学术研究与知识管理具有不可替代的作用。然而,当前无论是任务专用模型还是通用视觉语言模型(VLMs),在应对数学内容固有的结构多样性、复杂性及真实场景变异性时均存在明显短板。
2025-08-27 09:14:48
860
原创 文档智能识别的升级版V2.1 !离线 OCR + 表格秒提+截图!
https://pan.baidu.com/s/1owzG74DLPxq6czEQC7ZNwQ 提取码: nt3z。截图识别:点击截图会隐藏本软件,利用鼠标框选图片进行识别,极大方便了用户的截图需求。v2.0版本是将之前的OCR与表格识别整合到一个软件上。支持左侧栏图片列表的删除,鼠标或delete键删除。1.文档智能识别V2.0。2.文档智能识别V2.1。
2025-07-29 10:00:15
343
番石榴内容审核助手软件:敏感词与隐私信息排查
2026-01-13
番石榴文档比对V2.2.0,支持文本、word、excel、pdf、ofd以及图片内容的比对 并生成详细比对报告,包括相似度,修改的字符数等
2025-11-11
LLM 推理服务器基准测试工具是一款专业的性能测试软件,用于评估大语言模型(LLM)推理服务的性能 软件支持测试外部 API 服务(如 DeepSeek、OpenAI)和本地部署的模型,能够全面评估客
2025-10-29
人工智能基于LLM的智能代理系统设计:多模态工具编排与安全防护机制在复杂决策流程自动化中的应用
2025-10-27
文档图像处理V2.1.1版,支持:漂白(可保留红色印章,圈图保留不想漂白区域功能);增加分辨率;去阴影;文档矫正:扭曲矫正、手动透视矫正、文档切边矫正以及卡证切边矫正
2025-09-18
文档智能识别V2.3.1版本;支持:1.ocr;2.表格识别;3.pdf扫描件的ocr和表格识别;4.手写体ocr 优化了软件主界面和增加了一键保存全部结果功能
2025-09-29
文档图像处理V2.1版,支持:漂白(可保留红色印章);增加分辨率;去阴影;文档矫正:扭曲矫正、手动透视矫正、文档切边矫正以及卡证切边矫正 。
2025-09-10
智能文档识别V2.2修订版,功能:OCR+表格结构识别,截图识别
2025-08-20
文档图像漂白桌面软件,无需联网,单机运行,可对图像进行漂白,适合合同,公文等 支持可保留红色印章,图像高分辨率等功能
2025-08-05
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅