ABBYY Recognition Server助力韩国国会图书馆实现数字化

2 篇文章 0 订阅
2 篇文章 0 订阅

名称: 韩国国会图书馆
地点: 韩国
行业: 教育

挑战
在韩国国会图书馆数字化所有的
资料。
解决方案
图像文件和图像PDF文档通过
ABBYY Recognition Server 4
被转换成文本,可用于文件搜索
系统、文档管理系统等。该系统还
提供实时OCR和TTS服务。
成果
• 创建一个可搜索的图书馆
• 盲人完全可以使用这些资

在亚洲地区有一个您可以获取无限的韩国研究数据的地方,这个地方就是韩国国会图书馆。创建于1952年2月20日,它的前身是秘书处的一个小机构,为国会会员的立法活动提供支持。现今它是韩国主要图书馆之一。超过一亿六千万页的珍贵资料存储在其数字图书馆,方便人们随时随地获取。内容包括各种议会资料、各国政府出版物、来自许多国际组织的资料(比如联合国和欧盟)。

挑战
跟大多数图书馆一样,韩国国会图书馆的数据资料过去大都以图像格式和图像PDF文档格式保存,使得应用非常受限。主要问题在于文件和书籍的扫描件信息不可搜索。而且,盲人完全无法使用这些资料。
为了克服这些限制,韩国国会图书馆得出结论有必要对所有资料进行数字化,并实施一项OCR解决方案“为给盲人提供最好的在线国家图书馆服务打下基础”。 它获得了ABBYY合作伙伴ReTIA的帮助—该国领先的解决方案专家 。与专注于图书馆IT系统开发的研发商DBPortal一起,他们共同部署、创建了一套基于web的图书馆数据库系统网络,使访问者可以有效地搜索到任何已出版的资料信息,并为盲人提供语音服务。

解决方案
ReTIA 和 DBPortal为实现自动文档捕获和PDF转换引入功能强大的基于服务器的OCR解决方案。通过基于web的系统,使得从韩国国民议会图书馆上传大量的图片和图像PDF文件到图书馆数据库成为可能。
处理过程如下所示:管理员设定OCR选项 -> 数据被识别-> XML文件被创建 -> 检验操作员在网络环境中校验数据。
在这个过程中图像文件和图像PDF文档通过ABBYY Recognition Server 4被转换成ALTO XML格式。这个解决方案已经在一些韩国公共组织和企业,包括韩国关税厅、韩国专利咨询协会、公平贸易委员会、韩国网络安全局、LG 电子公司、GS工程建设集团等被应用。它是一个全文本识别解决方案,可用于文件搜索系统、文档管理系统等。
“感谢这项服务,大约25万视觉障碍者现在能够很容易地访问图书馆里的所有知识和信息。这是一个重要的里程碑,韩国国会图书馆将进一步致力于为整个国家的民众提供方便的信息检索”。
李垠澈,博士,馆长,韩国国会图书馆

这套基于web的系统,通过ABBYY Recognition Server 提供的OCR功能,执行来自图书馆内部任务流程以及外部在线OCR请求。它将识别结果保存到韩国国会图书馆的数字图书馆系统,并生成日志数据文件,其中包括各种元数据(例如,创建时间和工作单位)。该体系的一个突出特点是其友好、直观的用户界面,专为图书馆任务而特定设计。
在OCR 管理界面图书馆工作人员可以登记文件进行处理、检查识别结果等。而且,还提供校验识别结果的功能。该网络系统提供了用户注册和工作数据统计的创建和管理的功能,便于检测每个用户所做的工作量。
此外,该系统还提供了一项额外的、高度创新型的功能:实时OCR。它可以让用户对图书馆数据库中之前未作处理的数据进行识别处理。实时OCR和TTS技术的结合为韩国国会图书馆创造了一项突破性的解决方案。
系统中的这项OCR功能很快将被适配到韩国国会数字图书馆的在线语音服务使用。

成果
感谢这项基于网络的OCR系统的应用,大大减少了创建一个可搜索的图书馆所需的人力资源和时间成本。
数据库的易用搜索功能、以及为盲人提供的多种语音服务,应有助于韩国国会图书馆实现促进议会民主与人民生活质量的发展的使命,以及为子孙后代保护人类的智力文化遗产。

Python网络爬虫与推荐算法新闻推荐平台:网络爬虫:通过Python实现新浪新闻的爬取,可爬取新闻页面上的标题、文本、图片、视频链接(保留排版) 推荐算法:权重衰减+标签推荐+区域推荐+热点推荐.zip项目工程资源经过严格测试可直接运行成功且功能正常的情况才上传,可轻松复刻,拿到资料包后可轻松复现出一样的项目,本人系统开发经验充足(全领域),有任何使用问题欢迎随时与我联系,我会及时为您解惑,提供帮助。 【资源内容】:包含完整源码+工程文件+说明(如有)等。答辩评审平均分达到96分,放心下载使用!可轻松复现,设计报告也可借鉴此项目,该资源内项目代码都经过测试运行成功,功能ok的情况下才上传的。 【提供帮助】:有任何使用问题欢迎随时与我联系,我会及时解答解惑,提供帮助 【附带帮助】:若还需要相关开发工具、学习资料等,我会提供帮助,提供资料,鼓励学习进步 【项目价值】:可用在相关项目设计中,皆可应用在项目、毕业设计、课程设计、期末/期中/大作业、工程实训、大创等学科竞赛比赛、初期项目立项、学习/练手等方面,可借鉴此优质项目实现复刻,设计报告也可借鉴此项目,也可基于此项目来扩展开发出更多功能 下载后请首先打开README文件(如有),项目工程可直接复现复刻,如果基础还行,也可在此程序基础上进行修改,以实现其它功能。供开源学习/技术交流/学习参考,勿用于商业用途。质量优质,放心下载使用。
1、资源项目源码均已通过严格测试验证,保证能够正常运行; 2、项目问题、技术讨论,可以给博主私信或留言,博主看到后会第一时间与您进行沟通; 3、本项目比较适合计算机领域相关的毕业设计课题、课程作业等使用,尤其对于人工智能、计算机科学与技术等相关专业,更为适合; 4、下载使用后,可先查看README.md或论文文件(如有),本项目仅用作交流学习参考,请切勿用于商业用途。 5、资源来自互联网采集,如有侵权,私聊博主删除。 6、可私信博主看论文后选择购买源代码。 1、资源项目源码均已通过严格测试验证,保证能够正常运行; 2、项目问题、技术讨论,可以给博主私信或留言,博主看到后会第一时间与您进行沟通; 3、本项目比较适合计算机领域相关的毕业设计课题、课程作业等使用,尤其对于人工智能、计算机科学与技术等相关专业,更为适合; 4、下载使用后,可先查看README.md或论文文件(如有),本项目仅用作交流学习参考,请切勿用于商业用途。 5、资源来自互联网采集,如有侵权,私聊博主删除。 6、可私信博主看论文后选择购买源代码。 1、资源项目源码均已通过严格测试验证,保证能够正常运行; 2、项目问题、技术讨论,可以给博主私信或留言,博主看到后会第一时间与您进行沟通; 3、本项目比较适合计算机领域相关的毕业设计课题、课程作业等使用,尤其对于人工智能、计算机科学与技术等相关专业,更为适合; 4、下载使用后,可先查看README.md或论文文件(如有),本项目仅用作交流学习参考,请切勿用于商业用途。 5、资源来自互联网采集,如有侵权,私聊博主删除。 6、可私信博主看论文后选择购买源代码。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值