Google 开始对扫描文档进行索引

最新推荐文章于 2024-06-06 20:13:52 发布

comsharp

最新推荐文章于 2024-06-06 20:13:52 发布

阅读量597

点赞数

文章标签： google 文档 cms 作业 html

Google 宣布，他们即将对扫描文档进行索引并投入搜索，这意味着极其庞大的处理资源，以及高级图象处理能力。和普通文本文件不同，扫描文档不包含任何文字数据供 Google 索引，相反，Google 使用 OCR 软件对扫描的文档进行辨认，并转换成文字内容。

过去，Google 也曾尝试索引这些扫描的文档图片，但只能对文件名，以及附近的元数据进行索引，对图片内容则无能为力。从现在开始，Google 搜索将包含这些通过 OCR 软件辨认出来的文字内容，用户在搜索中遇到扫描文档，Google 会提供选项，让你以 PDF 或 HTML 格式阅读。

这类技术早已存在，但准确性一直是个问题，同样，如此大规模的作业也不是一件容易事，这一举动将为搜索带来更多资源，尤其是来自印刷内容的搜索，如学术论文。

这里有一个扫描文档的示例：Repairing Aluminum Wiring。更多资料可以访问 Google 的博客。

本文国际来源：http://www.techcrunch.com/2008/10/30/google-now-indexes-scanned-documents/
中文翻译来源：COMSHARP CMS （锐商企业CMS）官方网站

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
Google 开始对扫描文档进行索引

Google 宣布，他们即将对扫描文档进行索引并投入搜索，这意味着极其庞大的处理资源，以及高级图象处理能力。和普通文本文件不同，扫描文档不包含任何文字数据供 Google 索引，相反，Google 使用 OCR 软件对扫描的文档进行辨认，并转换成文字内容。过去，Google也曾尝试索引这些扫描的文档图片，但只能对文件名，以及附近的元数据进行索引，对图片内容则无能为力。从现在开始，Googl
复制链接

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。