所在位置:

首页众企业动态企业动态Google 开始对扫描文档进行索引

Google 开始对扫描文档进行索引

时间:2024-05-03浏览次数:40409TAG:Google  扫描  搜索  文档  索引  内容  文字  进行  更多  辨认  资源  

Google 宣布,他们即将对扫描文档进行索引并投入搜索。


这意味着极其庞大的处理资源,以及高级图象处理能力。和普通文本文件不同,扫描文档不包含任何文字数据供 Google 索引,相反,Google 使用 OCR 软件对扫描的文档进行辨认,并转换成文字内容。


过去,Google 也曾尝试索引这些扫描的文档图片,但只能对文件名,以及附近的元数据进行索引,对图片内容则无能为力。从现在开始,Google 搜索将包含这些通过 OCR 软件辨认出来的文字内容,用户在搜索中遇到扫描文档,Google 会提供选项,让你以 PDF 或 HTML 格式阅读。


这类技术早已存在,但准确性一直是个问题,同样,如此大规模的作业也不是一件容易事,这一举动将为搜索带来更多资源,尤其是来自印刷内容的搜索,如学术论文。


更多资料可以访问 Google 的博客。


来源:techcrunch.com  翻译:锐商企业CMS



>> 查看更多相似文章



相关阅读

加盟热线:

4008-598-678

地址:厦门思明区软件园二期望海路19号之二303

QQ:渠道(907010669),代理(370735343

众企业专注企业网站建设、企业网站制作、企业建网站

全国分站

Copyright © 2016众企业网站建设平台.All Rights Reserved. 闽ICP备15015615号-5   耗时:0.02706s
首页
菜单
代理
版面
全国