![]()

摘要: 使用robots.txt协议阻止搜索引擎包含网站内容是不可行的,也不能用于阻止搜索引擎爬网程序. 即使设置了robots.txt协议,百度和Google仍将是网页. 建立索引并将其显示在搜索结果中,而不只是显示网页快照. 因此,搜狗输入法应使用robots.txt来防止搜索引擎抓取用户隐私信息.
安全问题反馈平台五云昨日通过新浪微博发布消息搜狗输入法有风险吗,搜狗输入法存在设计缺陷,可能导致大量用户敏感信息泄露. 用户发送的诸如图片和声音之类的多媒体文本消息被搜索引擎捕获并泄漏到Internet. 对此,Sogou说,问题出在诸如Microsoft Bing之类的搜索引擎未遵守禁止协议这一事实. Bing China表示Bing Search没有违反Robots.txt协议,该公司始终遵守有序,健康和道德的市场行为守则.

上述所谓的漏洞来自搜狗手机输入法中的“多媒体输入”功能. 借助去年5月发布的此功能,用户可以共享图片,语音和文本等信息. 原理是将用户要共享的信息上载到Sogou服务器,以形成可以单击以查看的链接. 这样,搜狗手机输入法就可以通过普通短信发送语音和图片,而朋友在收到短信后可以收听语音和查看图片.
在Wuyun的报告中,有人指出“由于不精确,信息被搜索引擎抓取了”. 例如,使用关键字“ site: pinyin.cn”进行搜索,您可以在Microsoft Bing中获得3700个结果,在Google中获得1120个结果.



Sogou认为用户的“多媒体输入”信息泄漏与搜索引擎未能遵守相关的Robots.txt协议有关,并指出关键问题是Bing搜索引擎.
Bing对与“搜狗输入法泄露用户隐私事件”相关的报告的官方回应说: “ Bing搜索未违反Robots.txt协议. 作为面向全球市场的互联网产品,必应必须始终遵循有序,健康和道德的市场行为准则,并积极推广负责任的数字公民理念;通过严格的数字安全考虑,为人们提供可靠的计算和网络体验. 我们呼吁并始终坚持为用户提供高度安全的Internet服务和产品. “

在Microsoft Bing声明的结尾,它还提到了Microsoft推出了Bing输入法之类的产品,该产品赢得了越来越多用户的关注和喜爱.
对于“搜索引擎的机器人协议”,Moonlight Blog此前对一篇文章进行了分析. 通常认为robots.txt文件告诉Spider程序可以在服务器上查看哪些文件. 但是,robots.txt协议不是规范,而只是约定. 通常,搜索引擎会识别此文件,但是有一些特殊情况.
通常来说,只要有其他页面链接到页面,搜索引擎就会为该页面编制索引. 让搜索引擎不通过robots.txt协议包含网站内容是不可行的,也不能使用它来阻止搜索引擎. 对于大多数爬网程序,搜索引擎只是不显示该页面的快照,其内容仍将显示在搜索结果中. 例如,淘宝目前使用robots.txt阻止百度抓取工具,但百度仍包含淘宝内容. 百度搜索“ Taobao.com”. 第一个结果也是淘宝首页的地址,但没有页面快照.
对于Google而言,使用漫游器可能不会阻止Google为URL编制索引,但是有一种方法可以防止网页内容出现在Google网页索引中(即使还有其他网站链接到该网页) ,实现方法是将以下行添加到页面的页眉部分.
<元名称=“ googlebot”内容=“ noindex”>
可以看出,使用robots.txt协议阻止搜索引擎包含网站内容是不可行的,也不能使用它来阻止搜索引擎爬网程序. 即使设置了robots.txt协议,百度和Google也会继续将网页编入索引并将其显示在搜索结果中,因此,搜狗输入法应使用robots.txt来防止搜索引擎抓取用户隐私信息.
有很多方法可以解决输入法泄露用户隐私的问题,例如限制对用户生成的链接地址的访问,仅允许两次访问或仅在24小时内生效的链接,这可以避免的访问私人信息泄漏. 如果要完全避免隐私泄露,则必须使用身份验证机制,例如发送带有验证码的短信,并在打开链接查看内容时输入验证码.
总而言之,当用户使用此“多媒体输入”功能发送文本消息时,他们可能会认为这与普通文本消息相同搜狗输入法有风险吗,并且不知道所发送的信息可能会泄露给第三方,因此开发人员具有此类隐私漏洞. 必须谨慎处理它并保护用户的个人隐私,而不能仅仅使用机器人协议来敷衍.

()()
本文来自电脑杂谈,转载请注明本文网址:
http://www.pc-fly.com/a/shouji/article-177304-1.html
养兵千日用兵一时
维持在中东的强大军事存在
可是合娶老婆你太恶心我了