俄罗斯第一大科技巨头,这回遇上了大麻烦:

44.7GB源代码,全被泄露到了网上。

什么概念?

就是这家名为Yandex的公司,几乎所有主要服务的源代码都被挖了个底掉……

要知道,在俄罗斯,Yandex不仅干着搜索引擎的活儿,还把俄国老百姓购物、打车、订外卖、租车这一连串生活服务都给包圆了。

简单来说,约等于俄版百度+淘宝+美团+滴滴。



这么大个事儿,自然引起了全世界网友的围观。

但就在众人纷纷猜测这又是哪家黑客手笔之际,Yandex的声明却有些令人大跌眼镜:



44.7GB源代码遭泄露,代码被扒了个底朝天

具体来说,泄密链接最早出现在了一个黑客论坛上。

泄密者称,这份44.7GB的Yandex代码库,包含该公司2022年7月以前,除反垃圾邮件规则之外的所有源代码。



这些被泄露出来的代码信息量到底有多大?

看看网友们热火朝天扒出来的细节就知道了……



Yandex不是以搜索引擎起家,常被称作“俄版百度”/“俄版谷歌”嘛,那就先以搜索引擎部分的代码为例。

一位名叫Alex Buraks的老哥就深扒了下Yandex搜索引擎的排名规则,还戏称这对理解谷歌SEO(搜索引擎优化)有很多有用的信息。

毕竟Yandex和谷歌的搜索结果有70%的匹配度,不少人认为其搜索技术用的就是谷歌同款:如PageRank、BERT等。

(掌握了Yandex的规则不就相当于透了谷歌排名算法的家底,手动狗头)



目前已经有大批吃瓜群众来围观,甚至Alex Buraks的这条线程曾在谷歌搜索“yandex”中排名第8。



有趣的是,在Yandex的排名因素中,排在第一个的就是PageRank



Buraks还直接列出了Yandex的10个排名因素:



当然这还只是其中的一部分,Buraks表示后续还会继续分析。

除了Alex Buraks,也有不少营销大师深扒了Yandex的排名因素,甚至有人都详细整理出了完整的1900+个排名因素。



值得一提的是,在各路大神扒代码的过程中,Yandex搜索引擎的一些“潜规则”也被摆上了台面。

就比如说加拿大黑客Aubrey Cottle就在代码中发现了Yandex是容忍种族歧视的。



还有网友在代码中发现,Yandex的广告投放中,普通广告和色情广告是分开计算的。



官方声明:没有被黑,是前员工泄密

这事儿一出,很快还有一份详细的泄密文件目录被整理出来放在了GitHub上。

作者是一位名叫Arseniy Shestakov的软件工程师。据他评估,这些源代码确实涉及了Yandex的所有主要服务。

包括:

还包括在线协同办公、支付、数据分析等等业务。

不过,泄露内容并不包括用户数据等敏感信息。

Arseniy Shestakov总结了几个关键细节:



△Yandex办公楼

事情闹得这么大,Yandex官方也坐不住了,很快发表声明表示:其实我们并没有被黑,是前员工出卖了我们!

Yandex倒是信誓旦旦,但外部的专业人士却有不同看法。

据bleepingcomputer消息,前Yandex技术专家Grigory Bakunov对此事做出了回应。

他认为,这次代码泄露确实不会对用户的隐私或安全构成直接风险,也不会直接威胁到Yandex的专有技术。

不过一些文件仍可能会暴露正在运行的服务,比如说“blacklist.txt”,Bakunov还称:

泄露代码目录:
https://gist.github.com/ArseniyShestakov/53a80e3214601aa20d1075872a1ea989

参考链接:
[1]https://www.bleepingcomputer.com/news/security/yandex-denies-hack-blames-source-code-leak-on-former-employee/
[2]https://arseniyshestakov.com/2023/01/26/yandex-services-source-code-leak/
[3]https://twitter.com/Kirtaner/status/1619007274202329091
[4]https://twitter.com/dom_woodman/status/1619028740201398274
[5]https://twitter.com/alex_buraks/status/1618988134850785280