12192 17

[水煮经管] 在Booking当数据科学家是怎样一种体验 [推广有奖]

企业贵宾

巨擘

0%

还不是VIP/贵宾

-

威望
4
论坛币
624047 个
通用积分
147.0356
学术水平
918 点
热心指数
988 点
信用等级
842 点
经验
398692 点
帖子
9795
精华
48
在线时间
17322 小时
注册时间
2014-8-19
最后登录
2022-11-2

相似文件 换一批

+2 论坛币
k人 参与回答

经管之家送您一份

应届毕业生专属福利!

求职就业群
赵安豆老师微信:zhaoandou666

经管之家联合CDA

送您一个全额奖学金名额~ !

感谢您参与论坛问题回答

经管之家送您两个论坛币!

+2 论坛币

在Booking当数据科学家是怎样一种体验

1.jpeg


作者 Nishikant Dhanuka

编译  Mika

本文为 CDA 数据分析师原创作品,转载需授权


Nishikant是分享了自己在Booking从数据科学家新手到大师的发展历程。


# 求职


在迪拜做了3年咨询类工作之后,我作为一名数据科学家加入了Booking 。从咨询转行为数据科学家是我职业生涯中的重大转变,现在看来我很高兴当初做了这一选择。


在面试时,我就对Booking的感觉特别好。我有机会与数据科学家交谈,面试官的背景非常多样,其中一位拥有天文学的博士学位,另一位是自己创业公司的首席技术官。


同时Booking的伙食特别好,这也是我选择Booking的原因之一。


# 入职


我还记得入职的第一天,同事问我”你对你的屏幕还满意吗?”这让我很意外,因为我以前工作时只配备了一台笔记本电脑。Booking之后给我配备了一台Mac、两个大屏幕以及其他一些酷炫的设备。


入职后不久,我参与的第一个入职项目涉及到分析大量文本,我需要从中得出业务见解。以前我只有结构化数据方面的经验,因此我对这个新挑战感到兴奋。我希望提高自己文本数据的水平,但不久之后我就遇到困难了,那就是Booking庞大的数据规模。


Booking每24小时售出150万个房间,同时有数百万人访问网站,这意味着数据科学家所接触的数据规模相当大。还好公司有使用Spark进行分布式计算的内部培训。通过培训,如今我能够在多台机器上运行分析。


# 项目


我的第二个项目是为合作网站构建推荐引擎。以前我只做过标准回归和分类模型,这是我第一次接触到协同过滤和分解机。


由于数据规模,我不得不用PySpark进行稀疏分布矩阵。在编写代码之后,我们进行了A / B测试,看这样是否会对我们的业务带来积极影响。这也是我第一次接触A / B测试,但幸运的是公司配有完备的实验工具和基础设施,从而让这一过程并不困难。通过多次迭代,我们顺利处理了冷启动问题,并成功完成了该项目。


2.jpeg

Booking的数据科学家在Analytics Fair上展示项目


接下来是大量的项目,每个项目都有不同的挑战,作为一名数据科学家我需要不断地学习。例如,其中一个项目需要我将业务问题表示为加权网络图,并进行相关分析; 在另一个项目中,我需要从简单的数据分析中得出有价值的见解。


就这样过了两年半,我目前是Booking的高级数据科学家。现在我致力于研究人工智能产品的机器翻译,并通过部署神经网络和深度学习解决方案构建全面的生产系统。虽然机器翻译最近取得了一些突破性进展,但我们仍然采用

“商业优先 ”的方法为客户提供帮助。


# 团队构成


下面我打算介绍下Booking团队内数据科学家的组织方式。


我们采用“嵌入式”结构,其中数据科学家与业务紧密相连。例如,我参与的团队中有开发人员、数据科学家、产品负责人和其他专家。团队结合所有的力量,将相关概念实施到具体产品。在日常运营中,我们遵循一定的准则:每日会议、回顾、待办事项、团队目标、KPI和OKR(目标和关键结果)。再加上每两周一次的会议,能够让团队稳步发展,并尽快学习。


正是与业务的紧密联系,Booking的数据科学家都有很强的沟通能力和商业意识,同时还有很强的专业技能。这些都是我们在面试求职者时要测试的基本技能。


# 出色的数据科学家


Booking共有120 多名数据科学家,而且社区在日益壮大。每位数据科学家都有不同的背景和工作强项。


有些人是数据科学新手,有些人则有丰富的工作经验; 有些人是贝叶斯派,有些人是频率学派; 有些人喜欢用R语言,有些人更喜欢用Python; 有些人喜欢用Vowpal Wabbit,有些人则喜欢使用Spark和H2O进行分布式计算。


这种多样性可以让大家彼此学习和进步。我们每周都会举行相关的聚会和会谈,当中我们会谈论最新的行业动向和研究论文,并用于解决Booking的实际问题。此外,公司还会定期举办相关技术培训,包括A / B测试、Git、Hive、Python、R、Spark、H2O、TensorFlow等内容。


3.jpeg

Booking数据科学社区每周会谈


在我看来,在Booking工作最大的财富就是出色的数据科学社区,在当中我每天都能学习新事物,并且十分开心。


# 面对的挑战


同时我们也有面对一些挑战。


首先,由于我们的数据科学社区发展得非常快,这也为分享知识带来了难度。为了解决这个问题,我们尝试了很多方法,比如针对专业的话题(比如自然语言处理),黑客马拉松等方面展开讨论,从而更好地分享知识。


让数据科学家参与业务也有其不利之处。有时在日常工作中我们会错过同事的相关反馈。为了解决这个问题,我们鼓励大家分享各自的成果,并与同事一起讨论他们的最新项目。我们也为新员工提供导师计划。


尽管我们已多次为数据科学社区做出贡献,但我们也希望将成果分享给外部世界。我们目前正在制定一些指导方案。


4.jpeg

Booking的数据科学家们在船上聚会


最后我想说,在Booking当数据科学家非常愉快,而且从来不会缺少机遇与挑战。


原文链接

https://towardsdatascience.com/diary-of-a-data-scientist-at-booking-com-924734c71417



二维码

扫码加我 拉你入群

请注明:姓名-公司-职位

以便审核进群资格,未注明则拒绝

关键词:booking 数据科学家 数据科学 King Book 数据科学家 数据 分析

已有 1 人评分经验 收起 理由
remlus + 100 精彩帖子

总评分: 经验 + 100   查看全部评分


https://www.cda.cn/?seo-luntan
高薪就业·数据科学人才·16年教育品牌
沙发
Bi_Bi_er_er 学生认证  发表于 2018-9-10 10:36:02 |只看作者 |坛友微信交流群
挺好的推荐!谢谢楼主{:2_31:}

使用道具

藤椅
RICHARDSXH 发表于 2018-9-10 12:38:54 |只看作者 |坛友微信交流群
谢谢推荐  学习

使用道具

板凳
errorzhu 学生认证  发表于 2018-9-10 15:28:40 |只看作者 |坛友微信交流群
谢谢推荐  ~学习~

使用道具

报纸
eeabcde 发表于 2018-9-10 16:20:40 |只看作者 |坛友微信交流群
支持一下!

使用道具

地板
liubin85419 发表于 2018-9-10 16:37:35 |只看作者 |坛友微信交流群
支持一下!

使用道具

7
zoomivy 发表于 2018-9-10 20:08:54 |只看作者 |坛友微信交流群
支持一下!

使用道具

8
xujingjun 发表于 2018-9-11 07:47:32 |只看作者 |坛友微信交流群

使用道具

9
escaflowne1985 在职认证  发表于 2018-9-11 09:09:15 |只看作者 |坛友微信交流群
居然看完了,我觉得需要掌握的技能还是很多的

使用道具

10
wuyan11 发表于 2018-9-11 09:09:40 |只看作者 |坛友微信交流群
支持一下

使用道具

您需要登录后才可以回帖 登录 | 我要注册

本版微信群
加JingGuanBbs
拉您进交流群

京ICP备16021002-2号 京B2-20170662号 京公网安备 11010802022788号 论坛法律顾问:王进律师 知识产权保护声明   免责及隐私声明

GMT+8, 2024-4-26 04:33