◆ ◆ ◆

导读

提供洞察和分析的公司都在尽力为自己组建完美的数据科学团队,这通常有两条路可以走。

大部分公司都在挣扎中选择了第一条路:寻找这些工资非常贵又很少见的独角兽人才,即同时具备这多种技能的独立个体。

完美的数据科学家完美地掌握了数学、统计学、编程以及沟通技术。这些人不光具备完成复杂工作的专业技术能力,还能够向非技术人员解释这些技术工作可能会带来的影响。

除了这些数据科学家会很昂贵的事实之外,这些天才科学家一周7天,每天24小时连轴工作也是不太可能的。

当然这不是唯一的一条路。

人类史上最早的科学家之一亚里士多德曾经说过:“整体大于它的各部分之和”,这给了我们一些启发。与其寻找这些很受欢迎的同时具备三方面技能的人,还不如挑选分别具备其中一项技能的人来组成一个团队。毕竟,没有一个人能够永远解决组织不断增长的对数据科学研究的需求。它需要一个数学家来负责深入钻研,还需要一个具备交叉学科知识的人来进行横向整合,最终组成一个完美的团队。

◆ ◆ ◆

数据科学团队的活力

任何一个数据科学团队的终极目标就是要成为一个解决问题的机器,一个能在不断变化的环境中不断搅动出价值的团队。越来越丰富的数据给曾经无法回答的业务问题提供了可能,这就给客户对洞察复杂性的期待提升到了一个新的高度。但随着这一套连锁反应而来的却是没有成熟方法论和解决方案的问题。随着输入越来越多样化,所需要的匹配的技能同样需要变得多样化。“酷呆瓜”团队的三个特点没有一个是可以缺失的,因此这个团队的集体智慧才真正是当今数据世界的驱动力。

显然,完美数据科学家团队中的任意两块都无法独立于第三块运作。而且,挖掘并保持数据科学家团队的内部平衡才能带来最大程度的准确性和相关性。

  • 数学家/统计学家

这些受过训练的学者在理解了相关理论以及结果所需要的条件后,基于这些输入构建起先进的模型。

  • 程序员

这位亲自操刀的架构师负责清洗、管理以及修整数据,以及建造模拟器或其他高科技工具来使数据变得更加方便易用。

  • 沟通者/内容专家

将技术翻译为业务的专家利用自己的全局观,基于过去的知识帮助寻找技术与用户需求的连接点。

这些技能的互相支持才使得团队变得完整,并具备完美的数据交付能力:

数学家/统计学家的工作严重依赖于程序员。“垃圾进入垃圾出去”的概念在这里非常适用,也就是说如果程序员没有清晰地获取数据、管理数据,那么科学家很难构建出有用的模型。此外,数学家和程序员又依赖于沟通者的知识。即便数据是完美的,也符合统计学结论,如果其无法直接涉及到要解决的商业问题,那么这些就是没有意义的。此外,内部不平衡的团队将会面临一些无法充实准备的困难,也无法交付出完美的作品。

◆ ◆ ◆

是购买还是自建?

今天的世界充满了大量、高速的数据,企业都面临着一个选择。传统那些写代码来编辑调查问卷、收集数据的程序员都被整合在了具备洞察的组织中。然而,他们中的很多人都没有接受过数学或统计学的正统培训。同样地,那些面向客户并具有数值定量头脑的商务人才在团队构建中也应当有一席之地。培训现有数学或统计学人才是可行的,但漫长的过程需要极强的耐心。如果组织认可且相信他们已有的人才并且选择这条路来组建团队,这也就指向了需要填补的空白从而打造完美团队。

组织机构很久之前就知道数据的价值了,但如果没有人的参与,无论数据量有多大,细节有多深,到2019年实现数据科学300亿美金的估值都是很难的。一个互相平衡的团队对各类数据作出的解读、过滤以及修正都会加速这种成长并提升数据科学的重要性。

许多人觉得Hilary的“酷呆瓜”概念只适用于个人。但实际上,我们必须认识到团队的集体“酷”也是充满潜力的。

当组织在组建和招聘数据科学团队时,或许团队宗旨可以简单的称为“如果你能找到呆瓜,那就留住他们。但如果缺少聚集了各类独角兽人才的团队,那就创造一个。”

原文发布时间为:2016-12-02

本文来自云栖社区合作伙伴“大数据文摘”,了解相关信息可以关注“BigDataDigest”微信公众号

找不到完美数据科学家?你还可以组建一支数据科学梦之队相关推荐

  1. 数据科学家为什么还要学藏语?这不科学。首份藏文数字数据集出炉

    数据科学家:为什么还要学藏语?这不科学. 亲,结论别下得这么早. 这是一个杠精式的对话. 藏语应当从西藏讲起,西藏是全世界人民群众最喜欢的文化边区之一. 仓央嘉措曾说,住进布达拉宫,我是雪域最大的王. ...

  2. 大数据数据科学家常用面试题_面试有关数据科学,数据理解和准备的问答

    大数据数据科学家常用面试题 问题1:在数据科学术语中,您如何称呼所分析的数据? (Q1: In the data science terminology, how do you call the da ...

  3. 《数据科学家养成手册》--第四章---数据科学的使命

    4.1.2  从信息到数据 1948年香农(好像吐槽输入法)发表的论文<通信的数学理论>(A Mathematical Theory of Communication)其中的话: if t ...

  4. hadoop将消亡_数据科学家:适应还是消亡!

    hadoop将消亡 Harvard Business Review marked the boom of Data Scientists in their famous 2012 article &q ...

  5. 关于自然语言处理,数据科学家需要了解的 7 项技术

    作者 | George Seif 译者 | 孙薇,责编 | 屠敏 头图 | CSDN 下载自东方 IC 出品 | CSDN(ID:CSDNnews) 以下为译文: 现代公司要处理大量的数据.这些数据以 ...

  6. 数据科学家经典20道面试题

    Q1.解释什么是正则化,以及它为什么有用. 回答者:Matthew Mayo   正则化是添加一个调优参数的过程模型来引导平滑以防止过拟合.(参加KDnuggets文章<过拟合>) 这通常 ...

  7. 为什么我劝你不要当数据科学家?

    作者丨Chris 译者丨Sambodhi 策划丨陈思 数据科学家这一职位越来越火热,人人都想从事数据科学,这不仅因为这份工作听上去高大上,更重要的是,它真的是一份高薪的工作.但是,数据科学家是人人都能 ...

  8. 避坑指南:数据科学家新手常犯的13个错误(附工具、学习资源链接)

    作者:Pranav  Dar 翻译:和中华 校对:张玲 本文约6000字,建议阅读10+分钟. 本文是老司机给数据科学家新手的一些建议,希望每个致力于成为数据科学家的人少走弯路. 简介 你已经决定把数 ...

  9. 如何区分大数据下的三大利器:数据科学家,数据工程师与数据分析师

    与其他一些相关工程职位一样,数据科学家的影响力与互联网同进同退.数据工程师和数据分析师与数据科学家携手共同完成这幅"大数据时代"巨作.他们共同努力拟定数据平台要求,基础和高级算法, ...

最新文章

  1. 哈希--直接定值法和除留取余法
  2. Spring-AOP @AspectJ进阶之绑定类注解对象
  3. Problems encountered while deleting resources. Could not delete 'E:\MyEclipse file\check\WebRoot\i
  4. (转载)cmd-命令大全及详解
  5. 来和 webpack 谈场恋爱吧!这课程好甜!
  6. frm ibd文件导入mysql_Mariadb,Mysql如何根据.frm和.ibd文件来恢复数据和表结构
  7. nginx 代理静态资源报 403
  8. 20年未解的MIT密码难题,被自学成才的程序员破解了,比预计早15年
  9. 如何搭建apache+tomcat集群
  10. USB转串口那些事儿—USB转串口工作原理及应用
  11. 大数据分析师的报考条件是什么?
  12. 将图片转化成SVG格式(亲测可行)
  13. angular实现双向绑定
  14. 4.20 视频面试字节_光大银行_神策
  15. Windows环境下Redis安装操作步骤
  16. 八、血条的制作和boss敌人的产生(雷霆战机)
  17. 期末大作业+毕业设计:在线电影网站设计——影视大全(6页面)含登录注册HTML+CSS+JavaScript
  18. 如何计算满足指定条件下数值的平均值——DAVERAGE函数的使用
  19. Java - IO部分的学习总结
  20. 快讯 | 第80届金球奖揭晓

热门文章

  1. 代码结构中 Dao,Service,Controller,Util,Model 是什么意思,为什么划分?
  2. 还在直接操作 Redis?赶快来试试这个
  3. 骚操作 !IDEA 防止写代码沉迷插件 !
  4. 昨天还在 for 循环里写加号拼接字符串的那个同事,今天已经不在了
  5. 据说中台凉了?唔,真香
  6. StackOverflow上面 7个最好的Java答案
  7. Git 2.25.0发布,支持部分clone、稀疏checkout
  8. 为什么阿里巴巴不建议在for循环中使用+进行字符串拼接?
  9. 数据科学干货分享来了!
  10. 支持向量机背后的数学原理!