作者 Jonathan Allen ,译者 张晓鹏

Splunk的用户大会已经接近尾声。三天时间的会议里,共进行了160多个主题研讨,涵盖了从安全、运营到商业智能,甚至包括物联网,会议中一遍又一遍出现相同的中心主题:大数据的关键是机器学习。

存储不再是一个问题。从运行Hadoop兼容节点的专用存储硬件,到数百台使用普通硬盘的计算机组成的集群,毫无疑问,我们具备了处理这类存储问题的能力。另一方面,像Splunk这样的分析和可视化工具也应运而生。如果你知道你要找什么,这些工具可以很快给你所需要的答案。

但是,你应该找什么呢?对于绝大多数的基层供应商来说,问题的答案就在机器学习里面。无论你是在谈论网络流量、用户行为,或者是消费趋势,这都不要紧,你能真正洞察你所监控的东西的方式是找到数据中的模式和相关性。虽然人类操作员可以通过试错法蹒跚而行,但他们相信,可以通过训练计算机来得到结果,并且速度更快和不带偏见。

当然,这并不是说人类已经过时。必须有人来确认相关性不只是种巧合,并找出对信息采取行动的方法。而这也正是前面所提到的可视化工具可以发挥作用的地方。

大数据和机器学习的主要用例

虽然大数据的潜力几乎是无限的,但不可避免的是一或两个行业会在前面带头冲锋。如果再过一年问我,我可能会说不同的话,但现在的预测是,无论是安全还是运营,都会处在第一线。

只要比那些只收现金的咖啡亭大的公司,都需要考虑信息的安全性。即使他们没有知识产权可言,但他们都在处理一些敏感信息,如信用卡号码。有方法可以可靠地检测和阻止那些正在发生的违约行为,对公司的长期成功是至关重要的。基于机器学习的安全产品承诺提供这种能力,并且它的易用性接近“交钥匙工程(译者注:意为卖方把所有事情都做好了,买方只要拿钥匙验收就可以了)”的水准。

与此类似,运营分析将会流行起来。现在你就可以买到工具来监视你的网络,解码数据包,或向你精确呈现一个给定的REST调用是如何经过服务器的中间层一路到达数据库或文件系统的,然后把它和一周,一个月或一年以前的行为做对比。这不是未来的概念,而是今天现成的东西,并可以在一周内运行起来。

其它领域的研究将会继续下去,但不会有如此快的速度。欺诈检测是非常重要的,但大多数公司会依靠他们的金融机构来设计和实施必要的控制措施。我预计在这方面不会有太多商业化的、现成的产品。

商业智能是另一个会看到大量金钱投入的研究领域。但可口可乐与百事可乐公司用来确定下一个流行口味的算法,看起来一点也不像通用和福特公司用来预测每种尺寸的车型会有多少量的算法。如此类推,商业化产品对大数据的运用目前可能会主要局限于基本的分析和可视化方面。

其他的会议思考

总而言之,Splunk举办了一次非常好的会议。一切都组织得很好,每个人,从初学者到最高级的数据挖掘工程师,都会有相关的议题研讨。我唯一的抱怨是,议题研讨没有记录。因为有这么多的内容,人们势必会因为冲突错过一两个重要的议题。

即使你对Splunk本身不感兴趣,但对大数据、机器学习以及相关主题感兴趣的任何人来说,这都是一次重要的会议。

查看英文原文:Splunk Conference Recap: The Key to Big Data is Machine Learning

Splunk 会议回顾: 大数据的关键是机器学习相关推荐

  1. Splunk 会议回想: 大数据的关键是机器学习

    作者 Jonathan Allen ,译者 张晓鹏 Splunk的用户大会已经接近尾声.三天时间的会议里,共进行了160多个主题研讨,涵盖了从安全.运营到商业智能,甚至包含物联网.会议中一遍又一遍出现 ...

  2. 美国大数据研发关键领域的七个战略

    大数据有可能从根本上改善所有美国人的生活.为了从资源丰富的大数据中获得最大的效益,奥巴马政府于2012年3月29日推出了"大数据研究与开发计划".在此基础上,美国又于2016年5月 ...

  3. 大数据的关键不是“大”,而是你真的需要它吗

    大数据的关键不是"大",而是你真的需要它吗 诸如我们听到的.看到的和正在自觉或不自觉地参与的,大数据已成为一项大工程,它无处不在.我们对待它就像在迎接自己的终生伴侣,兴奋之情溢于言 ...

  4. 大数据原理-关键技术

    大数据时代 大数据的由来 关键核心技术 计算模式 大数据的由来 关键核心技术 计算模式 大数据的由来: 4V大数据量.繁多的数据类型.处理数据的速度快.价值密度低 使得出现了大数据时代 关键核心技术: ...

  5. 阿里巴巴大数据技术关键进展及展望

    摘要:2019杭州云栖大会大数据技术专场,由阿里云通用计算平台负责人关涛带来以 "阿里巴巴大数据技术关键进展及展望" 为主题的演讲.本文首先讲解了从阿里巴巴的角度看待大数据领域的客 ...

  6. 如何快速全面建立自己的大数据知识体系? 大数据 ETL 用户画像 机器学习 阅读232 作者经过研发多个大数据产品,将自己形成关于大数据知识体系的干货分享出来,希望给大家能够快速建立起大数据

    如何快速全面建立自己的大数据知识体系? 大数据 ETL 用户画像 机器学习 阅读232  作者经过研发多个大数据产品,将自己形成关于大数据知识体系的干货分享出来,希望给大家能够快速建立起大数据产品的体 ...

  7. 大数据 深度 分页_机器学习、深度学习、大数据 ?傻傻分不清楚?

    提起机器学习四个字,不知你的脑海中是否会有一丝印象?毕竟身处信息时代,在日常生活中,无论通过什么媒介,接触到这个名词概念的机会还是挺大的.与之类似,还有以下这些名词概念:数据分析.数据挖 掘.深度学习 ...

  8. 干货解读 |大数据,数据挖掘,机器学习的区别和联系

    大数据 大数据(big data),或称巨量资料,指的是所涉及的资料量规模巨大到无法透过主流软件工具,在合理时间内达到撷取.管理.处理.并整理成为帮助企业经营决策更积极目的的资讯. 研究机构Gartn ...

  9. 送100本书!涵盖Java 、大数据、推荐系统、机器学习、黑客、数据库、手游、少儿编程等!免费包邮!...

    「清华大学出版社」联系了包括架构师小秘圈在内的 10 家技术公众号,送出 100本技术书.内容涉及Java. 大数据.推荐系统.机器学习.黑客.数据库.手游.少儿编程等! 01 书怎么送 在下面的公众 ...

最新文章

  1. 图像拼接 Image-based only, no GPS/IMU data
  2. android MAT使用
  3. multisim怎么设置晶体管rbe_Multisim 10在单管共射放大电路中的应用
  4. 【朝夕技术专刊】WebApi部署多服务器配置Nginx负载均衡
  5. 又一起!北大副校长詹启敏院士被疑25篇论文造假
  6. oracle导出有分区表的用户,分区表导出导入
  7. “霸座女”越席乘坐火车并阻碍民警执行职务被拘留
  8. 使用ubuntu系统中遇到的问题及解决方案
  9. r语言 图形一览_R语言实战(第2版):第三章 图形初阶(01)
  10. ib课程计算机科学教材,热门课程:IB计算机科学的评估方式
  11. ARM计划将四核心CPU引入磁盘驱动器
  12. java.lang.NoClassDefFoundError: org/springframework/core/metrics/ApplicationStartup
  13. 基于Android的百度地图显示
  14. Excel·VBA数组组合函数、组合求和
  15. Subversion vs Subclipse
  16. 论NOIP2015我是如何滚粗的
  17. 机器学习4种调参自动优化方法,第二款是我的最爱!
  18. 迅捷路由器造成计算机无法上网,迅捷fw325r路由器不能上网(连不上网)怎么办?...
  19. VMware虚拟机装系统出现Units specified dont exist解决办法
  20. 人工智能轨道交通行业周刊-第44期(2023.5.8-5.14)

热门文章

  1. 惠斯登电桥传感器电路设计技巧,了解一下?
  2. 符合IPC-9704标准的应力测试仪TSK-64/TSK-32
  3. 时间序列预测基础教程系列(14)_如何判断时间序列数据是否是平稳的(Python)
  4. magisk安装与配置
  5. 专题分纲目录 MEM/MBA数学基础
  6. 音视频开发(十四):OpenGL 与 OpenGL ES2区别
  7. 人体存在感应+毫米波雷达技术,你知道多少?
  8. 某二级支行网络的设计与实现
  9. 使用个人股票量化接口做股票投资靠谱吗?
  10. UVA-10929-You can say 11(秦九昭算法+同余与模算术)