13招神技 让你在数据科学和数据分析工作中脱颖而出

我有幸在很早参与了一个大数据科学项目,我非常喜欢其中的工作,甚至我意识到我的努力可以增加一些公司的价值。

然而,可悲的是,只有不到30%的数据科学项目最终实施了。我备受打击的意识到我的努力被浪费了。但是,我不是唯一的一个。几乎,每一个分析家都有同样失望的感觉。

即使在今天,数据科学行业面临的真正挑战是企业和分析人员之间缺乏协调。令我惊讶的是,我甚至注意到,这些人更喜欢坐在同一个办公室里坐在一起。

如果这两种技能的专业人士很普遍,我们就可以看到一个实施可能性更高的项目。在过去的四年里,我花了很多时间思考使一个项目成功的最佳实践。

我发现,如果有个对症的人坐在你的办公室,他能明确定义业务问题,并且诱导你突破思维定式,你将突破管窥限制。

因此,你在数据科学/分析工作中正在取得成功时,我建议你遵循下面提到的提示。这些都是尝试和测试的总结。为了获得最大的利益,我建议你遵守。我从他们身上已经受益。现在轮到你了!

以下是优先顺序

在你开始解决问题之前请先掌握业务

我知道你是一个数据分析师,所有你关心的都是数字。但是,一个令人敬畏的业务分析师和一般数据分析师有哪些不同呢?那就是他们对业务理解的潜质。你应该在开始你的第一个项目之前试着去了解企业。下面是一些你应该需要探索的东西:

客户信息:活动客户总数,月客户流失,业务上的业务组合定义。

经营策略:我们如何获得新客户,渠道有哪些?我们如何留住有价值的客户?

产品信息:你的客户如何被你的产品吸引?你如何通过你的产品赚钱?你的产品是直接盈利者还是媒介工具?

如果你能回答这些问题,你对开始你的第一个项目已入门。

想想你是正在解决一个潜在问题,还是只是一个结果

我观察到,分析师瞄准的甚至不是问题的主要目标。例如,让我们想象一下,我们发现,一个客户在拨打客户服务电话,谈话更多的是他在放弃服务。

现在,如果我们开始解决降低客户服务的呼叫数量的方法,我们可能不会降低流失率。相反,在你没有过失的情况下,我已经看到你客户较高的不满。这可能是一个简单的致命伤,你会拒绝进入这种简单的陷阱。但是,现实生活中的问题几乎难以发现。我想说,解决一个明确的问题要比找到解决问题的正确方法要容易的多。

花费更多的时间在找到正确的评估指标和完成工作需要的必备条件

这个可能是对分析师来说是非常容易解决的一个难题,但也是最容易导致失败的一个陷阱。让我用几个简单例子来做解释。

假设,你将要建一个营销活动的目标模型,你将选择哪个指标来评估你的模型:

KS正态分布统计

等分提升指数

AUC-ROC曲线

Log-Likelihood 对数似然数

在这种模型中,我常会选择KS正态分布曲线。等分提升指数只能给你在某个特定等分的评估,因此,它可能不会帮助我们找到巨大的目标人群和突破点。AUC-ROC曲线可以对整体人群评估,不适合在这个模型中。对数似然数可能是最大的最不适合这个模型,因为所有的事情是顺序排名而不是实际概率。

使用发散-收敛的思维过程,以避免过早收敛

我已经看到这在许多行业是最大的问题。当今的商界领袖在他们所做的一切中寻求创新。

要真正的创新,您可以遵从发散-收敛的系统方法。在某种程度上,你需要对将要到来的进行发散思维,通过这种方法你得到更多的经验。我们的意思是想所有的可能方式,在可行性、时间发展、传统方式等各个方面破解难题。但是,你确信你已经发散到足够大了,你需要立即应用所有的约束条件来缩小方法。

打破行业壁垒想到替代解决方案

分析正在使用在每一个可能的行业中。但是,为什么我们不能超越传统的方法,在其他行业寻找解决方案?

例如,一个应用于电子商务行业的推荐视频解决方案可以像Analytics Vidhya公司在博客门户使用一样好。唯一的方法就是与其他行业的人进行互动,通过分析来学习他们奋斗的成果。

与业务伙伴共同前行

从你的分析事业的第一天起,你应该与业务伙伴进行互动。我常常会看到一件一般会出错的事,分析师和业务伙伴就解决方案交流很不频繁,业务合作伙伴想远离技术细节从业务角度进行分析,这确实对项目不利。在模型实施和模型建模中保持持续的互动是非常重要的。

思考最简单的让你的想法落地的方案

我知道你是一个数据分析师,喜欢用复杂的想法让业务人士迷惑。和业务人士使用如此复杂的讨论可以帮助你快速结束眼前的谈话,但会降低成功实施的可能性

以下是你需要做的:一旦你输出一个指标,尽量找出一个简单的方式,可以让企业更容易理解。让我给你这个方法的一个例子。我们试图找出那些一旦有机会,就可以做的非常好的代理商,我们想出不同层次的人群和他们预期的表现。然而,我们不得不选择一个可以区分人群组合的方式。我们所做的很简单:我们实施了差别收费策略,以改变申请人的组合和我们群体的组合。

当做一个业务组件的时候,确保你把它放到它们的语言场景中

目标指标永远不是你分析的最终产品。它只是一个业务组件!因此,你需要在使你的想法更清晰和更有效而投入大量的精力。尝试学习能与你的听众更好连接在一起的术语,思考你的商业伙伴想寻找什么,假象你是他们的鞋子。

给企业领导做讲演的时候学会使用业务语言

我最近开始为我的一个项目学习中文。整个项目都非常简单,但我发现,即使有一个强大的模型,在销售它的时候我犯了个错误。原因是我对他们内部讨论的理解一篇空白。使用你的听众的语言是非常重要的。我看到非常简单的模型被赞赏和最聪明的模型被拒绝。唯一的区别是分析师在介绍他们的模型时使用的业务语言。

积极跟进落实计划

最后来的但不是最不重要的,一旦每个人都相信你的模型的有效性,会发生什么。你的工作还没有完成。建立每月项目跟进计划,了解项目如何实施,是否在正常的进行。

积极参与数据类的比赛

随着时间的发展,你会意识到一件事情:分析行业的变化非常快。然而,如果你是喜欢待在自己舒适区的一个人,你很快就会发现你的技能都过时了。我发现一个非常有用的方法就是参与数据类的科学竞赛,并与同行竞争/学习。 Kaggle 和Analytics Vidhya就是一些非常好的比赛。

通过博客和书本学习关于分析方面的最新工具和技术

《Programming Collective Intelligence》集体智慧编程

《Machine Learning for Hackers》黑客机器学习

《The Elements of Statistical Learning: Data Mining, Inference, and Prediction》统计学习的要素:数据挖掘、推理和预测

《Learning from Data》从数据中学习

《Pattern Recognition and Machine Learning》模式识别与机器学习

学习最新的工具,以了解什么是可能的,什么不是

走出你在SAS、R、 编程的安乐窝,试着学习最新的技术来掌握大数据,Spark和java将是我对入手的建议。

本文链接http://www.36dsj.com/archives/37512

本文分享自微信公众号 - CDA数据分析师(cdacdacda)

原文出处及转载信息见文内详细说明,如有侵权,请联系 yunjia_community@tencent.com 删除。

原始发表时间:2015-11-26

本文参与腾讯云自媒体分享计划,欢迎正在阅读的你也加入,一起分享。

发表于

我来说两句

0 条评论
登录 后参与评论

相关文章

来自专栏AI科技评论

业界 | 百度研究院院长林元庆:解读《最强大脑》背后的技术

AI科技评论按:近日,《最强大脑》第四季落下帷幕,凭借在人脸识别和图像检索方面的出色表现,百度人工智能机器人小度荣获“脑王” 称号。4月11日,百度以此为主题在...

36770
来自专栏CSDN技术头条

工作中,你真的会表达数据吗?

来源 | 《用数据讲故事》 我们要的不是数据,而是数据告诉我们的事实 在幻灯片中,数据的作用一直很受重视。在工作场合,饼图、柱形图、条形图、折线图、散点图充斥在...

32930
来自专栏AI科技评论

小i机器人发布最强大脑2.0平台 语义识别渐渐浮出水面

最近Bot这种虚拟机器人成为了国际新热点,但于有些人而言,它们已经做了十几年。 席卷全球的Bots风让语义识别渐渐浮出水面 长期以来,语音交互领域的公司,我们对...

43270
来自专栏机器人网

机器人容易被骗?谷歌AI研究人员将改变这种状况

据外媒报道,让机器人看到不存到的东西或完全让其将图像归类错误也许是一场有趣、好玩的游戏,但如果一套汽车的自动驾驶系统将一辆白色卡车错认成一朵白云时,这一切就跟好...

364120
来自专栏深度学习与数据挖掘实战

干货|新浪微博“一次增长黑客实践”总结

作者:李江

17620
来自专栏AI科技评论

谷歌之后,亚马逊也开源了自家的深度学习工具

GAIR 今年夏天,雷锋网将在深圳举办一场盛况空前的“全球人工智能与机器人创新大会”(简称GAIR)。大会现场,雷锋网将发布“人工智能&机器人Top25创新企...

43280
来自专栏云计算D1net

IT专家指导企业如何使用大数据

目前大数据市场日益升温,由此大数据驱动了巨大的消费增长。 研究公司IDC预计大数据技术和服务市场将以27%的速度逐年增长,到2017年达到324亿美元。 尽管资...

38570
来自专栏大数据文摘

算法告诉你,达芬奇和莫奈谁更有创造力

29270
来自专栏灯塔大数据

原创译文 | 社会对于机器学习最大的误解是什么?

导读:上一期了解一下人工智能时代,五大最具潜力的职业,今天我们来学习一下机器学习和数据科学的应用,对于企业的重要性,以及作者对于机器学习和数据科学的未来思考(文...

34670
来自专栏AI研习社

普通程序员想投身 AI 行业?知乎大 V 阿萨姆分享开发者转型的机遇与挑战

据 LinkedIn 发布的「全球 AI 领域人才报告」显示,2011 年深度学习技术爆发,人工智能领域有了飞跃式的发展,但核心人才资源的短缺限制了国内人工智...

385100

扫码关注云+社区

领取腾讯云代金券