学界 | 专访北京大学王立威教授:高校算法的突破与创新要走在数据前面

AI科技评论按:中国人工智能学会AIDL第二期【人工智能前沿讲习班】日前在北京中科院自动化所举行,本期讲习班的主题为【机器学习前沿】。北京大学教授王立威带来了题为《机器学习理论:回顾与展望》的主题报告,主要对机器学习中关于泛化能力的几个重要理论进行介绍。

北京大学教授王立威博士的主要研究领域集中于机器学习,在包括COLT, NIPS,JMLR, PAMI等权威会议期刊发表论文60余篇。2010年入选AI’s 10 to Watch,是首位获得该奖项的亚洲学者。2012年获得首届国家自然科学基金优秀青年基金,新世纪优秀人才。任NIPS等权威会议Area Chair,和多家学术期刊编委。在主题报告结束后,AI科技评论与王教授做了短时间交流。

1. 您曾经指出,机器学习理论在于理解人工智能的局限性。结合您的研究经历,您认为人工智能现在能做什么?还不能做什么?可能的突破口又在哪里?

我觉得在过去几年,人工智能或者机器学习的发展已经把这个问题很好地展现了。现在做得很好的两个领域主要集中于图像和语音,由于深度神经网络的结构利用了先验知识,自然也非常适用于这两个领域。

当然,产业现在也发展得比较好,所以我认为未来短期内如果会有重大突破的话,更多的是在应用领域,找到和图像和语音相关的比较好的结合点,可能不是偏学术领域,而会是一个是偏商业化的方向。(AI科技评论:更好地产品化。)对,找到一个更好的应用。

2. 目前工业界开始出现与高校合作的趋势,前者提供数据和研发资金,后者提供研发支持,而往往这些研究都是应用导向的。您认为这样的合作会对理论研究产生怎样的影响?

我想举这么一个例子,就是产生很大影响的 AlphaGo。从最终展示出来的成果来看,我们可以认为,AlphaGo 是一个非常成熟的应用系统。而 Alpha Go 从最开始的想法到技术落地,同样很大地推动了学术的前进。比如 DeepMind,不论是从算法和理论上都有突破,这一点研究界也有目共睹。(工业界研究推动学术发展)同样也是很好的一个模式,我认为,将来工业界和高校的合作趋势也可以取得这样的一个成功。

3.现在云计算已经将计算力提升到一个以前不敢想象的高度,甚至已经远远高于样本的获取能力。那么构建样本会成为未来的研究重点吗?

数据其实是一个很大的问题,也牵扯到很多方面。我的一个考虑是,今天应用的比较成功的领域,包括图像和语音方面,实际上这些是属于非专业知识的数据,随便请一个人,一个普通人,就可以对图像或者语音进行标注。这类问题当然也有应用,但有很多相当一大类数据是属于专业数据,比如说医疗数据,这些只能让医生进行标注,它的成本实际上是很高的。

4. 此前与其它老师交流的时候,他们提及高校研究的数据量不够大的问题。那么从您个人的研究经验来看,数据对于算法而言处于怎样的地位?

我认为主要有两个方面。一种是应用,关注的是系统的最终性能,而数据对后者的影响是巨大的。当然高校是完全无法和企业相提并论的。但高校更重要的一个任务是,我能不能去设计新的更好的算法。我们并不是只停留在 Deep Learning 这样的算法上,就像我在演讲中提到的那样,也许两三年后,Deep Learning 也许就不是最好的,这完全有可能。那么这个新的算法该由谁来提供?我想这应该是高校教师的职责,是他的本职工作,researcher 就应该做这样的事情。所以我提出一个新的算法,未必要等到手里有巨大的数据量才开始做研究。

原文发布于微信公众号 - AI科技评论(aitechtalk)

原文发表时间:2017-03-06

本文参与腾讯云自媒体分享计划,欢迎正在阅读的你也加入,一起分享。

发表于

我来说两句

0 条评论
登录 后参与评论

相关文章

来自专栏AI科技评论

Mobileye CTO CVPR演讲:机器学习和无人驾驶将带来哪些冲击?

GAIR 今年夏天,雷锋网将在深圳举办一场盛况空前的“全球人工智能与机器人创新大会”(简称GAIR)。大会现场,谷歌,DeepMind,Uber,微软等巨头的人...

3299
来自专栏人工智能头条

如何用机器学习和知识图谱来实现商业智能化? | CCAI 演讲实录

1163
来自专栏AI科技大本营的专栏

CCAI 2017 | 德国DFKI科技总监Hans Uszkoreit:如何用机器学习和知识图谱来实现商业智能化?

文/CSDN大琦 7 月22 - 23 日,由中国人工智能学会、阿里巴巴集团 & 蚂蚁金服主办,CSDN、中国科学院自动化研究所承办的第三届中国人工智能大会(C...

3256
来自专栏人工智能快报

Intel拟推动概率计算研究

Intel公司近期正在组建一个战略研究联盟,计划通过推动“概率计算”(probabilistic computing)发展来引领人工智能发展趋势。

833
来自专栏人工智能头条

【CCAI 2016专访】今日头条李磊:研发不能只靠有监督学习 知识表示框架是未来AI核心

1897
来自专栏PPV课数据科学社区

霍金生前最伟大的学术成就是什么?

今日,著名物理学家史蒂芬·霍金去世,享年76岁。 NASA发布悼文表示:悼念知名物理学家及科学大使史蒂芬·霍金。他的理论解锁了一个充满可能性的宇宙。我们,以及全...

2805
来自专栏AI科技评论

清华大学邓志东教授:国内研究氛围浮躁,原创性算法太少

AI 科技评论按:自去年 3 月 AlphaGo 战胜李世乭后,人工智能「突如一夜春风来」地步入人们视线,业已成为家喻户晓的一个名词。目前,以深度卷积神经网络为...

27712
来自专栏镁客网

「深度」揭秘Facebook的人工智能实验室

1794
来自专栏华章科技

【斯坦福AI百年报告2017】重磅发布人工智能与机器学习全景式概览

“AI Index”(AI指数)是斯坦福大学AI百年研究的一个项目,它是一个开放的非营利性项目,旨在追踪人工智能的活动和进展。它的目的是促进以数据为基础的对AI...

702
来自专栏PPV课数据科学社区

【聚焦】大数据讨论 值得你思考的问题!

  1,大数据的运用-案例   CieloMar:CaRRot能不能例举一个你们公司里大数据分析的例子,以及如何定价  CaRRot:数据公司的实用案例: 我就...

2544

扫码关注云+社区