人工智能、大数据与深度学习之间的关系和差异

深度学习(Deep Learning)

尽管在早期的在线搜索急剧爆发之前它已经存在,‘深度学习’仍是一个相对较新的术语。由于学术研究和工业的蓬勃发展,其在不同领域取得了巨大成就,深度学习是应用深层神经网络技术(即具有多个隐藏层的神经网络架构)来解决问题。深度学习是一个类似数据挖掘的过程,它采用深层神经网络架构,这是特定类型的机器学习算法。

深度学习已经取得了令人印象深刻的成就。有鉴于此,至少在我看来,务必要注意几点:

深度学习不是灵丹妙药 – 对于每个问题来说,并不是一个简单一刀切的解决方案。

这不是传说中的万能算法 – 深度学习不会取代所有其他机器学习算法和数据科学技术,至少还没有被证明是这样。

适度的期望是必要的 – 尽管最近在各种类型的分类问题上,特别是计算机视觉和自然语言处理以及强化学习等领域已经取得了巨大的进步,但当代深度学习并没有扩大到非常复杂的问题,例如“解决世界和平”。

深度学习和人工智能不是同义词。

深度学习可以帮助数据科学以附加过程和工具的形式解决问题,而在这种观察中,深入学习是数据科学领域的一个非常有价值的补充。

人工智能

大多数人发现人工智能很难用一个精确的,甚至是广泛的定义讲出来。我不是一个人工智能研究者,所以我的答案可能与其他领域的人差别很大。多年来通过对AI的思想哲学研究,我得出的结论是,人工智能,至少我们通常认为的想法的概念,实际上并不存在。

在我看来,AI是一个标尺,一个移动目标,一个渴望而不可及的目标。每当我们迈向AI成就之路,不知何故,这些成就似乎又变成了被称为其他的东西。

我曾经读过如下内容:如果你在上世纪60年代问AI的研究人员,他们对AI的想法是什么,他们可能会一致认为,可以帮助我们预测下一步行动和欲望,所有人类知识可以随时获取,一个适合我们口袋的小型设备就是真实的AI。但是今天我们都携带智能手机,很少有人会把它们称为人工智能。

AI适合数据科学?嗯,正如我所说,我不认为AI真的是有形的,我想很难说它适合任何地方。但,一些数据科学和机器学习相关领域,人工智能可以提供助力,有时与实体一样有价值;计算机视觉肯定会引起注意,现代深度学习研究也是如此,得益于人工智能的精神气质,若不是无限期的话。

AI可能是研究和开发设备,从来没有在同名行业中产生任何东西。我想说,从AI到数据科学的这条路径可能不是查看两者之间的关系的最佳方式,但是两个实体之间的许多中间步骤已经被AI以某种形式开发和完善了。

数据科学(Data Science)

那么,在讨论这些相关概念和数据科学的地位之后,数据科学究竟是什么呢?对我来说,这是试图精确定义的一个最难的概念。数据科学是一个多方面的学科,包括机器学习和其他分析过程,统计学和相关的数学分支,越来越多地从高性能科学计算中借鉴,以便最终从数据中发现洞察,并使用这些新发现的信息来讲述故事。这些故事通常伴随着图片(我们称之为可视化),并针对行业,研究甚至是我们自己,目的是从数据中获取一些新的想法。

数据科学采用相关领域的各种不同工具(请参阅上面所有内容)。数据科学既是数据挖掘的同义词,也是数据挖掘概念的超集。

数据科学产生各种不同的结果,但它们都具有共同的洞察力。数据科学是这一切,而且对你而言,它可能还有别的东西,而且甚至还没有涵盖获取,清理,判别和预处理数据!顺便说一下,什么是数据呢?它总是大吗?

我认为我的关于数据科学困惑的观点,至少可以通过上图的版本来代表它,以及这篇文章的顶部的Piatetsky-Shapiro的维恩图。我也建议大多数与Drew Conway的数据科学维恩图一致,尽管我会补充一点:我认为他非常合理且实用的图像实际上是指数据科学家,而不是数据科学。这可能是吹毛求疵,但我不认为数据科学本身包含黑技能;我相信这是科学家拥有的技能,以便能够进行数据科学。诚然,这可能是对语义的嘲弄,但在我心中是有道理的。

当然,这不是一个宏图的全景,它在不断地演变。例如,我记得不久以前的一次阅读,数据挖掘是商业智能的一个子领域。即使有不同的意见,我真的不能想象今天这是一个有效的想法(坦率地说,几年前很难接受)。