[导 读]机器学习是使数据具有意义的算法的应用和科学,也是计算机科学中最令人兴奋的领域!在数据丰沛的时代,计算机可以通过自我学习获得算法把数据转化为知识。近年来涌现出了许多强大的机器学习开源软件库,现在是进入该领域的最佳时机,掌握强大的算法可以从数据中发现模式并预测未来。
本文将讨论机器学习的主要概念、不同类型及相关术语,为利用机器学习技术成功地解决实际问题奠定基础。
本文将主要涵盖下述几个方面:
♦ 机器学习的基本概念
♦ 三种类型的机器学习及基本术语
♦ 成功设计机器学习系统的基石
♦ 为数据分析和机器学习安装和配置Python
一、构建把数据转换为知识的智能机器
在当今的科技时代,大量结构化和非结构化数据是我们的丰富资源。机器学习在二十世纪下半叶演变为人工智能(AI)的一个分支,它涉及从数据中通过自我学习获得算法以进行预测。
机器学习并不需要先在大量的数据中进行人工分析,然后提取规则并建立模型,而是提供了一种更有效的方法来捕获数据中的知识,逐步提高预测模型的性能,以完成数据驱动的决策。
机器学习不仅在计算机科学研究中越来越重要,在日常生活中也发挥出越来越大的作用。归功于机器学习,今天才会有强大的垃圾邮件过滤、方便的文本和语音识别、可靠的网络搜索引擎、具有挑战性的下棋程序,并有希望在不久的将来可以享受安全和高效的自动驾驶。
二、三种不同类型的机器学习
本文将讨论有监督、无监督和强化三种不同类型的机器学习,分析它们之间的根本差别,并用概念性的例子开发一个可以解决实际问题的应用: