欢迎光临
免费的PDF电子书下载网站

精通数据科学算法 PDF下载

编辑推荐

机器学习的应用是高度自度化且自动修正的。学习到的数据越多,机器学习应用需要的人工干预越少。为了解决现实世界中复杂的数据问题,科学家们开发出专门的机器学习算法来解决这些问题。数据科学正是通过算法和统计分析来帮助读者从现有数据中获取新知识的。 本书将解决如何高效地进行数据分类及预测的问题。本书主要讲解7种数据科学算法,有k*近邻算法、朴素贝叶斯算法、决策树、随机森林,k-means聚类、回归分析和时间序列分析。 此外,你还会掌握如何对数据进行预聚类,以便针对大型数据集进行优化和分类。*后,你将了解如何根据数据集中的现有趋势来预测数据。本书的各章还有配套的练习题,以帮助你夯实内容,扩展相关知识。 读完本书后,你将了解如何选择机器学习算法进行聚类、分类或回归,并知道选择哪种算法来解决实际问题。 本书主要包括以下内容: 如何使用朴素贝叶斯、决策树和随机森林进行分类并准确地解决复杂问题; 正确识别数据科学问题并使用回归分析和时间序列分析设计合适的预测解决方案; 如何使用 k-means算法对数据进行聚类; 如何使用Python和R语言有效地实现算法。 ;

内容简介

数据科学(Data Science)是从数据中提取知识的技术,是一门有关机器学习、统计学与数据挖掘的交叉学科。数据科学包含了多种领域的不同元素,包括信号处理、数学、概率模型技术和理论、计算机编程、统计学等。 本书讲解了7种重要的数据分析方法,它们分别是k*近邻算法、朴素贝叶斯算法、决策树、随机森林、k-means聚类、回归分析以及时间序列分析。全书共7章,每一章都以一个简单的例子开始,先讲解算法的基本概念与知识,然后通过对案例进行扩展以讲解一些特殊的分析算法。这种方式有益于读者深刻理解算法。 本书适合数据分析人员、机器学习领域的从业人员以及对算法感兴趣的读者阅读。

作者简介

Dávid Natingga于2014年毕业于伦敦帝国理工学院的计算与人工智能专业,并获工程硕士学位。2011年,他在印度班加罗尔的Infosys实验室工作,研究机器学习算法的优化。2012~2013年,他在美国帕罗奥图的Palantir技术公司从事大数据算法的开发工作。2014年,作为英国伦敦Pact Coffee公司的数据科学家,他设计了一种基于顾客口味偏好和咖啡结构的推荐算法。2017年,他在荷兰阿姆斯特丹的TomTom工作,处理导航平台的地图数据。 他是英国利兹大学计算理论专业的博士研究生,研究纯数学如何推进人工智能。2016年,他在日本高等科学技术学院当了8个月的访问学者。

精通数据科学算法 PDF下载

目录

第 1 章 用k最近邻算法解决分类问题

1.1 Mary对温度的感觉

1.2 实现k最近邻算法

1.3 意大利地区的示例——选择k值

1.4 房屋所有权——数据转换

1.5 文本分类——使用非欧几里德距离

1.6 文本分类——更高维度的k-NN

精通数据科学算法 pdf下载声明

本pdf资料下载仅供个人学习和研究使用,不能用于商业用途,请在下载后24小时内删除。如果喜欢,请购买正版

pdf下载地址

版权归出版社和作者所有,下载链接已删除。如果喜欢,请购买正版!

链接地址:精通数据科学算法