作 者:(美)库姆斯(Alexander T.Combs) 著;黄申 译 定 价:69 出 版 社:人民邮电出版社 出版日期:2017年05月01日 页 数:251 装 帧:平装 ISBN:9787115449061 ●第1章Python机器学习的生态系统1
●1.1数据科学/机器学习的工作流程2
●1.1.1获取2
●1.1.2检查和探索2
●1.1.3清理和准备3
●1.1.4建模3
●1.1.5评估3
●1.1.6部署3
●1.2Python库和功能3
●1.2.1获取4
●1.2.2检查4
●1.2.3准备20
●1.2.4建模和评估26
●1.2.5部署34
●1.3设置机器学习的环境34
●1.4小结34
●第2章构建应用程序,发现低价的公寓35
●2.1获取公寓房源数据36
●使用import.io抓取房源数据36
●2.2检查和准备数据38
●部分目录
内容简介
机器学习是近年来渐趋热门的一个领域,同时Python语言经过一段时间的发展也已逐渐成为主流的编程语言之一。本书结合了机器学习和Python语言两个热门的领域,通过利用两种核心的机器学习算法来将Python语言在数据分析方面的优势发挥到很好。全书共有10章。靠前章讲解了Python机器学习的生态系统,剩余9章介绍了众多与机器学习相关的算法,包括各类分类算法、数据可视化技术、推荐引擎等,主要包括机器学习在公寓、机票、IPO市场、新闻源、内容推广、股票市场、图像、聊天机器人和推荐引擎等方面的应用。
由库姆斯所著的《Python机器学习实践指南》适合Python程序员、数据分析人员、对算法感兴趣的读者、机器学习领域的从业人员及科研人员阅读。 (美)库姆斯(Alexander T.Combs) 著;黄申 译 Alexander T.Combs是一位经验丰富的数据科学家、策略师和开发人员。他有金融数据抽取、自然语言处理和生成,以及定量和统计建模的背景。他目前是纽约沉浸式数据科学项目的一名全职zi深讲师。
探索人工智能的奥秘:从原理到实战的深度解析 本书旨在为广大读者提供一个全面、深入且极具实践价值的人工智能学习路径。我们不局限于单一的技术栈或特定领域的应用,而是从人工智能的根本原理出发,逐步过渡到当下最流行、最前沿的技术实现。无论您是初学者,希望建立扎实的理论基础,还是有一定经验的开发者,寻求拓展技术广度和深度,本书都将为您提供宝贵的指导和启发。 第一部分:人工智能的基石——理解智能的本质 在踏入人工智能的浩瀚海洋之前,我们需要首先理解“智能”究竟意味着什么。本部分将带领您穿越历史的长河,追溯人工智能思想的萌芽与发展。我们将探讨早期关于计算和思维的哲学思考,以及图灵测试等里程碑式的概念,它们如何奠定了人工智能研究的理论基础。 接着,我们将深入剖析人类智能的构成要素,例如感知、学习、推理、决策和创造力。通过类比和对比,我们将揭示计算机如何模拟和实现这些能力。这一部分将是构建您人工智能认知体系的关键,帮助您摆脱对“黑箱”技术的盲目崇拜,理解算法背后深刻的逻辑。 智能的哲学根源与历史演进: 从亚里士多德的逻辑推理到现代的符号计算,理解人工智能的哲学思想脉络。 人类智能的认知模型: 探讨学习、记忆、注意力、情感等关键认知过程,并思考如何将其转化为计算模型。 图灵测试及其局限性: 分析这个经典的思想实验,以及它在评估机器智能方面的意义与争议。 人工智能的分类与分支: 了解强人工智能、弱人工智能、通用人工智能等概念,以及机器学习、深度学习、自然语言处理、计算机视觉等主要研究领域。 第二部分:机器学习的通用语言——从统计模型到学习算法 机器学习是实现人工智能最主流、最有效的方法之一。本部分将为您系统梳理机器学习的核心概念和经典算法。我们将从最基础的监督学习、无监督学习和强化学习开始,逐步深入理解各种算法的原理、优缺点以及适用场景。 我们不会止步于算法的介绍,更重要的是,我们将探讨算法背后的数学原理,例如概率论、统计学、线性代数和微积分等。理解这些数学工具,将帮助您更深刻地理解算法的工作机制,从而能够灵活地选择、调整和优化模型。 监督学习: 回归算法: 线性回归、多项式回归、岭回归、Lasso回归,以及如何处理过拟合和欠拟合。 分类算法: 逻辑回归、支持向量机(SVM)、K近邻(KNN)、决策树、随机森林、梯度提升树(如XGBoost, LightGBM),以及各类评估指标(准确率、精确率、召回率、F1分数、ROC曲线)。 无监督学习: 聚类算法: K-Means、DBSCAN、层次聚类,以及如何评估聚类结果。 降维算法: 主成分分析(PCA)、t-SNE,以及它们在数据可视化和特征提取中的应用。 关联规则挖掘: Apriori算法及其在推荐系统和市场篮子分析中的应用。 强化学习基础: 马尔可夫决策过程(MDP): 理解状态、动作、奖励、转移概率等核心概念。 Q-learning与SARSA: 介绍经典的强化学习算法,以及它们如何通过试错学习最优策略。 第三部分:深度学习的革命——神经网络的强大力量 深度学习作为机器学习的一个分支,在近年来取得了突破性的进展,尤其在图像识别、语音识别和自然语言处理等领域展现出惊人的能力。本部分将带领您深入理解神经网络的构建、训练与应用。 我们将从最基本的感知机开始,逐步构建更复杂的神经网络结构,如多层感知机(MLP)、卷积神经网络(CNN)、循环神经网络(RNN)及其变体(LSTM, GRU)。您将学习如何设计网络结构、选择激活函数、优化损失函数以及使用反向传播算法进行模型训练。 神经网络基础: 感知机与激活函数: 理解神经元的工作原理,Sigmoid, ReLU, Tanh等激活函数的选择。 多层感知机(MLP): 构建全连接网络,理解前向传播与反向传播算法。 损失函数与优化器: 均方误差(MSE)、交叉熵(Cross-Entropy),梯度下降、Adam等优化算法。 卷积神经网络(CNN): 卷积层、池化层、全连接层: 理解CNN在图像特征提取中的核心作用。 经典CNN架构: LeNet, AlexNet, VGG, ResNet等,以及它们的创新之处。 迁移学习与数据增强: 如何利用预训练模型加速训练,以及提升模型鲁棒性。 循环神经网络(RNN)及其变体: RNN的基本结构与原理: 处理序列数据的能力,以及存在的长程依赖问题。 LSTM与GRU: 理解门控机制如何解决RNN的梯度消失/爆炸问题。 RNN在序列建模中的应用: 文本生成、机器翻译、时间序列预测等。 第四部分:人工智能的实际应用——解决现实世界的问题 理论知识的掌握是基础,而将这些知识转化为解决实际问题的能力才是最终目的。本部分将聚焦于人工智能在各个领域的落地应用,帮助您理解如何将所学技术应用于真实场景。 我们将深入探讨计算机视觉、自然语言处理、推荐系统、智能语音助手等热门应用领域。您将学习到针对不同任务,如何选择合适的模型、进行数据预处理、模型训练与评估,以及最终的模型部署与优化。 计算机视觉: 图像分类与物体检测: YOLO, Faster R-CNN等模型,以及其在安防、自动驾驶等领域的应用。 图像分割与风格迁移: U-Net, GAN等技术,以及它们在医疗影像分析、艺术创作中的潜力。 人脸识别与姿态估计: 关键技术与伦理考量。 自然语言处理(NLP): 词嵌入与语言模型: Word2Vec, GloVe, BERT, GPT系列,理解文本表示与语义理解。 文本分类与情感分析: 垃圾邮件过滤、产品评论分析。 机器翻译与文本生成: Transformer架构的威力,以及其在跨语言交流、内容创作中的应用。 问答系统与对话机器人: 构建智能交互体验。 推荐系统: 协同过滤: 基于用户行为和物品相似度的推荐。 基于内容的推荐: 利用物品属性进行推荐。 混合推荐模型: 结合多种方法的优势。 其他前沿应用: 强化学习在游戏AI、机器人控制中的应用。 生成对抗网络(GAN)在图像生成、数据增强等领域的探索。 联邦学习与隐私保护。 第五部分:模型部署与生产化——让智能走进现实 将训练好的模型部署到生产环境中,使其能够为用户提供服务,是人工智能项目成功的关键环节。本部分将为您介绍模型部署的相关技术和最佳实践。 您将学习到如何将模型打包、优化,以及选择合适的部署平台(如云端、边缘设备)。同时,我们也将探讨模型监控、持续集成/持续部署(CI/CD)以及模型迭代更新的流程,确保人工智能系统能够稳定、高效地运行。 模型序列化与部署格式: Pickle, ONNX, TensorFlow Lite等。 服务化部署: RESTful API, gRPC。 容器化技术: Docker, Kubernetes。 云平台上的AI服务: AWS SageMaker, Azure Machine Learning, Google AI Platform。 边缘AI部署: 针对嵌入式设备和移动端的模型优化。 模型监控与A/B测试。 MLOps: 机器学习运维的最佳实践。 结语:拥抱人工智能的未来 人工智能的浪潮正以前所未有的速度席卷而来,深刻地改变着我们的生活和工作方式。本书提供了一个系统、全面的学习框架,希望能帮助您掌握人工智能的核心技术,理解其背后的原理,并具备将其应用于实际问题的能力。人工智能的发展永无止境,技术更新迭代迅速。我们鼓励您在阅读本书的基础上,保持持续学习的热情,积极探索新的技术和应用,共同创造一个更加智能美好的未来。
作为一名在工作中需要处理大量数据的工程师,我一直希望能够利用机器学习来提高工作效率和解决一些棘手的问题。《Python机器学习实践指南》这个书名听起来非常契合我的需求。我特别期待书中能够介绍一些在实际应用中常用的机器学习算法,并提供详细的Python实现代码。比如,在回归分析和分类问题上,我希望书中能有关于线性回归、逻辑回归、随机森林、梯度提升等算法的深入讲解,以及如何在实际数据集中应用这些算法。另外,对于深度学习的部分,如果书中能够介绍一些基础的神经网络构建方法,并提供一些图像识别或文本处理的案例,那将是锦上添花。我更看重的是书中能否提供一些关于项目部署和模型维护的建议,毕竟将模型从实验室阶段推向实际应用是一个很大的挑战。