•  漫画算法与数据结构(大规模数据集)

    漫画算法与数据结构(大规模数据集) 针对流式数据场景,对常见的大规模数据集算法和数据结构进行了梳理和讲解。示例代码扫描封底的二维码获取。

    《漫画算法与数据结构(大规模数据集)》的重点并不是介绍通用的数据结构与算法分析。在大数据和人工智能的时代背景下,传统的经典算法往往性能不佳,甚至可能不起作用。本书以分布式数据集、流式数据结构与算法设计为主线,对流式数据采集、数据库中的数据结构设计、外部存储器算法进行介绍。目前,实际生产中已经形成了流式数据采集、存储、分析和计算的产品且成果显著。针对流式数据的采集和存储的产品主要有 Apache Kafka、Apache Pulsar 和 Pravega。流式数据的计算与分析主要经历了两代产品,第一代为 Apache Storm、Spark Streaming,目前流行的是第二代产品 Apache Flink。此外,还出现了 MPP(Shared Nothing 架构)的分布式并行架构数据库集群,主要有 Greenplum、HAWQ、HashData 等分布式数据库系统。通过在 MPP 架构基础上对流式数据的存储和计算支持,单节点每秒可处

    ¥39.90定价:¥79.80 (5折)

    5条评论

    /2024-02-01 /清华大学出版社

  •  Effective数据科学基础设施

    Effective数据科学基础设施 学习Metaflow和数据科学基础设施的书籍,立数据科学基础设施的上佳指南。源代码、Links文件见书封底二维码。

    《Effective数据科学基础设施》由Netflix工程师Ville Tuulos撰写,以Metaflow为对象,介绍了数据科学所需要的基础设施,囊括数据准备、特征工程、模型训练、模型部署、服务和持续监控等环节。Metaflow专注于构建生产流程,更适合具有深厚工程和DevOps技能的大型专业数据科学团队。本书的目标读者为数据科学家、机器学习工程师、IT 技术人员和MLOps工程师。数据科学家在人工智能和算法方面非常精通,但软件开发能力通常不足。他们渴望有一套方法论和工具来促进从构建到部署的迭代过程,从而落实自己的想法。数据科学家不在意在一个 孤岛 。上开展数据挖掘和分析工作,他们更希望能够在离线、实时和批处理等场景中落实项目。IT技术人员对机器学习算法理论和模型细节并不了解,他们渴望本书能够提供一个机器学习流程的全貌,便于他们进行任务编排。此外,一些

    ¥49.00定价:¥98.00 (5折)

    16条评论

    [芬] 维莱·图洛斯Ville Tuulos)著 郭涛 /2023-08-01 /清华大学出版社

  •  数据科学与大数据技术:Effective数据科学基础设施

    数据科学与大数据技术:Effective数据科学基础设施

    《Effective数据科学基础设施》由Netflix工程师Ville Tuulos撰写,以Metaflow为对象,介绍了数据科学所需要的基础设施,囊括数据准备、特征工程、模型训练、模型部署、服务和持续监控等环节。Metaflow专注于构建生产流程,更适合具有深厚工程和DevOps技能的大型专业数据科学团队。本书的目标读者为数据科学家、机器学习工程师、IT 技术人员和MLOps工程师。数据科学家在人工智能和算法方面非常精通,但软件开发能力通常不足。他们渴望有一套方法论和工具来促进从构建到部署的迭代过程,从而落实自己的想法。数据科学家不在意在一个“孤岛”。上开展数据挖掘和分析工作,他们更希望能够在离线、实时和批处理等场景中落实项目。IT技术人员对机器学习算法理论和模型细节并不了解,他们渴望本书能够提供一个机器学习流程的全貌,便于他们进行任务编排。此外,一

    ¥88.10定价:¥98.00 (8.99折)

    沐洋图书专营店

    [芬]维莱·图洛斯(VilleTuulos)著郭涛 /2023-08-01 /清华大学出版社

广告