
Python网络爬虫:从入门到精通
教材教辅研究生/本科/专科教材11.2万字
更新时间:2023-10-25 19:34:57 最新章节:参考文献
书籍简介
本书主要介绍如何使用Python语言进行网络爬虫程序的开发,从Python语言的基本特性入手,详细介绍Python网络爬虫开发的多个方面,涉及HTTP、HTML、正则表达式、JavaScript、自然语言处理、数据处理与科学计算等不同领域的内容。全书共12章,包括基础篇、进阶篇、提高篇和实战篇4个部分。基础篇包括第1、2、3章,分别为Python基础及网络爬虫、静态网页抓取、数据存储。进阶篇包括第4、5、6章,分别为JavaScript与动态内容、模拟登录与验证码、爬虫数据的分析与处理。提高篇包括第7、8、9章,分别为爬虫的灵活性和多样性、Selenium模拟浏览器与网站测试、爬虫框架Scrapy与反爬虫。实战篇提供了3个实战项目供读者学习参考。本书内容覆盖网络数据抓取与爬虫编程中的主要知识和前沿技术。同时,本书在重视理论基础的前提下,从实用性和丰富度出发,结合实例演示爬虫程序编写的核心流程,将理论与实践结合,力求提高读者的网络爬虫实操技能。本书可作为高等院校数据科学、统计学、计算机科学、软件工程等相关专业课程的教材,也可作为Python语言初学者、网络爬虫技术爱好者的参考书。
品牌:人邮图书
上架时间:2023-07-01 00:00:00
出版社:人民邮电出版社
本书数字版权由人邮图书提供,并由其授权上海阅文信息技术有限公司制作发行
最新章节
吕云翔主编
最新上架
- 会员本书根据计算机科学与技术专业对离散数学的教学要求,参考国内外众多优秀的离散数学教材,并结合教学组老师多年的教学实践编写而成。本书对离散数学的核心知识单元进行了系统的理论阐述,对离散数学的分析证明方法进行了严谨的介绍,并通过丰富的应用实例介绍了离散系统建模,旨在帮助读者在掌握理论基础的同时,理解如何利用这些理论知识来分析和解决问题。作为《离散数学及其应用》的第1版,本书将函数的相关内容列为独立章节,教材教辅19万字
- 会员人工智能技术在新媒体领域中的应用,不仅极大地提高了新媒体的生产效率,而且让新媒体传播更加精准和智能化。越来越多的企业通过短视频、直播和图文等新媒体平台开展营销内容创作与生产、私域经营和管理、短视频直播带货、广告投放与管理等互联网组合营销活动。本书根据新媒体运营和营销岗位及其要求,聚焦抖音、视频号、小红书等主流的新媒体平台,讲解移动互联网环境下对新媒体职业领域的认知与策划、营销内容的采编与生产、以及教材教辅9.6万字
- 会员随着计算机技术的持续突破,人工智能生成内容(AIGC)应运而生,显示出其在内容创作领域的巨大潜力。本书深入浅出地探讨了AIGC的理论基础、实践应用与发展前瞻,是技术与创新并重的专业指南。本书主要内容包括AIGC概述、AIGC工具与应用,重点介绍了写作类、图表类、演示文稿类、图像类、音乐类及视频类AIGC工具的实操技巧,旨在为读者提供一条清晰的学习与应用路径。本书内容前沿,案例翔实,不仅适合作为高等教材教辅9.4万字
- 会员本书以Hive为开发平台,主要介绍了如何使用HiveQL来查询和分析存储在Hadoop分布式文件系统上的大数据集合,具体内容包括Hive入门、Hive数据库及表操作、Hive元数据、Hive高级操作、Hive函数与Streaming、Hive视图与索引、Hive调优、Hive与HBase集成、数据迁移框架Sqoop等。本书介绍的每个任务都运用了大量案例,紧密结合实际应用,融入了含金量十足的开发经验教材教辅8万字
- 会员如今的组织管理中,四个最基本的关系:个人与目标的关系、个人与组织的关系、组织与环境的关系以及组织与变化的关系,都完全改变了。随之而来的新范式必然也将逐渐融入组织行为学的经典框架,本教材不仅强调对基本概念和理论的准确把握,更突出对环境的分析,以及新环境影响下的组织行为、组织学习、组织网络的创新和价值。组织管理的核心价值,需要回归到组织赋能与激活人,以响应“现实”组织的特征。本教材不仅融入了大量实际案教材教辅38.3万字