Python网络爬虫:从入门到精通
教材教辅研究生/本科/专科教材11.2万字
更新时间:2023-10-25 19:34:57 最新章节:参考文献
书籍简介
本书主要介绍如何使用Python语言进行网络爬虫程序的开发,从Python语言的基本特性入手,详细介绍Python网络爬虫开发的多个方面,涉及HTTP、HTML、正则表达式、JavaScript、自然语言处理、数据处理与科学计算等不同领域的内容。全书共12章,包括基础篇、进阶篇、提高篇和实战篇4个部分。基础篇包括第1、2、3章,分别为Python基础及网络爬虫、静态网页抓取、数据存储。进阶篇包括第4、5、6章,分别为JavaScript与动态内容、模拟登录与验证码、爬虫数据的分析与处理。提高篇包括第7、8、9章,分别为爬虫的灵活性和多样性、Selenium模拟浏览器与网站测试、爬虫框架Scrapy与反爬虫。实战篇提供了3个实战项目供读者学习参考。本书内容覆盖网络数据抓取与爬虫编程中的主要知识和前沿技术。同时,本书在重视理论基础的前提下,从实用性和丰富度出发,结合实例演示爬虫程序编写的核心流程,将理论与实践结合,力求提高读者的网络爬虫实操技能。本书可作为高等院校数据科学、统计学、计算机科学、软件工程等相关专业课程的教材,也可作为Python语言初学者、网络爬虫技术爱好者的参考书。
品牌:人邮图书
上架时间:2023-07-01 00:00:00
出版社:人民邮电出版社
本书数字版权由人邮图书提供,并由其授权上海阅文信息技术有限公司制作发行
最新章节
吕云翔主编
- 会员本书结合了Python3.6的新特性,完全为零基础的初学者量身定做。书中例举大量实例,介绍了Python的基本语法、编码规范和一些编程思想。本书第1~8章为Python语言基础,主要介绍Python的基本用法;第9章为一个实战,帮助读者理解前8章的知识;第10~17章为Python的进阶使用,包含面向对象编程、函数式编程入门、文件读写、异常处理、模块和包几个部分;第18章为第2个实战,帮助读者融高教教材8.4万字
同类热门书
最新上架
- 会员本书以企业财务管理活动为主线,参照当前财务管理的职业资格标准,注重职业素养形成和职业能力培养,体现基于职业岗位分析和具体工作过程的课程设计理念,围绕财务管理活动设计相应的项目、任务。本书提炼财务管理实务课程中蕴含的素养元素,构建基于成果导向的教材体系,将素质教育的核心理念与要素有机融入教材中,将素养元素润物细无声地传递给学生,实现素质教育与职业能力培养有机融合。本书强调学生知识目标和能力目标的实现教材教辅16.1万字
- 会员当前,在高等教育创新发展势在必行、全面推进“新工科、新医科、新农科、新文科”等建设的大背景下,本书针对桂林旅游学院国家级一流本科专业建设点酒店管理专业人才培养过程进行研究和总结。从协同育人平台的搭建、师资队伍建设、教育教学水平的提高、学生参加学科竞赛的选拔、创新创业项目的培育、互联网+活动的参与等等各方面着手,针对学生特点,以高质量就业为导向,全方位、多角度阐释酒店管理专业人才的高质量培养全过程。教材教辅16.8万字
- 会员本书系统地介绍了数字媒体技术的基础知识、应用与发展,以及数字媒体关键技术,主要内容包括数字媒体技术概述,数字图像与计算机视觉技术,数字音频技术,数字视频技术,计算机图形学与动画技术,数字媒体压缩、存储与传输技术,融媒体技术,人机交互技术,虚拟现实技术,数字出版与数字媒体资源管理。本书采用章节式写法,理论联系实际,讲解深入浅出,每章都设计丰富的知识栏目和课堂实训模块。本书可作为高等院校数字媒体、网络教材教辅14.4万字
- 会员本书在介绍货币、利率等基本概念的基础上,还介绍了商业银行、中央银行两大类银行机构,以及货币市场、资本市场、金融衍生工具市场三种不同性质的金融市场,进而阐述了货币需求、货币供给、货币政策、通货膨胀与通货紧缩、金融监管等概念。本书结构完整、表述流畅,较好地体现了理论与实践的新发展,是一本富有时效性与全面性的货币金融学教材。本书适合作为经济类、金融类和管理类专业学生修读“货币银行学”“货币金融学”课程的教材教辅42.8万字
- 会员本书主要讲解Hadoop的分布式文件系统、MapReduce编程模型和Spark大数据处理技术。全书共12章,具体包括大数据概述、Hadoop大数据处理架构、HDFS分布式文件系统、MapReduce分布式计算框架、HBase分布式数据库、Spark概述、基于Scala的Spark编程、Windows环境下Spark综合编程、SparkSQL结构化数据处理、SparkStreaming流计算、教材教辅9.7万字