正版现货新书 Python商业大数据网络爬虫技术与实战 9787563840229 毛小岗,徐同春,田雪莉编著
全新正版现货,以书名为准,放心购买,购书咨询18822403591朱老师
¥
28.35
5.7折
¥
49.8
全新
库存2件
作者毛小岗,徐同春,田雪莉编著
出版社首都经济贸易大学出版社
ISBN9787563840229
出版时间2025-11
装帧平装
开本24cm
定价49.8元
货号200215003
上书时间2026-09-15
商品详情
- 品相描述:全新
- 商品描述
-
作者简介
毛小岗,首都经济贸易大学工商管理学院教师,中国消费大数据研究院研究员,北京绿茵茵互联网科技有限公司联合创始人。参与多项企业和政府的数据分析课题,讲授“文本数据挖掘”、“商务数据分析”和“机器学习实战与Kaggle竞赛实训”等多门数据科学课程。
徐同春,首都经济贸易大学工商管理学院硕士生,研究方向为公司治理与公司金融,专注数据科学在企业管理和商业分析场景中的实践运用。
田雪莉,北京航空航天大学人文社会科学学院硕士生,研究方向为创业与创新,致力于商业数据在企业管理中的技术转化与应用。
目录
1 爬虫开发环境的安装与使用
1.1 为什么选择 Python进行爬虫开发
1.2 Anaconda的安装与配置
1.3 爬虫相关库的安装
1.4 其他开发环境集成 Anaconda
1.5 Jupyter Notebook的使用
2 Python编程基础
2.1 Python语法
2.2 控制结构
2.3 数据类型
2.4 函数
2.5 面向对象编程
2.6 正则表达式
2.7 文件路径处理
3 网络爬虫基本原理
3.1 网络爬虫概述
3.2 爬虫与反爬虫
3.3 网页类型与商业大数据
4 网络爬虫的合法性与道德规范
4.1 网络爬虫合法性概述
4.3 网络爬虫的伦理问题
4.4 合规爬虫的设计原则
4.5 爬虫伦理趋势
5 爬虫基本库的使用
5.1 网页获取库
5.2 信息解析库
5.3 数据存储库
6 编写网络爬虫的通用方法
6.1 编写网络爬虫的总体思路
6.2 设计爬虫流程,编写初步方案
6.3 划分爬虫模块,优化初步方案
6.4 做好异常处理,确定爬虫方案
7 静态网页爬虫
7.1 静态网页爬虫概述
7.3 编写静态网页爬虫的核心要点
7.4 爬虫实例:爬取上市公司定期报告
8 动态爬虫
8.1 动态网页爬虫概述
802 动态网页数据请求
8.3 爬虫实例:获取电商平台商品信息数据
8.4 利用 Selenium库实现动态网页爬虫
8.5 Selenium库动态网页爬取流程
8.6 使用 Selenium库爬虫实例:获取 ESG评级数据
9 API接口调用
9.1 API接口调用说明
9.2 API接口调用一般流程
9.3 爬虫实例:获取股票历史数据
10 逆向爬虫
10.1 逆向概述
10.2 逆向基础
10.3 开发者工具
10.4 网页逆向逻辑
10.5 爬虫实例一:获取电商评论数据
10.6 爬虫实例二:获取投诉信息数据
11 AI赋能爬虫
11.1 使用 AI工具爬取网页
11.2 AI爬虫工具
11.3 Crawl4AI安装与配置
11.4 AI爬虫基础
11.5 深度爬取
11.6 网页筛选
11.7 内容筛选
11.8 数据提取
11.9 爬虫实例:获取财经新闻文本数据
参考文献
内容摘要
本书以Python为开发工具,系统地讲解了商业大数据网络爬虫开发的全过程,涵盖了爬虫开发环境配置、Python基础语法、爬虫原理、爬虫合法性与道德规范、爬虫基本库使用、静态与动态网页爬取、API数据调用、逆向解析以及AI辅助爬虫等内容,并配有实战案例、项目实训和可运行代码。
本书适用于工商管理大类等财经类相关专业本科和研究生,不仅聚焦于技术方法的讲解,更强调合规意识的培养与数据思维的构建。通过丰富的爬虫案例与实践训练,帮助读者在真实场景中掌握商业大数据采集能力,提升科研与职业竞争力。
以下为对购买帮助不大的评价