机读格式显示(MARC)
- 010 __ |a 978-7-111-52750-3 |d CNY99.00
- 100 __ |a 20160408d2016 em y0chiy50 ea
- 200 1_ |a 基于R语言的自动数据收集 |A Ji Yu R Yu Yan De Zi Dong Shu Ju Shou Ji |e 网络抓取和文本挖掘实用指南 |f (德) 西蒙·蒙策尔特 ... [等] 著 |d = Automated data collection with R |e a practical guide to Web scraping and text mining |f Simon Munzert |g 吴今朝译 |z eng
- 210 __ |a 北京 |c 机械工业出版社 |d 2016.2
- 215 __ |a 366页 |c 图 |d 26cm
- 225 2_ |a 数据科学与工程技术丛书 |A Shu Ju Ke Xue Yu Gong Cheng Ji Shu Cong Shu
- 304 __ |a 题名页题其余著者: 克里斯蒂安·鲁巴, 彼得·迈博纳, 多米尼克·尼胡斯
- 320 __ |a 有书目 (第360-366页)
- 330 __ |a 本书共17章。第1章是概述,阐述数据挖掘的意义与实际应用。第2-8章介绍网络和数据技术基础知识。这一部分内容涉及互联网上通信、交换、保存和显示信息的基础技术(如HTTP、HTML、XML、JSON、AJAX、SQL等),并讲解用于查询网络文档和数据集的基本技术(XPath和正则表达式)。第9-11章介绍网络抓取和文本挖掘的实用工具箱。这一部分由三个核心章节组成:第9章讲解多种网络抓取技术,涉及正则表达式的使用、XPath、各类API接口、其他数据类型以及开源社区相关的技术;第10章深入介绍用于统计性文本处理的技术;第11章给出关于用R管理数据的项目中常见问题的一些见解。第12-17章介绍实际案例分析,涉及美国参议院里的合作网络、从半结构化文档解析信息、利用Twitter预测2014年奥斯卡奖、绘制姓氏地理分布图、采集关于手机的数据、分析产品评论里的情绪等。这些案例分析针对日常的数据抓取和文本处理的工作流程、真实环境数据中的陷阱以及规避它们的方法等问题提供一些实用的见解。
- 410 _0 |1 2001 |a 数据科学与工程技术丛书
- 500 10 |a Automated data collection with R : a practical guide to Web scraping and text mining |A Automated Data Collection With R : A Practical Guide To Web Scraping And Text Mining |m Chinese
- 517 1_ |a 网络抓取和文本挖掘实用指南 |A Wang Luo Zhua Qu He Wen Ben Wa Jue Shi Yong Zhi Nan
- 606 0_ |a 程序语言 |A Cheng Xu Yu Yan |x 程序设计
- 606 0_ |a 数据采集 |A Shu Ju Cai Ji
- 701 _1 |a 蒙策尔特 |A Meng Ce Er Te |g (Munzert, Simon) |4 著
- 701 _1 |a 鲁巴 |A Lu Ba |g (Rubba, Christian) |4 著
- 701 _1 |a 迈博纳 |A Mai Bo Na |g (Meibner, Peter) |4 著
- 702 _0 |a 吴今朝 |A Wu Jin Chao |4 译
- 801 _0 |a CN |b 江苏新华 |c 20160408
- 905 __ |a WXCSXY |d TP312/1415