文本挖掘:基于R语言的整洁工具

文本挖掘:基于R语言的整洁工具
  • ISBN: 9787111588559
  • 出版日期:
  • 出版社: 机械工业出版社有限公司
  • 作者: 【美】茱莉亚·斯拉格;戴维·罗宾逊
  • 评分:
  • 类型: 互联网
  • 得到图书

内容简介

当前很多数据都是非结构化的大规模文本,这给分析和可视化带来了挑战。本书使用实用的tidytext软件包来介绍文本挖掘技术,该包是由Julia Silge和David Robinson共同开发的R软件包(类似于ggplot2和dplyr软件包),开发时采用了整洁原则。本书将会介绍如何利用tidytext以及其他整洁工具使文本分析变得更容易、更有效。

本书展示如何将文本转换为数据框,然后提取和可视化文本的特征;并介绍如何将自然语言处理(NLP)融入有效的工作流程中;实用的代码示例和数据分析将帮助你了解文学作品、新闻和社交媒体中的有用信息。