Python数据分析系列课程:学习文本挖掘

从基本的分词、词袋模型、分布式表示等概念开始,多面深入学习文本挖掘技术的各个方面

Ratings: 0.00 / 5.00




Description

文本挖掘(TM),又称自然语言处理(NLP),是AI时代炙手可热的数据分析挖掘前沿领域,其所涉及的人机对话系统,推荐算法,文本分类等技术在BAT等企业中都得到广泛应用。
本课程将使用经典武侠小说、大众点评抓取结果、微博语料数据等多个实际案例进行教学。
课程将会从基本的分词、词袋模型、分布式表示等概念开始,多面介绍文本挖掘技术的各个方面,特别会针对目前最热的word2vec,gensim 等结合实际案例进行学习,帮助学员直接升级至业界技术前沿。学习完本课程后,学员将能够独立使用Python环境完成中文文本挖掘的各种工作。

本课程版权归三节课所有,未经书面同意私自录制、转载等行为均属侵权行为。课程内的所有内容,包括但不限于视频、文字、图片均由三节课公司或其他权利人依法拥有其知识产权,包括但不限于著作权、商标权、专利权等。

未经三节课公司的明确书面特别授权,任何人不得为任何目的使用以及向任何自然人或单位提供出售、营销、出版或利用三节课官网上提供的任何内容或服务。如有违反,您将承担由此给三节课公司或其他权利人造成的一切损失。

What You Will Learn!

  • 学习文本挖掘的基本技术:分词、词袋模型、分布式表示等
  • 多面深入掌握文本挖掘的关键技术
  • 实战掌握经典案例中的文本挖掘应用方法和技术
  • 帮助学员独立使用Python环境完成各类文本挖掘工作

Who Should Attend!

  • 企业内对文本挖掘和数据分析感兴趣的Python工程师、软件研发工程师等
  • 适合企业中的中高级数据分析师、Python数据分析师等提升数据挖掘硬性技术能力
  • 适合目前正在数据挖掘、推荐算法、NLP等领域从事科研工作的在校生和工程师等