资源

虽然知道大多数同学都有资料收藏癖,还是给大家准备一份自然语言处理学习资源大礼包,主要是之前陆陆续续分享的NLP学习资源,包括自然语言处理、深度学习、机器学习、数学相关的经典课程、书籍和学习笔记,这些资料基本上都是公开渠道可以获得的,整理到一起,方便NLP爱好者收藏把玩。当然,学习的前提依然是”学自然语言处理,其实更应该学好英语“

获取方法很简单,关注AINLP公众号,后台回复关键词:ALL4NLP,一键打包收藏NLP学习资源:

这些自然语言处理相关资源列表如下,欢迎收藏:

相关的资源的过往文章大致介绍如下,不限于下述文章:

斯坦福大学自然语言处理经典入门课程-Dan Jurafsky 和 Chris Manning 教授授课

哥伦比亚大学经典自然语言处理公开课,数学之美中盛赞的柯林斯(Michael Collins)教授授课

认真推荐一份深度学习笔记:简约而不简单

Andrew Ng 老师新推的通俗人工智能课程以及其他相关资料

那些值得推荐和收藏的线性代数学习资源

Philipp Koehn大神的神经网络机器翻译学习资料:NMT Book

凸优化及无约束最优化相关资料

斯坦福大学深度学习自然语言处理课程CS224N 2019 全20个视频分享

自然语言处理经典书籍《Speech and Language Processing》第三版最新版下载(含第二版)

强化学习圣经:《强化学习导论》第二版(附PDF下载)

新书下载 | 面向机器学习的数学(Mathematics for Machine Learning)

Springer面向公众开放正版电子书籍,附65本数学、编程、数据挖掘、数据科学、数据分析、机器学习、深度学习、人工智能相关书籍链接及打包下载

最后,欢迎关注AINLP,回复"all4nlp"获取:

=============================================Old 分割线======================================================

这里提供一些52nlp博客的一些系列文章以及收集的自然语言处理相关书籍及其他资源的下载,陆续整理中!如有不妥,我会做删除处理!

关注我们的公众号 AINLP,回复相关关键词获取:

1、关注AINLP公众号,后台回复 “文章、历史消息、历史、history、存档” 任一关键字获取历史文章存档消息。

2、回复“正态分布,rickjin, 正态分布前世今生, 正态分布文章, 正太分布, 正太, 正态”任一关键字获取Rickjin正态分布前世今生系列:

正态分布系列文章索引

3、回复“nlp, 自然语言处理,学习自然语言处理,学习nlp, 如何学习nlp,如何学习自然语言处理” 任一关键字获取文章:如何学习自然语言处理

4、回复"slp" 获取:斯坦福NLP书籍和课程网盘链接和密码

5、回复"slp3" 获取:自然语言处理综论英文版第三版及斯坦福NLP课程链接和密码

6、回复"ng" 获取:Andrew Ng老师课程相关资料链接和密码

7、回复"aic" 获取:AI Challenger 2018 文本挖掘类竞赛相关代码及解决方案汇总
博客版本持续更新,欢迎提供线索:https://www.52nlp.cn/?p=10998

8、回复"bert" 获取:BERT相关论文、文章和代码资源汇总
博客版本持续更新:https://www.52nlp.cn/?p=10870

9、回复"HMM" 获取:HMM学习最佳范例全文PDF
HMM学习最佳范例全文PDF文档及相关文章索引

10、回复"Hinton" 获取:面向机器学习的神经网络公开课视频及课件
Geoffrey Hinton 大神面向机器学习的神经网络公开课及相关视频资料

11、回复"NLTK" 获取: NLTK相关资料
Python自然语言处理工具NLTK学习导引及相关资料

12、回复"youhua"获取:优化相关资料
凸优化及无约束最优化相关资料

13、回复"xiandai"获取:线性代数相关资料
那些值得推荐和收藏的线性代数学习资源

14、回复"cs224n"获取:深度学习自然语言处理课程最新视频:
2019斯坦福CS224n深度学习自然语言处理课程视频和相关资料分享
斯坦福大学深度学习自然语言处理课程CS224N 2019 全20个视频分享

15、回复"kuakua"获取:夸夸语料库(500条)
为了夸夸聊天机器人,爬了一份夸夸语料库

16、回复"fenci"获取:中文分词相关资源
中文分词文章索引和分词数据资源分享

17、回复”tongjixuexi”获取:李航老师统计学习方法第一版PPT(清华大学深圳研究生院袁春老师精心制作)
李航老师《统计学习方法(第二版)》出版及统计学习方法第一版PPT课件下载

18、如何计算两个文档的相似度全文文档

一、书籍:
1、《自然语言处理综论》英文版第二版
2、《统计自然语言处理基础》英文版
3、《用Python进行自然语言处理》,NLTK配套书
4、《Learning Python第三版》,Python入门经典书籍,详细而不厌其烦
5、《自然语言处理中的模式识别》
6、《EM算法及其扩展》
7、《统计学习基础》
8、《自然语言理解》英文版(似乎只有前9章)
9、《Fundamentals of Speech Recognition》,质量不太好,不过第6章关于HMM的部分比较详细,作者之一便是Lawrence Rabiner;
10、概率统计经典入门书:《概率论及其应用》(英文版,威廉*费勒著)
第一卷  第二卷  DjVuLibre阅读器(阅读前两卷书需要)
11、一本利用Perl和Prolog进行自然语言处理的介绍书籍:《An Introduction to Language Processing with Perl and Prolog
12、国外机器学习书籍之:
1) "Programming Collective Intelligence",中文译名《集体智慧编程》,机器学习&数据挖掘领域"近年出的入门好书,培养兴趣是最重要的一环,一上来看大部头很容易被吓走的"
2) "Machine Learning",机器学习领域无可争议的经典书籍,下载完毕将后缀改为pdf即可。豆瓣评论 by 王宁):老书,牛人。现在看来内容并不算深,很多章节有点到为止的感觉,但是很适合新手(当然,不能"新"到连算法和概率都不知道)入门。比如决策树部分就很精彩,并且这几年没有特别大的进展,所以并不过时。另外,这本书算是对97年前数十年机器学习工作的大综述,参考文献列表极有价值。国内有翻译和影印版,不知道绝版否。
3) “Introduction to Machine Learning
13、国外数据挖掘书籍之:
1) "Data.Mining.Concepts.and.Techniques.2nd",数据挖掘经典书籍 作者 : Jiawei Han/Micheline Kamber 出版社 : Morgan Kaufmann 评语 : 华裔科学家写的书,相当深入浅出。
2) Data Mining:Practical Machine Learning Tools and Techniques
3) Beautiful Data: The Stories Behind Elegant Data Solutions( Toby Segaran, Jeff Hammerbacher)
14、国外模式识别书籍之:
1)“Pattern Recognition
2)“Pattern Recongnition Technologies and Applications
3)“An Introduction to Pattern Recognition
4)“Introduction to Statistical Pattern Recognition
5)“Statistical Pattern Recognition 2nd Edition
6)“Supervised and Unsupervised Pattern Recognition
7)“Support Vector Machines for Pattern Classification
15、国外人工智能书籍之:
1)Artificial Intelligence: A Modern Approach (2nd Edition) 人工智能领域无争议的经典。
2)“Paradigms of Artificial Intelligence Programming: Case Studies in Common LISP
16、其他相关书籍:
1)Programming the Semantic Web,Toby Segaran , Colin Evans, Jamie Taylor
2)Learning.Python第四版,英文

二、课件:
1、哈工大刘挺老师的“统计自然语言处理”课件;
2、哈工大刘秉权老师的“自然语言处理”课件;
3、中科院计算所刘群老师的“计算语言学讲义"课件;
4、中科院自动化所宗成庆老师的“自然语言理解”课件;
5、北大常宝宝老师的“计算语言学”课件;
6、北大詹卫东老师的“中文信息处理基础”的课件及相关代码;
7、MIT Regina Barzilay教授的“自然语言处理”课件,52nlp上翻译了前5章;
8、MIT大牛Michael Collins的“Machine Learning Approaches for Natural Language Processing(面向自然语言处理的机器学习方法)”课件;
9、Michael Collins的“Machine Learning (机器学习)”课件;
10、SMT牛人Philipp Koehn “Advanced Natural Language Processing(高级自然语言处理)”课件;
11、Philipp Koehn “Empirical Methods in Natural Language Processing”课件;
12、Philipp Koehn“Machine Translation(机器翻译)”课件;

三、语言资源和开源工具:
1、Brown语料库:
a) XML格式的brown语料库,带词性标注;
b) 普通文本格式的brown语料库,带词性标注;
c) 合并并去除空行、行首空格,用于词性标注训练:browntest.zip
2、NLTK官方提供的语料库资源列表
3、OpenNLP上的开源自然语言处理工具列表
4、斯坦福大学自然语言处理组维护的“统计自然语言处理及基于语料库的计算语言学资源列表
5、LDC上免费的中文信息处理资源
6、中文分词相关工具:
1)Java版本的MMSEG:mmseg-v0.3.zip,作者为solol,详情可参见:《中文分词入门之篇外
2)张华平老师的ICTCLAS2010,该版本非商用免费一年,下载地址:
http://cid-51de2738d3ea0fdd.skydrive.live.com/self.aspx/.Public/ICTCLAS2010-packet-release.rar
7、热心读者“finallyliuyu”提供的一批新闻语料库,包括腾讯,新浪,网易,凤凰等,目前放在CSDN上:http://finallyliuyu.download.csdn.net/
另外finalllyliuyu在2010年9月又提供了一批文本文类语料,详情见:献给热衷于自然语言处理的业余爱好者的中文新闻分类语料库之二

四、文献:
1、ACL-IJCNLP 2009论文全集:
a) 大会论文Full Paper第一卷
b) 大会论文Full Paper第二卷
c) 大会论文Short Paper合集
d) ACL09之EMNLP-2009合集
e) ACL09 所有workshop论文合集

《资源》有75条评论
  1. 您好,机器学习相关书籍都不能下载了

    [回复]

    52nlp 回复:

    那个网盘失效了,这些书爱问上基本上都有,在那里找找吧,抱歉。

    [回复]

  2. 博主您好!
    我想问下您知道有没有一些公开的英文新闻数据(带时间标签的),比如yahoo!news dataset, 但是我不知道怎么下载或申请。谢谢博主啦!

    [回复]

    52nlp 回复:

    抱歉,这个不清楚。

    [回复]

  3. 真希望有人能从基础总结一套学习方案阿,
    数学方面要看哪些,计算机方面要看哪些,语言学要看哪些,自然语言处理方面的等等。作为新手只能是有点迷茫,感觉学海浩瀚,不知道从哪入手比较好。

    [回复]

    52nlp 回复:

    可以看看课程图谱博客上的一些系列文章,包括数学,计算机,机器学习等学科的课程系列,相信会有很多帮助 http://blog.coursegraph.com/

    [回复]

  4. 我觉得博主的网站非常好,对于刚开始研究nlp的初学者来说,真的是太好的入门网站了。为什么不弄个donate,让大家尽点心意么。。。

    [回复]

    52nlp 回复:

    谢谢建议,不过暂时不考虑了

    [回复]

  5. 51nlp太棒的,有很多我要的资料,我做实体关系提取的 有志同道合的 可以聊聊阿
    qq: 1951352997 注明身份

    [回复]

  6. 博主,您好,首先非常感谢您的总结,对我们新手具有非常好的指引作用。关于课件分享,新浪爱问的不可以访问,不知可否从其他途径分享下?比如百度网盘之类的,谢谢!

    [回复]

    52nlp 回复:

    抱歉,很多资料由于在老电脑里不太好找了,建议google一下,我自己当时也是从公开途径获得后整理的

    [回复]

  7. 非常感谢你的资源,不过《自然语言处理综论》英文版第二版的链接好像失效了,我最近正在找这本书,您有资源的话不知道是否方便更新一下。谢谢!

    [回复]

    52nlp 回复:

    抱歉,我电脑换了之后有些资源找不到了,回头要是有的话我再更新一下吧

    [回复]

  8. 老师您好,我看了您的关于斯坦福大学深度学习与自然语言处理的文章,里面评论说您把视频搬到了百度云了,请问能否给我一个链接呢谢谢老师。

    [回复]

  9. 博主你好,感谢你提供的资源,我是一个初学者,不知道该如何获得资源,不知道您愿不愿意帮助我,希望能得到您的回复
    qq:1952461154

    [回复]

  10. 博主,您好,首先非常感谢您的总结,想请问一下网上是否有关于受限汉语数据库查询相关的数据集,谢谢!或者有相关资源看到这个留言能联系我,QQ 1789890760,非常感谢,100小红包感谢

    [回复]

    52nlp 回复:

    抱歉,这个不清楚,看看其他同学有是否了解的。

    [回复]

  11. 博主您好!我想要自然语言处理的相关课件,能发给我吗?邮箱liuyong020202@163.com,万分感谢!

    [回复]

    52nlp 回复:

    额,差不多10年前的东西,我手上电脑换了几次,早没有了

    [回复]

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注