-
什么是FastText
FastText是Facebook于2016年开源的一个词向量计算和文本分类工具,它提出了子词嵌入的方法,试图在词嵌入向量中引入构词信息。一般情况下,使用fastText进行文本分类的同时也会产生词的embedding,即embedding是fastText分类的产物。
-
FastText流程
FastText的架构图为:
分为输入层、隐含层、输出层,下面分别介绍这三层:
-
输入层
输入层包含三类特征:
- 全词特征,也就是每个词的完整词嵌入向量;
- 字符n-gram特征,例如对于单词 w h e r e where
-