NLP模型笔记2022-14:修改fastTex预训练模型的词语向量维度并保存模型

FastText 是一个开源、免费、轻量级的库,允许用户学习文本表示和文本分类器。它适用于标准的通用硬件。模型以后可以缩小尺寸以适应移动设备。
在这里插入图片描述

157 种语言分发预训练的词向量,使用 fastText在Common Crawl和Wikipedia上进行训练。这些模型使用具有位置权重的 CBOW 进行训练,维度为 300,字符 n-gram 长度为 5,窗口大小为 5 和 10 个负数。我们还分发了三个新词类比数据集,分别用于汉语、法语、印地语和波兰语。

参考来源:https://fasttext.cc/docs/en/crawl-vectors.html#adapt-the-dimension

参考链接:https://blog.csdn.net/weixin_42361622/article/details/112414065

猜你喜欢

转载自blog.csdn.net/weixin_41194129/article/details/125217126