spacy的安装和使用教程
**引言**从文本内容中抽取实体已经成为增强许多下游任务表现的一个关键因素。如何安装spacy库下载spacy预训练语言模型以及使用模型抽取文本中的实体信息是本文的重点关注问题。若想详细了解spacy模型可以浏览github库[https://github.com/explosion/spacy-models]文章目录一、spacy安装二、spacy预训练模型安装三、spacy模型的使用pytorch代码一、spacy安装最简单直接的方式是采用以下命令直接在终端实施在线安装spacy包。pip install spacy受python版本以及相关依赖包的缺乏经常出现无法安装的窘境。为此我们下载spacy包和相应的依赖包murmurhash、cymem采用离线安装whl的方式实现安装。三个相关依赖包可通过官网下载https://pypi.org/。一定要保证三个依赖包与自己的python版本匹配1.pip install murmurhash-1.0.10-cp37-cp37m-win_amd64.whl2.pip install cymem-2.0.8-cp37-cp37m-win_amd64.whl3.pip install spacy二、spacy预训练模型安装从https://spacy.io/models库中找到对应语言的预训练模型。模型分为四类,各类模型描述如下将与spacy版本对应的某语言模型的tar.gz或.whl文件下载到本地文件夹中用pip install命令安装预训练模型。三、spacy模型的使用pytorch代码下面列举两个英文和中文提取实体信息的示例代码import spacy try:nlp_enspacy.load(en_core_web_sm)print(✅ English spaCy 模型加载成功)except Exception as e:print(f❌ 加载失败{e})try:nlp_zhspacy.load(zh_core_web_sm)print(✅ Chinese spaCy 模型加载成功)except Exception as e:print(f❌ 加载失败{e})defextract_entities(text,langen): 抽取文本中的实体 lang:en英文,zh中文 nlpnlp_eniflangenelsenlp_zh docnlp(text)return[(ent.text,ent.label_)forent in doc.ents]textApple Inc.was founded by Steve Jobs in Cupertino,California. en_textApple Inc. was founded by Steve Jobs in Cupertino, California.print(英文实体)fortext,label inextract_entities(en_text,en):print(f {text}: {label})# 中文示例 zh_text2024年阿里巴巴集团在杭州举办了云栖大会创始人马云出席并发言。print(\n中文实体)fortext,label inextract_entities(zh_text,zh):print(f {text}: {label})总结 spacy包已经成为抽取实体信息的必要环节。本博文从安装依赖包到下载预训练模型进行描述。如果对您有帮助不要吝惜的点一个赞呀参考博文1.https://www.cnblogs.com/my16/p/15167257.html2.https://blog.csdn.net/cicd6pipeline/article/details/1510139123.https://comate.baidu.com/zh/page/8cnl2692bec