import nltk
import ssl
# 处理SSL证书问题,避免下载时的证书验证错误
try:
_create_unverified_https_context = ssl._create_unverified_context
except AttributeError:
pass
else:
ssl._create_default_https_context = _create_unverified_https_context
# 设置NLTK数据下载路径(使用系统级路径,确保工具链可访问)
nltk.data.path.append('/usr/share/nltk_data')
# 下载所需的语料库
corpora = ['punkt', 'averaged_perceptron_tagger', 'stopwords']
for corp in corpora:
print(f"正在下载 {corp} 语料库...")
nltk.download(corp, quiet=True)
print(f"✅ 已下载 {corp} 语料库")
print("\n所有NLTK语料库下载完成!")