import nltk
import ssl

# 处理SSL证书问题,避免下载时的证书验证错误
try:
    _create_unverified_https_context = ssl._create_unverified_context
except AttributeError:
    pass
else:
    ssl._create_default_https_context = _create_unverified_https_context

# 设置NLTK数据下载路径(使用系统级路径,确保工具链可访问)
nltk.data.path.append('/usr/share/nltk_data')

# 下载所需的语料库
corpora = ['punkt', 'averaged_perceptron_tagger', 'stopwords']
for corp in corpora:
    print(f"正在下载 {corp} 语料库...")
    nltk.download(corp, quiet=True)
    print(f"✅ 已下载 {corp} 语料库")

print("\n所有NLTK语料库下载完成!")