前言
Pytorch
readme
- 请先安装pytorch的BERT代码,代码源见前言(2)
pip install pytorch-pretrained-bert
参数表
| data_dir | bert_model | task_name |
|---|---|---|
| 输入数据目录 | 加载的bert模型,对于中文文本请输入’bert-base-chinese’ | 输入数据预处理模块,最好根据应用场景自定义 |
| model_save_pth | max_seq_length* | train_batch_size |
| 模型参数保存地址 | 最大文本长度 | batch大小 |
| learning_rate | num_train_epochs | |
| Adam初始学习步长 | 最大epoch数 |
* max_seq_length = 所设定的文本长度 + 2 ,BERT会给每个输入文本开头和结尾分别加上[CLS]和[SEP]标识符,因此会占用2个字符空间,其作用会在后续进行详细说明。

本文介绍如何利用PyTorch实现BERT模型进行中文文本分类,详细讲解数据读取、特征转换、模型训练及测试的过程,提供代码示例,并分享了训练总结和经验。
&spm=1001.2101.3001.5002&articleId=84880528&d=1&t=3&u=4b64b9eacfdb48b0a8fdcaf3299469f8)
8682

被折叠的 条评论
为什么被折叠?



