基于Huggingface使用BERT进行文本分类的fine-tuning

随着BERT大火之后，很多BERT的变种，这里借用Huggingface工具来简单实现一个文本分类，从而进一步通过Huggingface来认识BERT的工程上的实现方法。

1、load data

train_df = pd.read_csv('../data/train.tsv',delimiter='\t',names=['text','label'])

print(train_df.shape)

train_df.head()

sentences = list(train_df['text'])

targets =train_df['label'].values

2、token encodding

#如果token要封装到自定义model类中的话，则需要指定max_len

tokenizer=BertTokenizer.from_pretrained('bert-base-uncased')

max_length=32

sentences_tokened=tokenizer(sentences,padding=True,truncation=True,max_length=max_length,return_tensors='pt')

targets=torch.tensor(targets)

3、encoding data

# from torchvision import transforms,datasets

from torch.utils.data import Dataset,DataLoader,random_split

class DataToDataset(Dataset):

    def __init__(self,encoding,labels):

        self.encoding=encoding

        self.labels=labels

    def __len__(self):

        return len(self.labels)

    def __getitem__(self,index):

        return self.encoding['input_ids'][index],self.encoding['attention_mask'][index],self.labels[index]

#封装数据

datasets=DataToDataset(sentences_tokened,targets)

train_size=int(len(datasets)*0.8)

test_size=len(datasets)-train_size

print([train_size,test_size])

train_dataset,val_dataset=random_split(dataset=datasets,lengths=[train_size,test_size])

BATCH_SIZE=64

#这里的num_workers要大于0

train_loader=DataLoader(dataset=train_dataset,batch_size=BATCH_SIZE,shuffle=True,num_workers=5)

val_loader=DataLoader(dataset=val_dataset,batch_size=BATCH_SIZE,shuffle=True,num_workers=5)#

4、create model

class BertTextClassficationModel(nn.Module):

    def __init__(self):

        super(BertTextClassficationModel,self).__init__()

        self.bert=BertModel.from_pretrained('bert-base-uncased')

        self.dense=nn.Linear(768,2)  #768 input, 2 output

    def forward(self,ids,mask):

        out,_=self.bert(input_ids=ids,attention_mask=mask)

        out=self.dense(out[:,0,:])

        return out

mymodel=BertTextClassficationModel()

#获取gpu和cpu的设备信息

device=torch.device("cuda" if torch.cuda.is_available() else "cpu")

print("device=",device)

if torch.cuda.device_count()>1:

    print("Let's use ",torch.cuda.device_count(),"GPUs!")

    mymodel=nn.DataParallel(mymodel)

mymodel.to(device)

5、train model

loss_func=nn.CrossEntropyLoss()

optimizer=optim.Adam(mymodel.parameters(),lr=0.0001)

from sklearn.metrics import accuracy_score

def flat_accuracy(preds,labels):

    pred_flat=np.argmax(preds,axis=1).flatten()

    labels_flat=labels.flatten()

    return accuracy_score(labels_flat,pred_flat)

epochs=3

for epoch in range(epochs):

    train_loss = 0.0

    train_acc=0.0

    for i,data in enumerate(train_loader):

        input_ids,attention_mask,labels=[elem.to(device) for elem in data]

        #优化器置零

        optimizer.zero_grad()

        #得到模型的结果

        out=mymodel(input_ids,attention_mask)

        #计算误差

        loss=loss_func(out,labels)

        train_loss += loss.item()

        #误差反向传播

        loss.backward()

        #更新模型参数

        optimizer.step()

        #计算acc

        out=out.detach().numpy()

        labels=labels.detach().numpy()

        train_acc+=flat_accuracy(out,labels)

    print("train %d/%d epochs Loss:%f, Acc:%f" %(epoch,epochs,train_loss/(i+1),train_acc/(i+1)))

6、evaluate

print("evaluate...")

val_loss=0

val_acc=0

mymodel.eval()

for j,batch in enumerate(val_loader):

    val_input_ids,val_attention_mask,val_labels=[elem.to(device) for elem in batch]

    with torch.no_grad():

        pred=mymodel(val_input_ids,val_attention_mask)

        val_loss+=loss_func(pred,val_labels)

        pred=pred.detach().cpu().numpy()

        val_labels=val_labels.detach().cpu().numpy()

        val_acc+=flat_accuracy(pred,val_labels)

print("evaluate loss:%d, Acc:%d" %(val_loss/len(val_loader),val_acc/len(val_loader)))

基于Huggingface使用BERT进行文本分类的fine-tuning的更多相关文章

Chinese-Text-Classification，用卷积神经网络基于 Tensorflow 实现的中文文本分类。
用卷积神经网络基于 Tensorflow 实现的中文文本分类项目地址: https://github.com/fendouai/Chinese-Text-Classification 欢迎提问:ht ...
基于Text-CNN模型的中文文本分类实战流川枫发表于AI星球订阅
Text-CNN 1.文本分类转眼学生生涯就结束了,在家待就业期间正好有一段空闲期,可以对曾经感兴趣的一些知识点进行总结. 本文介绍NLP中文本分类任务中核心流程进行了系统的介绍,文末给出一个基于T ...
基于Text-CNN模型的中文文本分类实战
Text-CNN 1.文本分类转眼学生生涯就结束了,在家待就业期间正好有一段空闲期,可以对曾经感兴趣的一些知识点进行总结. 本文介绍NLP中文本分类任务中核心流程进行了系统的介绍,文末给出一个基于T ...
基于Naive Bayes算法的文本分类
理论什么是朴素贝叶斯算法? 朴素贝叶斯分类器是一种基于贝叶斯定理的弱分类器,所有朴素贝叶斯分类器都假定样本每个特征与其他特征都不相关.举个例子,如果一种水果其具有红,圆,直径大概3英寸等特征,该水果 ...
基于keras中IMDB的文本分类 demo
本次demo主题是使用keras对IMDB影评进行文本分类: import tensorflow as tf from tensorflow import keras import numpy a ...
文本分类实战（十）—— BERT 预训练模型
1 大纲概述文本分类这个系列将会有十篇左右,包括基于word2vec预训练的文本分类,与及基于最新的预训练模型(ELMo,BERT等)的文本分类.总共有以下系列: word2vec预训练词向量 te ...
Pytorch——BERT 预训练模型及文本分类
BERT 预训练模型及文本分类介绍如果你关注自然语言处理技术的发展,那你一定听说过 BERT,它的诞生对自然语言处理领域具有着里程碑式的意义.本次试验将介绍 BERT 的模型结构,以及将其应用于文 ...
文本分类实战（九）—— ELMO 预训练模型
1 大纲概述文本分类这个系列将会有十篇左右,包括基于word2vec预训练的文本分类,与及基于最新的预训练模型(ELMo,BERT等)的文本分类.总共有以下系列: word2vec预训练词向量 te ...
文本分类实战（八）—— Transformer模型
1 大纲概述文本分类这个系列将会有十篇左右,包括基于word2vec预训练的文本分类,与及基于最新的预训练模型(ELMo,BERT等)的文本分类.总共有以下系列: word2vec预训练词向量 te ...

随机推荐

JVM关键字try、catch、finally、return执行过程
关键字:jvm try catch finally return.指令 finally相当于在所有方法返回之前执行一次 finally中含有return其中finally中return会覆盖try和c ...
Mono集成中使用api获取当前mono 调用堆栈的方法
// 在mono源代码层级中加如下两个api 可以获取堆栈字符串这两个api我新加的,原来没有.基于原来的代码改的. // add by bodong#if PLATFORM_WIN32 __dec ...
[BUUOJ记录] [BJDCTF2020]EasySearch
前面的突破点考察swp泄露以及md5截断认证,最后一步考察ssi注入进入题目是一个登陆页面什么提示都没有,工具扫了一下发现swp泄露,得到登录验证页面的源码: <?php ob_start() ...
[V&N公开赛] CheckIn
V&N战队考核+招新,赵师傅出的Web题,做着感觉有点顶,趁热打铁写write up记录一下考察的知识点这道题说是CheckIn其实还是有一定难度的(也可能是我太菜了),进入题目直接给出了f ...
Mockito在JUnit测试中的使用
Mockito是一种用于替代在测试中难以实现的成员,从而让testcase能顺利覆盖到目标代码的手段.下面例子将展示Mockito的使用. 完整代码下载:https://files.cnblogs.c ...
Java 得到指定时间加半个小时之后得时间
Calendar c = Calendar.getInstance(); c.setTime(cur); //设置时间 c.add(Calendar.MINUTE, 1); //日期分钟加1,Cale ...
Visual Studio Code 下载安装
1.官网下载:https://code.visualstudio.com/ 2.下载完成后,点开如果是黑屏的话,右键勾上.
SpringMVC-数据提交
数据提交目录数据提交 1. 前端的参数与controller中的参数名一致 2. 前端的参数与controller中的参数名不一致 3. 前端接收的是一个对象 4. 总结 5. 数据显示到前端 1 ...
一起来读官方文档-----SpringIOC（03）
1.4.依存关系典型的企业应用程序不坑你只包含单个对象或单个bean.即使是最简单的应用程序,也有一些对象可以协同工作,以呈现最终用户视为一致的应用程序.下一部分将说明如何从定义多个独立的Bean定 ...
Python全栈工程师系列学习之学习记录
@ 目录前言 Day 01 一.python的历史和种类二.安装python解释器以及配置环境变量三.变量.常量和注释 Day 02 Day 03 Day 04 Day 05 Day 06 一. ...

基于Huggingface使用BERT进行文本分类的fine-tuning

基于Huggingface使用BERT进行文本分类的fine-tuning的更多相关文章

随机推荐

热门专题