From 7326df2c98868c4b7ff1426588c4a60e40de7337 Mon Sep 17 00:00:00 2001 From: Marcin Date: Sun, 19 May 2019 00:11:59 +0200 Subject: [PATCH] Train sentencepiece on unsup --- ulmfit/train_clas.py | 2 +- 1 file changed, 1 insertion(+), 1 deletion(-) diff --git a/ulmfit/train_clas.py b/ulmfit/train_clas.py index 1c926f8..20f4285 100644 --- a/ulmfit/train_clas.py +++ b/ulmfit/train_clas.py @@ -317,7 +317,7 @@ class CLSHyperParams(LMHyperParams): val_df = self.add_noise(val_df, noise) cls_name = f'{cls_name}noise{noise}tv' - args = self.tokenizer_to_fastai_args(sp_data_func=lambda: trn_df[1], use_moses=use_moses) + args = self.tokenizer_to_fastai_args(sp_data_func=lambda: lm_trn_df[1], use_moses=use_moses) args['text_cols'] = list(trn_df.columns.values)[1:] args['mark_fields'] = True lm_suffix = self.bptt if self.bptt != 70 else ""