mirror of
https://github.com/wassname/Castor.git
synced 2026-09-25 13:10:11 +08:00
Refactored the code for Ferhan's relation prediction model using torchtext
33 lines
2.1 KiB
Python
33 lines
2.1 KiB
Python
import os
|
|
|
|
from argparse import ArgumentParser
|
|
|
|
def get_args():
|
|
parser = ArgumentParser(description='Simple QA model - Ferhan Ture')
|
|
parser.add_argument('--epochs', type=int, default=40)
|
|
parser.add_argument('--batch_size', type=int, default=32)
|
|
parser.add_argument('--rnn_type', type=str, default='lstm') # or use 'gru'
|
|
parser.add_argument('--d_embed', type=int, default=300)
|
|
parser.add_argument('--d_hidden', type=int, default=400)
|
|
parser.add_argument('--n_layers', type=int, default=2)
|
|
parser.add_argument('--lr', type=float, default=1e-5)
|
|
parser.add_argument('--test', action='store_true', dest='test', help='turn on test mode; no training.')
|
|
parser.add_argument('--not_bidirectional', action='store_false', dest='birnn')
|
|
parser.add_argument('--clip_gradient', type=float, default=0.5, help='gradient clipping')
|
|
parser.add_argument('--log_every', type=int, default=300)
|
|
parser.add_argument('--dev_every', type=int, default=1200)
|
|
parser.add_argument('--save_every', type=int, default=1200)
|
|
parser.add_argument('--dropout_prob', type=float, default=0.3)
|
|
parser.add_argument('--patience', type=int, default=10, help="number of epochs to wait before early stopping")
|
|
parser.add_argument('--no_cuda', action='store_false', help='do not use CUDA', dest='cuda')
|
|
parser.add_argument('--gpu', type=int, default=0, help='GPU device to use') # use -1 for CPU
|
|
parser.add_argument('--seed', type=int, default=1111, help='random seed for reproducing results')
|
|
parser.add_argument('--save_path', type=str, default='saved_checkpoints')
|
|
parser.add_argument('--data_cache', type=str, default=os.path.join(os.getcwd(), 'data_cache'))
|
|
parser.add_argument('--vector_cache', type=str, default=os.path.join(os.getcwd(), 'vector_cache/input_vectors.pt'))
|
|
parser.add_argument('--word_vectors', type=str, default='glove.42B')
|
|
parser.add_argument('--train_embed', action='store_false', dest='fix_emb') # fine-tune the word embeddings
|
|
parser.add_argument('--resume_snapshot', type=str, default='')
|
|
args = parser.parse_args()
|
|
return args
|