This commit is contained in:
ekurtulus
2023-01-11 11:37:27 +03:00
parent bdb4762359
commit 5b77dd2e9f
5 changed files with 202 additions and 38 deletions
+10 -7
View File
@@ -1,4 +1,4 @@
from transformers import AutoModelForCausalLM
import transformers
# from .gptj import get_model as get_gptj_model
@@ -25,9 +25,12 @@ def freeze_top_n_layers(model, target_layers):
return model
def get_specific_model(model_name, cache_dir, quantization):
return AutoModelForCausalLM.from_pretrained(model_name, cache_dir=cache_dir)
# if "gpt-j" in model_name.lower():
# return get_gptj_model(model_name, cache_dir, quantization)
# else:
# return AutoModelForCausalLM.from_pretrained(model_name, cache_dir=cache_dir)
def get_specific_model(model_name, cache_dir, quantization, seq2seqmodel):
# encoder-decoder support for Flan-T5 like models
# for now, we can use an argument but in the future,
# we can automate this
if seq2seqmodel:
model = transformers.AutoModelForSeq2SeqLM.from_pretrained(model_name, cache_dir=cache_dir)
else:
model = transformers.AutoModelForCausalLM.from_pretrained(model_name, cache_dir=cache_dir)
return model