diff --git a/ulmfit/__init__.py b/multifit/__init__.py similarity index 100% rename from ulmfit/__init__.py rename to multifit/__init__.py diff --git a/multifit/__main__.py b/multifit/__main__.py new file mode 100644 index 0000000..00eaf42 --- /dev/null +++ b/multifit/__main__.py @@ -0,0 +1,19 @@ +from pathlib import Path + +import fire + +import multifit.configurations +import multifit + +class Experiment: + def new(self): + return {n: getattr(multifit.configurations,n) for n in multifit.configurations.__all__} + + def load(self, model_path): + return multifit.ULMFiT().load_(Path(model_path)) + + def from_pretrained(self): + return multifit.from_pretrained + +if __name__ == '__main__': + fire.Fire(Experiment()) \ No newline at end of file diff --git a/ulmfit/configurations.py b/multifit/configurations.py similarity index 100% rename from ulmfit/configurations.py rename to multifit/configurations.py diff --git a/ulmfit/datasets/__init__.py b/multifit/datasets/__init__.py similarity index 100% rename from ulmfit/datasets/__init__.py rename to multifit/datasets/__init__.py diff --git a/ulmfit/datasets/create_wikitext.py b/multifit/datasets/create_wikitext.py similarity index 100% rename from ulmfit/datasets/create_wikitext.py rename to multifit/datasets/create_wikitext.py diff --git a/ulmfit/datasets/dataset.py b/multifit/datasets/dataset.py similarity index 100% rename from ulmfit/datasets/dataset.py rename to multifit/datasets/dataset.py diff --git a/ulmfit/datasets/postprocess_wikitext.py b/multifit/datasets/postprocess_wikitext.py similarity index 100% rename from ulmfit/datasets/postprocess_wikitext.py rename to multifit/datasets/postprocess_wikitext.py diff --git a/ulmfit/datasets/utils.py b/multifit/datasets/utils.py similarity index 100% rename from ulmfit/datasets/utils.py rename to multifit/datasets/utils.py diff --git a/ulmfit/training.py b/multifit/training.py similarity index 99% rename from ulmfit/training.py rename to multifit/training.py index 60649be..34349b2 100644 --- a/ulmfit/training.py +++ b/multifit/training.py @@ -5,7 +5,7 @@ import dataclasses from fastai.callbacks import CSVLogger, SaveModelCallback from fastai.text import * -from ulmfit.datasets import ULMFiTDataset,ULMFiTTokenizer +from multifit.datasets import ULMFiTDataset,ULMFiTTokenizer CLS_BEST = 'cls_best' LM_BEST = "lm_best" diff --git a/notebooks/CLS-DE.ipynb b/notebooks/CLS-DE.ipynb index 26961fa..014b4e0 100644 --- a/notebooks/CLS-DE.ipynb +++ b/notebooks/CLS-DE.ipynb @@ -44,8 +44,8 @@ "outputs": [], "source": [ "from fastai.text import *\n", - "from ulmfit.datasets import ULMFiTDataset, Dataset\n", - "import ulmfit" + "from multifit.datasets import ULMFiTDataset, Dataset\n", + "import multifit" ] }, { @@ -82,7 +82,7 @@ "metadata": {}, "outputs": [], "source": [ - "exp = ulmfit.from_pretrained(f'{lang}_multifit_paper_version')" + "exp = multifit.from_pretrained(f'{lang}_multifit_paper_version')" ] }, { @@ -1538,7 +1538,7 @@ ], "source": [ "def get_results(exp_path):\n", - " exp = ulmfit.ULMFiT().load_(exp_path, silent=True).classifier\n", + " exp = multifit.ULMFiT().load_(exp_path, silent=True).classifier\n", " results = exp.validate(use_cache=False) \n", " results.update(seed=exp.seed, fp16=exp.fp16)\n", " return results\n", diff --git a/notebooks/CLS-JA.ipynb b/notebooks/CLS-JA.ipynb index a4ee055..77fdfe3 100644 --- a/notebooks/CLS-JA.ipynb +++ b/notebooks/CLS-JA.ipynb @@ -44,8 +44,8 @@ "outputs": [], "source": [ "from fastai.text import *\n", - "from ulmfit.datasets import ULMFiTDataset, Dataset\n", - "import ulmfit" + "from multifit.datasets import ULMFiTDataset, Dataset\n", + "import multifit" ] }, { @@ -82,7 +82,7 @@ "metadata": {}, "outputs": [], "source": [ - "exp = ulmfit.from_pretrained('ja_multifit_paper_version')" + "exp = multifit.from_pretrained('ja_multifit_paper_version')" ] }, { @@ -1745,7 +1745,7 @@ ], "source": [ "def get_results(exp_path):\n", - " exp = ulmfit.ULMFiT().load_(exp_path, silent=False).classifier\n", + " exp = multifit.ULMFiT().load_(exp_path, silent=False).classifier\n", " results = exp.validate(use_cache=True) \n", " results.update(seed=exp.seed, fp16=exp.fp16)\n", " return results\n", diff --git a/notebooks/MLDoc-JA-multifit_fp16.ipynb b/notebooks/MLDoc-JA-multifit_fp16.ipynb index 985e8cd..8bca5c8 100644 --- a/notebooks/MLDoc-JA-multifit_fp16.ipynb +++ b/notebooks/MLDoc-JA-multifit_fp16.ipynb @@ -44,8 +44,8 @@ "metadata": {}, "outputs": [], "source": [ - "from ulmfit.datasets import ULMFiTDataset, Dataset\n", - "from ulmfit import ULMFiT, multifit1552_fp16, multifit1552_fp32" + "from multifit.datasets import ULMFiTDataset, Dataset\n", + "from multifit import ULMFiT, multifit1552_fp16, multifit1552_fp32" ] }, { diff --git a/prepare_imdb.sh b/prepare_imdb.sh index 4c2105b..3dbdf90 100755 --- a/prepare_imdb.sh +++ b/prepare_imdb.sh @@ -7,5 +7,5 @@ echo "Saving data in $DATA_DIR" wget -c "http://files.fast.ai/data/aclImdb.tgz" -P "${DATA_DIR}" echo "Imdb is raw text no preparation is done" -python -m ulmfit.datasets.utils prepare_imdb "${DATA_DIR}/aclImdb.tgz" +python -m multifit.datasets.utils prepare_imdb "${DATA_DIR}/aclImdb.tgz" diff --git a/prepare_wiki.sh b/prepare_wiki.sh index a43a868..8640388 100755 --- a/prepare_wiki.sh +++ b/prepare_wiki.sh @@ -46,8 +46,8 @@ else echo "${EXTR_PATH} already exists. Skipping extraction." fi -python -m ulmfit.create_wikitext -i "${EXTR_PATH}" -l "${LANG}" -o "${WIKI_DIR}" +python -m multifit.create_wikitext -i "${EXTR_PATH}" -l "${LANG}" -o "${WIKI_DIR}" -python -m ulmfit.postprocess_wikitext "${WIKI_DIR}/${LANG}-2" $LANG -python -m ulmfit.postprocess_wikitext "${WIKI_DIR}/${LANG}-100" $LANG -#python -m ulmfit.postprocess_wikitext "${WIKI_DIR}/${LANG}-all" $LANG +python -m multifit.postprocess_wikitext "${WIKI_DIR}/${LANG}-2" $LANG +python -m multifit.postprocess_wikitext "${WIKI_DIR}/${LANG}-100" $LANG +#python -m multifit.postprocess_wikitext "${WIKI_DIR}/${LANG}-all" $LANG diff --git a/sotabench/sotabench.py b/sotabench/sotabench.py index 8b79c5f..6dca7e6 100644 --- a/sotabench/sotabench.py +++ b/sotabench/sotabench.py @@ -1,4 +1,4 @@ -from ulmfit import ULMFiT +from multifit import ULMFiT from fastai.text import * from sotabencheval.language_modelling import WikiText103Evaluator from sotabencheval.utils import is_server diff --git a/ulmfit/__main__.py b/ulmfit/__main__.py deleted file mode 100644 index 82febbe..0000000 --- a/ulmfit/__main__.py +++ /dev/null @@ -1,19 +0,0 @@ -from pathlib import Path - -import fire - -import ulmfit.configurations -import ulmfit - -class Experiment: - def new(self): - return {n: getattr(ulmfit.configurations,n) for n in ulmfit.configurations.__all__} - - def load(self, model_path): - return ulmfit.ULMFiT().load_(Path(model_path)) - - def from_pretrained(self): - return ulmfit.from_pretrained - -if __name__ == '__main__': - fire.Fire(Experiment()) \ No newline at end of file