Files
Open-Assistant/model/reward/instructor/configs/deberta-v3-base.yml
T
2023-01-07 16:36:55 +01:00

15 lines
290 B
YAML

model_name: microsoft/deberta-v3-base
learning_rate: 1e-5
scheduler: cosine
gradient_checkpointing: false
gradient_accumulation_steps: 32
per_device_train_batch_size: 2
warmup_steps: 600
eval_steps: 200
save_steps: 500
max_length: 512
num_train_epochs: 2
datasets:
- webgpt
- hfsummary