114 lines
2.9 KiB
JSON
114 lines
2.9 KiB
JSON
{
|
|
"best_global_step": 1000,
|
|
"best_metric": 38.22496541449399,
|
|
"best_model_checkpoint": "./whisper-small-ru-lora/checkpoint-1000",
|
|
"epoch": 0.07582075972401243,
|
|
"eval_steps": 1000,
|
|
"global_step": 1000,
|
|
"is_hyper_param_search": false,
|
|
"is_local_process_zero": true,
|
|
"is_world_process_zero": true,
|
|
"log_history": [
|
|
{
|
|
"epoch": 0.0075820759724012435,
|
|
"grad_norm": 2.148340940475464,
|
|
"learning_rate": 9.900000000000002e-06,
|
|
"loss": 0.6513661956787109,
|
|
"step": 100
|
|
},
|
|
{
|
|
"epoch": 0.015164151944802487,
|
|
"grad_norm": 1.6975250244140625,
|
|
"learning_rate": 1.9900000000000003e-05,
|
|
"loss": 0.37973670959472655,
|
|
"step": 200
|
|
},
|
|
{
|
|
"epoch": 0.02274622791720373,
|
|
"grad_norm": 4.548895359039307,
|
|
"learning_rate": 2.9900000000000002e-05,
|
|
"loss": 0.15598671913146972,
|
|
"step": 300
|
|
},
|
|
{
|
|
"epoch": 0.030328303889604974,
|
|
"grad_norm": 1.5962910652160645,
|
|
"learning_rate": 3.99e-05,
|
|
"loss": 0.18657663345336914,
|
|
"step": 400
|
|
},
|
|
{
|
|
"epoch": 0.03791037986200622,
|
|
"grad_norm": 2.4020962715148926,
|
|
"learning_rate": 4.99e-05,
|
|
"loss": 0.1705690574645996,
|
|
"step": 500
|
|
},
|
|
{
|
|
"epoch": 0.04549245583440746,
|
|
"grad_norm": 2.5167970657348633,
|
|
"learning_rate": 4.858571428571429e-05,
|
|
"loss": 0.15946486473083496,
|
|
"step": 600
|
|
},
|
|
{
|
|
"epoch": 0.053074531806808704,
|
|
"grad_norm": 2.2412750720977783,
|
|
"learning_rate": 4.715714285714286e-05,
|
|
"loss": 0.1628062629699707,
|
|
"step": 700
|
|
},
|
|
{
|
|
"epoch": 0.06065660777920995,
|
|
"grad_norm": 0.556187629699707,
|
|
"learning_rate": 4.572857142857143e-05,
|
|
"loss": 0.18077341079711914,
|
|
"step": 800
|
|
},
|
|
{
|
|
"epoch": 0.06823868375161118,
|
|
"grad_norm": 0.0893208235502243,
|
|
"learning_rate": 4.43e-05,
|
|
"loss": 0.1555758857727051,
|
|
"step": 900
|
|
},
|
|
{
|
|
"epoch": 0.07582075972401243,
|
|
"grad_norm": 1.529534101486206,
|
|
"learning_rate": 4.287142857142857e-05,
|
|
"loss": 0.1582450771331787,
|
|
"step": 1000
|
|
},
|
|
{
|
|
"epoch": 0.07582075972401243,
|
|
"eval_loss": 0.1050347164273262,
|
|
"eval_runtime": 1258.3452,
|
|
"eval_samples_per_second": 0.795,
|
|
"eval_steps_per_second": 0.397,
|
|
"eval_wer": 38.22496541449399,
|
|
"step": 1000
|
|
}
|
|
],
|
|
"logging_steps": 100,
|
|
"max_steps": 4000,
|
|
"num_input_tokens_seen": 0,
|
|
"num_train_epochs": 1,
|
|
"save_steps": 1000,
|
|
"stateful_callbacks": {
|
|
"TrainerControl": {
|
|
"args": {
|
|
"should_epoch_stop": false,
|
|
"should_evaluate": false,
|
|
"should_log": false,
|
|
"should_save": true,
|
|
"should_training_stop": false
|
|
},
|
|
"attributes": {}
|
|
}
|
|
},
|
|
"total_flos": 2.09556799488e+18,
|
|
"train_batch_size": 2,
|
|
"trial_name": null,
|
|
"trial_params": null
|
|
}
|