It could be useful to have some stats on the dataset before training. Something like: * number of images (training/validation sets) * number of characters/words (training/validation sets) * character distribution (training set) * unknown characters
It could be useful to have some stats on the dataset before training. Something like: