Test-Time Augmentation × EMAの組み合わせで精度はさらに伸びるか?【Keras×CIFAR-10実験】 CIFAR-10 CNN EMA Google Colab Keras TTA 過学習 画像分類
バッチサイズを上げたら学習率も比例して上げるべき?Linear Scaling Ruleを検証【Keras×CIFAR-10実験】 Adam Batch Size CIFAR-10 CNN Google Colab Keras Learning Rate Linear Scaling Rule 画像分類
GAP前 vs GAP後 vs 両方|Dropoutの挿入位置で精度はどう変わる?【Keras×CIFAR-10実験】 CIFAR-10 CNN Dropout GlobalAveragePooling Google Colab Keras 過学習 画像分類
学習率ウォームアップの長さ(0 / 3 / 5 / 10エポック)で精度はどう変わる?【Keras×CIFAR-10実験】 Adam CIFAR-10 CNN Google Colab Keras Learning Rate Warmup 画像分類