Python TensorFlow для машинного обучения
Google Research попыталась объяснить, откуда у diffusion-моделей берётся «креативность
». Почему генератор изображений не просто копирует обучающие примеры, а создаёт новые сцены, которых не было в датасете? Ответ оказался математическим. Во время обучения нейросеть не запоминает идеальную функцию удаления шума. Из-за регуляризации и особенностей градиентного обучения она усваивает её более сглаженную версию. Google называет этот эффект score smoothing. Если бы функция была идеальной, каждый случайный шум в конце превращался бы в точную копию одного из обучающих примеров. Но сглаживание создаёт между примерами «зоны интерполяции»...