音色迁移的问题

作者您好，我选择了vctk数据集中p225到p246共二十个说话人的语音进行训练（包括有p226和p231），模型迭代到十万次左右损失不再下降（31左右），但是使用模型时，我发现仅有音高和韵律进行了转换，而音色没有变化，且转换音色生成的语音质量很差。我继续迭代到二十万次，损失没有下降，效果与迭代十万次的相同，仅有韵律和音高有转换，音色转换效果很差。我想知道这可能是为什么？我应该继续训练迭代到六十多万次吗？