Почему так происходит
Модель рисует изображение целиком, а не набирает текст как редактор. Поэтому буквы могут выглядеть похожими на текст, но быть неправильными при увеличении.
Для надежного результата лучше генерировать чистый фон, персонажа или товар без текста, а надпись добавлять отдельно в редакторе или просить крупный короткий текст.
Как ставить задачу
- избегать мелкого текста и длинных фраз внутри картинки
- просить место под надпись вместо самой надписи
- использовать короткие крупные слова, если текст нужен сразу
Как работать с ограничениями моделей без обхода правил
Отказы модели и ошибки с текстом - не всегда проблема бота. Современные модели ограничивают небезопасные запросы и пока не всегда надежно рисуют точные буквы внутри изображения.
Правильный путь - переписать идею в безопасный публичный сценарий: стиль, фон, свет, одежда, композиция, место под надпись. Это помогает получить результат без попыток обходить правила.