Говорящий герой требует от модели совпадения картинки и звука: артикуляция должна попадать в речь, а мимика — в интонацию. Промпты в этой подборке описывают не только внешность и обстановку, но и манеру речи: темп, эмоцию, куда смотрит говорящий. Модели с нативной генерацией звука (HappyHorse, Veo, Seedance) отрабатывают такие описания заметно лучше, если реплика задана прямо в промпте. Промпты на английском, и саму реплику тоже лучше писать на нём — с латиницей артикуляция получается точнее. Меняйте героя, обстановку и текст реплики.
27 промптов