Видео из текста в Telegram

Генерация видео по текстовому промпту прямо в чате Telegram. Пять моделей, от 480p до 4K, длина от 2 секунд, оплата за секунду и без подписки.

Видео из текста это старт с нуля: ни фото, ни референса, только написанное описание на входе и клип на выходе. Его принимают все модели бота, и разница между рабочим результатом и мутным кроется в основном в том, как написан промпт.

Пишите для камеры, а не для поисковой строки

Привычка, которую приносят из генераторов картинок, это навалить прилагательных. Видео вознаграждает другое: скажите, что в кадре, а потом скажите, что кадр делает. Объект, обстановка, положение камеры и движение вытянут клип дальше, чем список стилевых слов.

Промпт вида «slow push in on a woman reading by a rain-streaked window, warm lamplight, quiet evening» даёт модели четыре вещи, с которыми она может работать. «Beautiful cinematic masterpiece 8k detailed» не даёт ни одной.

Скажите, что движется

У видео есть ось, которой нет у картинок, и именно её забывают прописать. Если в промпте ничего не движется, модель придумывает движение сама, а придуманное движение это то место, где клипы начинают выглядеть неправильно. Назовите нужное движение, неважно, принадлежит оно объекту, камере или свету.

Проверяйте дёшево, потом вкладывайтесь

Прогоните формулировку на начальной модели в 480p. Черновик на шесть секунд это 12 кредитов, так что три формулировки обойдутся дешевле одного готового клипа. Когда формулировка даёт задуманный кадр, перезапустите её в более высоком разрешении на модели потяжелее. Откройте бота, и выбор модели окажется в одном касании от черновика. Остальной порядок работы разобран в пошаговом руководстве.

Как выбрать модель под текстовый промпт

Кинематографичную модель стоит брать, когда кадру нужно движение камеры или смена ракурсов. Модель уровня качества лучше держит мелкие детали и подходит там, где объект должны разглядывать вблизи. Начальная модель не просто дешевле: она всегда возвращает звук, из-за чего клип по одному тексту выглядит законченным без второго шага. Все пять принимают текстовый промпт, а на странице цен написано, сколько стоит секунда у каждой.

Если картинка у вас уже есть и её нужно оживить, это видео из фото.

Частые вопросы

Можно ли сделать видео из одного текста?

Да. Любая модель каталога принимает текстовый промпт без приложенного изображения, а три из них рассчитаны на текст как на основной вход.

Какой длины должен быть промпт?

Несколько предложений лучше, чем абзац. Назовите объект, обстановку, камеру и настроение, и на этом остановитесь. Длинные промпты скорее размывают картину, чем уточняют её.

Какая модель лучше работает с текстовыми промптами?

Кинематографичная, если кадру нужно движение камеры, и модель уровня качества, если детали важнее движения. Формулировку стоит сначала проверять на начальной модели, потому что она дешёвая.

Обязательно ли описывать камеру?

Не обязательно, но это помогает. Названный тип кадра и движение дают модели что-то конкретное, и это самый простой способ сделать так, чтобы клип выглядел снятым, а не сгенерированным.

Сколько стоит клип из текста?

Тариф выбранной модели и разрешения, умноженный на число секунд. На начальной модели это два кредита в секунду в 480p.

zosee video независимый продукт. Не связан с Telegram, xAI, Alibaba, Kuaishou, Google, OpenAI и Runway, ими не одобрен и не спонсируется. Названия моделей принадлежат их владельцам.

Сделать клип в Telegram

Подпишитесь на канал с идеями и заберите разовый бонус ровно на один короткий клип на начальной модели. Кредиты не сгорают.