Новейшая модель ByteDance для генерации аудиовизуального контента с двухпоточной диффузионно-трансформерной архитектурой и 4,5 миллиардами параметров. Seedance 1.5 Pro генерирует видео и аудио одновременно за один унифицированный проход, устраняя проблемы синхронизации при последовательном наложении звука. Поддерживает многоязычную синхронизацию губ (английский, мандаринский, японский, корейский, испанский и др.), кинематографическое управление камерой (панорамирование, наклон, масштабирование, орбитальное движение), диалоги между несколькими персонажами и сохранение единообразия персонажей между кадрами. Создает клипы длительностью от 4 до 12 секунд с разрешением до 1080p. Количество токенов рассчитывается по формуле (высота выходного видео * ширина выходного видео * продолжительность * 24) / 1024.
import requests
r = requests.post(
"https://infergate.ru/api/v1/videos",
headers={"Authorization": "Bearer sk-•••"},
json={
"model": "bytedance/seedance-1-5-pro",
"prompt": "Кот на волне на закате",
"duration": 8,
},
)
job = r.json()
# опрашивайте polling_url, пока status != "completed"
print(job["id"], job["polling_url"])modelstringобязательныйpromptstringобязательныйfrequency_penaltynumberГенерация медиа (аудио/изображения) тарифицируется по фактической стоимости провайдера — итоговая цена хода видна в чате сразу после ответа.