ByteDance
Модели, созданные командой ByteDance и доступные через единый API GoRouter.
6
моделей в каталоге
Модели автора
Хостинг-провайдеры и условия маршрутизации указаны на странице каждой модели.
bytedance/seedance-2.0-mini
Seedance 2.0 Mini — это модель генерации видео от ByteDance. Она поддерживает генерацию видео из текста, генерацию видео из изображения с контролем первого и последнего кадра, а также мультимодальную генерацию видео по ссылке с входными данными в виде изображения, видео и аудио. Она поддерживает вывод в разрешении 480p и 720p для видео длительностью 4-15 секунд. Количество токенов вычисляется по формуле: (высота выходного видео ширина выходного видео длительность * 24) / 1024.
bytedance/seedance-2.5
Seedance 2.5 — это модель генерации видео от ByteDance. Она подходит для длительного повествования, мультимодальной генерации на основе референсов, редактирования видео и расширения видео. Поддерживает управление по первому кадру и по первому и последнему кадрам, до 50 изображений, видео и аудио-референсов, необязательное генерируемое аудио и многоязычную аудиовизуальную генерацию.
bytedance/seedance-2.0
Seedance 2.0 — это модель генерации видео от ByteDance. Она поддерживает генерацию видео из текста, из изображения с контролем первого и последнего кадра, а также мультимодальную генерацию по референсу. Она особенно сильна в сохранении согласованности персонажа, визуального стиля и движения камеры из референсного материала. Количество токенов вычисляется по формуле (высота выходного видео ширина выходного видео длительность * 24) / 1024.
bytedance/seedance-2.0-fast
Seedance 2.0 Fast — это модель генерации видео от ByteDance. Она поддерживает преобразование текста в видео, изображения в видео с управлением первым и последним кадром, а также мультимодальное преобразование референса в видео. Она ставит приоритет на скорость генерации и низкую стоимость, а не на максимальное качество вывода. Количество токенов определяется как (высота выходного видео ширина выходного видео длительность * 24) / 1024
bytedance/seedance-1-5-pro
ByteDance — аудиовизуальная генеративная модель следующего поколения с архитектурой Dual-Branch Diffusion Transformer на 4.5B параметров. Seedance 1.5 Pro генерирует видео и аудио одновременно за один единый проход — это устраняет проблемы синхронизации при последовательном озвучивании. Поддерживает многоязычную синхронизацию губ (английский, мандаринский, японский, корейский, испанский и другие), кинематографическое управление камерой (панорамирование, наклон, масштабирование, орбитальное движение), диалоги нескольких персонажей и согласованность персонажей между кадрами. Pro создаёт клипы длительностью от 4 до 12 секунд с разрешением до 1080p. Количество токенов вычисляется по формуле: (высота выходного видео ширина выходного видео длительность * 24) / 1024
bytedance/ui-tars-1.5-7b
UI-TARS-1.5 — это мультимодальный визуально-языковой агент, оптимизированный для сред GUI-based, включая интерфейсы рабочего стола, веб-браузеры, мобильные системы и игры. Созданный компанией ByteDance, он основан на фреймворке UI-TARS с рассуждением на основе обучения с подкреплением, что обеспечивает надежное планирование действий и их выполнение в виртуальных интерфейсах. Эта модель достигает самых современных результатов на ряде интерактивных и grounding-бенчмарков, включая OSworld, WebVoyager, AndroidWorld и ScreenSpot. Она также демонстрирует полное выполнение задач в разнообразных играх Poki и превосходит предыдущие модели в задачах агента Minecraft. UI-TARS-1.5 поддерживает декомпозицию мышления во время инференса и демонстрирует сильное масштабирование по вариантам, причем версия 1.5 заметно превосходит по производительности более ранние чекпоинты 72B и 7B.