Следующее поколение аудиовизуальной генеративной модели от ByteDance с архитектурой Dual-Branch Diffusion Transformer на 4,5 млрд параметров. Seedance 1.5 Pro генерирует видео и аудио одновременно за один унифицированный проход, устраняя проблемы с синхронизацией...
Провайдер для ByteDance: Seedance 1.5 Pro
Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.
Модальности
Другие модели от bytedance
ByteDance: Seedance 2.0 Fast
Seedance 2.0 Fast — это модель генерации видео от ByteDance. Она поддерживает преобразование текста в видео, изображения в видео с контролем первого и последнего кадра, а также мультимодальное преобразование референса в видео. Модель ориентирована на скорость генерации и снижение стоимости...
ByteDance: Seedance 2.0
Seedance 2.0 — это модель для генерации видео от ByteDance. Она поддерживает преобразование текста в видео, изображения в видео с контролем первого и последнего кадра, а также мультимодальное преобразование референса в видео. Модель особенно сильна в сохранении согласованности персонажей,...
ByteDance: UI-TARS 7B
UI-TARS-1.5 — это мультиканальный визуально-языковой агент, оптимизированный для сред с графическим интерфейсом пользователя (GUI), включая настольные интерфейсы, веб-браузеры, мобильные системы и игры. Разработанный ByteDance, он основан на фреймворке UI-TARS с использованием рассуждений на основе обучения с подкреплением, что обеспечивает надёжное планирование и выполнение действий в виртуальных интерфейсах. Эта модель достигает самых современных результатов в ряде интерактивных и grounding бенчмарков, включая OSworld, WebVoyager, AndroidWorld и ScreenSpot. Она также демонстрирует идеальное выполнение задач в различных играх Poki и превосходит предыдущие модели в задачах агентов Minecraft. UI-TARS-1.5 поддерживает декомпозицию мыслей во время инференса и показывает сильное масштабирование по вариантам, при этом версия 1.5 заметно превосходит производительность более ранних контрольных точек 72B и 7B.