Hacker News Digest

24 июля 2026 г. в 06:17 • bfl.ai • ⭐ 497 • 💬 119

OriginalHN

Flux 3

FLUX 3 — первая модель, обученная одновременно на изображениях, видео и звуке в единой архитектуре Self‑Flow. Она не просто объединяет отдельные моды, а заставляет их проверять друг друга: звук должен соответствовать удару, движение должно соблюдать массу, будущее должно вытекать из прошлого. Такое взаимное ограничение дает более полное представление о реальном мире и повышает точность генерации (ошибка Фрéchet‑расстояния ниже, успех задач выше).

Модель умеет создавать до 20‑секундных видеороликов с нативным аудио, продолжать видеопоток, превращать отдельные кадры в анимацию, менять стиль от камерного до кинематографического, генерировать изображения и их редактировать, а также выполнять мультиязычные диалоги. Она может генерировать видеоконтент из текста, трансформировать существующее видео, сохраняя центральные элементы, например персонажа, в новом контексте. Ранние результаты показывают, что FLUX 3 превосходит предыдущие подходы как в качестве визуального контента, так и в задачах физического взаимодействия. Партнёры уже используют её в робототехнике (FLUX‑mimic) и планируют открытый доступ к базовой версии для создания контента и предсказания действий. Компания постепенно открывает интерфейс для видео‑ и аудио‑редактирования и планирует выпуск открытого веса модели для исследователей и безопасного развертывания.