Цена $0.02 за секунду выглядит почти символической, пока не посчитаешь длинный эфир: четыре часа стрима обойдутся в $288. Lucy 2.5 от Decart — широко доступный API для обработки видео в реальном времени, однако заявленные в анонсах 1080p не совпадают с разрешением из документации API, а громкая цифра задержки относится к работе модели, а не к полному пути от камеры до экрана. Разбираемся, где заканчиваются маркетинговые формулировки, сколько это стоит в пересчёте на час и как получить доступ к сервису.
Что умеет Lucy 2.5 в реальном времени
Lucy 2.5 — модель Decart для редактирования видео в формате video-to-video в реальном времени. Она вышла 16 июля 2026 года вместе с публикацией "Raising the Bar for Live AI". Видеопоток поступает через WebRTC, а текстовые промпты и при необходимости референсные изображения направляют преобразование. На выходе модель, по заявлению Decart, выдаёт обработанные кадры с частотой 30 fps. Важно понимать границу возможностей: Lucy не создаёт готовые ролики с нуля, а меняет существующий живой поток — стилизует его, заменяет, добавляет или удаляет объекты. Тим Симмонс из Theoretically Media удачно формулирует разницу: это живые эффекты и композитинг поверх стрима, а не нелинейный монтаж. Пока что доступен только API: «приложения ещё нет», а показанный в стартовом видео Decart продукт, который держат в руках, «не является доступным продуктом».
Документация API поддерживает и живой, и записанный входной видеоматериал. На странице модели у fal указано, что коммерческое использование разрешено на условиях сервиса. Decart привлекла более $450M, включая раунд на $300M под руководством Radical Ventures в мае 2026 года.
Почему на 1080p рассчитывать пока не стоит
В анонсах и на странице модели fal для Lucy 2.5 заявлены 30 fps и 1080p. Но в собственной документации API Decart указано выходное разрешение 1280 × 720 — в горизонтальном формате 16:9 или вертикальном 9:16. Пока публично не задокументирован endpoint для 1080p, планировать нужно именно 720p: это зафиксировано в контракте API, и на это же разрешение рассчитаны примеры ценообразования.
Такой же подход нужен и к частоте кадров. Формулировка «30 FPS» встречается в маркетинговых материалах без опубликованной методики измерений. Decart не раскрывает ни серверное железо, ни размер модели, ни результаты теста от захвата изображения до воспроизведения. Полезная внешняя точка отсчёта — SANA-Streaming, исследовательский препринт от мая 2026 года: его авторы сообщают о 24 кадрах в секунду от начала до конца при 1280 × 704 на одной RTX 5090, тогда как diffusion-transformer-ядро работает на 58 fps. Это не бенчмарк Lucy, а иллюстрация того, почему сама по себе цифра «30 FPS» без чётко определённой точки измерения мало о чём говорит.
Задержка: что скрывается за «почти нулевой»
Для Lucy 2.5 встречаются три показателя задержки, но они описывают разные вещи. В публикации Decart об инфраструктуре DOS 2.0, вышедшей вместе с новостью о раунде $300M, заявлен отклик модели менее 30 мс. В обзоре сообщества на Hugging Face инфраструктуре инференса Decart приписывается задержка менее 40 мс на 720p: упоминаются квантизация MXFP8/NVFP4, динамическое sparse attention, глубокое объединение ядер и заявленное 4-кратное ускорение операций, ограниченных вычислениями. Однако никто из них не публикует полную задержку от захвата камерой до пикселей на экране зрителя. К ней добавляются передача по WebRTC, кодирование и плеер, а итог зависит от сети. Для оценки в своей инфраструктуре выведите в кадре видимую метку времени и сравните её с отображаемым результатом в целевой сети и через нужный путь воспроизведения.
Управление редактированием: восемь режимов и ограничения Self-Anchoring
Документированный набор инструментов Lucy 2.5 включает восемь операций. Каждой можно управлять текстовыми промптами, референсными изображениями или их сочетанием:
| Режим редактирования | Типичный сценарий в эфире |
|---|---|
| Замена персонажа | Подмена на VTuber-аватара или маскота бренда |
| Виртуальная примерка | Смена одежды во время live-commerce трансляции |
| Добавление объекта | Интерактивные элементы в демонстрации продукта |
| Замена объекта | Подмена предметов на заднем плане |
| Удаление объекта | Устранение лишних деталей с восстановлением фона |
| Изменение атрибутов | Корректировка цвета, размера и положения |
| Замена фона | Смена локации в эфире без хромакея |
| Глобальный перенос стиля | Стилизация от дневной сцены до киберпанка, live VFX |
Важнее самого списка режимов — две детали управления. Во-первых, Self-Anchoring — механизм, который подаёт недавний собственный результат модели обратно как референс, чтобы при долгом стриме не «плыла» идентичность. Он включён по умолчанию и меняется только при установлении соединения. В документации Decart сказано отключать его при резкой смене кадра, появлении нового человека или существенном изменении сцены: в таких случаях якорь указывает на мир, которого уже нет. Значит, потребуется переподключение, и это нужно учитывать в системах с несколькими камерами.
Во-вторых, для референсных изображений есть чёткие требования: хорошее освещение, отсутствие перекрывающих деталей, минимум 512 × 512 пикселей и кадрирование, соответствующее исходному видео. Тёмный или неподходящий по композиции референс может полностью сорвать замену.
Realtime или офлайн-генерация: что выбрать
Офлайн-генераторы вроде Runway, Pika и инструментов класса Sora решают другие задачи, чем Lucy 2.5. На вопрос «что лучше» нет универсального ответа — всё определяется сценарием. Есть четыре ключевых критерия:
- Интерактивность. Если зрители или камера должны влиять на видео прямо во время эфира, подходит только realtime-подход. Офлайн-инструменты работают по циклу «промпт — ожидание».
- Длительность. Офлайн-сервисы обычно создают клипы длиной 5–60 секунд и тратят на рендеринг от секунд до минут в продуктах уровня Runway и Pika, согласно сравнению Hugging Face. Lucy работает непрерывным потоком. fal заявляет многочасовую работу без распада идентичности, хотя стресс-тесты длительных сессий не опубликованы.
- Минимальный уровень качества. Для финальных материалов в 1080p и выше сегодня выигрывает офлайн-рендеринг: документированный выход API Lucy ограничен 720p. Тим Симмонс предлагает практичный гибридный процесс: снять сцену на телефон, вживую применить эффект Lucy для оценки кадра, а затем прогнать материал через офлайн-модель video-to-video для финального качества.
- Модель затрат. Офлайн-инструменты берут плату за сгенерированный клип, Lucy — за каждую активную секунду потока, и при почасовом расчёте разница быстро накапливается.
За чем пользователи тянутся на практике? На r/generativeAI u/TastyFooting предельно просто описал главную привлекательность технологии:
«Генерация video-to-video в реальном времени по текстовому промпту. Больше не нужно ждать рендеринга». (источник)
В обсуждениях постоянно звучат два открытых вопроса: u/ai_art_is_art спрашивает «Есть ли вообще применение такой модели? VTubing?», а автор из r/AINewsAndTrends сомневается, «будет ли это работать так же хорошо за пределами демо». Направления, которые документирует страница модели fal, включают live shopping и виртуальную примерку, размещение продуктов в реальном времени, интерактивные трансляции, преобразование сцен внутри приложений, игры и виртуальный стейджинг во время live-обходов. В обзоре Hugging Face к ним добавлены VTubing и создание вариаций рекламы. О том, как realtime-генерация меняет рынок видео-API в целом, читайте в нашем материале о SeedRealtime.
Во сколько обходится стрим: $0.02/сек — не главный показатель
Есть два опубликованных маршрута доступа и две цены:
| Способ доступа | Тариф | Один активный час | Примечания |
|---|---|---|---|
| Прямой API Decart | $0.02/сек (720p) | $72 | Новым аккаунтам дают тестовые кредиты; объёмные тарифы обсуждаются отдельно |
| Serverless через fal | $0.04/сек | $144 | Playground включён, минимальных объёмов нет |
Примеры ценообразования Decart показывают нижнюю границу: 30-секундная realtime-сессия стоит $0.60, а офлайн-редактирование 5-секундного видео в 720p — $0.20. Согласно страницам с тарифами обеих платформ, деньги списываются за активные секунды генерации, а не за время просмотра. Но для принятия решения важнее расчёт на длинных сессиях:
При четырёх активных часах в каждый будний день fal выставит около $576 в сутки, или примерно $12,700 за месяц с 22 рабочими днями — без учёта сетевых расходов и модерации. Непрерывная генерация превращает небольшую цену за единицу в задачу почасовой конкуренции: если каждому зрителю приложение открывает отдельный поток Lucy, почасовую сумму нужно умножать на число одновременных сессий. Если сравниваете этот вариант с другими API генерации, различия в моделях биллинга — за секунду, за клип или за токен — разобраны в нашем гайде по ценам и единицам тарификации видео-API.
Есть два базовых способа снизить расходы. Время простоя камеры не обязано быть временем активной генерации — запускайте поток только при появлении реального контента. Кроме того, сам выбор маршрута сокращает счёт вдвое: при одинаковом документированном выходе 720p прямой API Decart стоит в два раза дешевле fal, тогда как fal предлагает свой playground, коммерческие условия и экосистему. Выбор зависит не от модели как таковой, а от того, что ещё требуется вокруг неё.
Как получить доступ: Decart, playground и fal
Быстрее всего проверить, как Lucy 2.5 реагирует на ваше лицо, можно через браузерный интерфейс Decart: lucy.decart.ai или playground с демо на demos.decart.ai. Новым аккаунтам начисляются тестовые кредиты, которых может хватить на первую сессию. До написания кода стоит проверить там референсные изображения и формулировки промптов.
Прямой доступ через API Decart, согласно документации realtime Lucy 2.5, строится по стандартной WebRTC-схеме:
- Получите API-учётные данные и создайте realtime-сессию для модели
lucy-2.5 - Установите WebRTC-соединение, настроив Self-Anchoring и улучшение промптов при подключении; последующее изменение Self-Anchoring потребует переподключения
- Подключите к сессии живой или записанный входной медиапоток
- Передавайте текстовые промпты и референсные изображения по активному соединению — референсы можно обновлять прямо во время сессии
- Получайте обработанный выходной трек и используйте встроенное автопереподключение при обрыве сессии: экспоненциальная задержка, до 5 попыток
Интеграция через fal состоит из пяти шагов:
npm install --save @fal-ai/client- Создайте аккаунт fal и получите API-ключ в панели управления
- Откройте WebRTC-соединение с
decart/lucy-2-5/realtime - Выдавайте с бэкенда краткоживущие JWT через
tokenProvider; в примере fal срок действия токена составляет 10 секунд. Это не сценарий, где ключ можно просто оставить во фронтенде браузера - Обрабатывайте результаты и ошибки через
onResult/onError, затем отправляйте промпты по живому соединению
Согласно странице модели fal, доступны клиентские варианты на JavaScript, Python и обычном REST. Для OBS важно отделять прототип от продакшена: browser source или захват окна с интерфейсом Decart подойдут, чтобы проверить визуальный стиль, но в рабочем пайплайне лучше принимать WebRTC-выход собственной API-интеграции. В обзоре Hugging Face сообщается об использовании OBS через WebRTC без изменения существующей схемы вещания, но ingest, задержку и поведение при переподключениях стоит проверить в собственном стеке. Там же упомянуты SDK для Android и iOS. Если нужно сравнить поведение версий, Lucy 2.1 по-прежнему доступна на fal. Более широкий разбор fal как платформы — в нашем обзоре fal.ai.
Перед выходом в эфир: требования к раскрытию информации уже действуют
Модель, способная менять людей, одежду и окружение в живом видео, превращает соблюдение требований в инженерную задачу, а не в формальную строчку политики. Политика допустимого использования Decart, обновлённая 12 февраля 2026 года, запрещает выдавать себя за реального человека без ясного и заметного раскрытия информации и подтверждаемого согласия. Она также требует от внедряющих сервисы сторон сообщать о сгенерированном или изменённом ИИ-контенте, использовать подходящую модерацию и по возможности сохранять машиночитаемые метки. Отдельно требования ЕС к прозрачности, действующие с 2 августа 2026 года, обязывают использовать машиночитаемую маркировку обнаруживаемого ИИ-контента и раскрывать информацию со стороны внедряющей организации в сценариях класса deepfake. Для продуктов, ориентированных на ЕС, до запуска нужно подтвердить применимые требования к прозрачности и происхождению контента, а не разбираться с ними постфактум.
Стоит ли строить продукт на Lucy 2.5 уже сейчас?
| Ваш проект | Рекомендация |
|---|---|
| Эффекты для прямых эфиров, VTubing, интерактивное видео с участием аудитории | Можно начинать — это естественная территория технологии |
| Виртуальная примерка в live commerce, демонстрации product placement | Можно начинать: прототипируйте в 720p и проверяйте изоляцию редактирования на собственных видео |
| Вариации и локализация рекламы на основе одного исходного материала | Запускайте пилот — это правдоподобный ранний сценарий с понятной экономикой |
| Живой previs перед финальным офлайн-рендером | Можно начинать — тест визуального решения за $0.60 на 30 секунд дешевле пересъёмки |
| Финальные материалы в 1080p и выше | Подождите — документированный выход API составляет 720p |
| Непрерывные масштабные стримы с жёстким бюджетом | Подождите или строго ограничивайте запуск — почасовая тарификация растёт быстрее, чем цена за клип |
Главный фактор, за которым стоит следить: если Decart выпустит публичный маршрут для 1080p, разрыв в качестве между офлайн- и realtime-подходом заметно сократится. До этого момента считайте 720p контрактной характеристикой, а более высокую цифру — намерением.
FAQ по realtime-видео Lucy 2.5
Lucy 2.5 действительно работает в реальном времени?
Да, в том смысле, что изменения применяются к живому WebRTC-потоку с заявленной частотой 30 fps, а задержка на стороне модели указывается на уровне менее 30–40 мс. Независимых замеров полного пути от захвата до воспроизведения не опубликовано, поэтому «реальное время» сейчас подтверждено демо, но не независимыми бенчмарками.
Какое разрешение выдаёт API Lucy 2.5?
В API задокументирован выход 1280 × 720 в формате 16:9 или 9:16. В анонсах фигурирует 1080p, но публичного endpoint для 1080p по состоянию на конец августа 2026 года не задокументировано.
Сколько Lucy 2.5 стоит в час?
Прямой API Decart тарифицируется по $0.02 за активную секунду при 720p — это $72 за активный час. На fal та же модель стоит $0.04 за секунду, или $144 за активный час. Обе платформы считают активное время генерации, а не время просмотра.
Работает ли Lucy 2.5 с OBS?
Да, для прототипирования: браузерный интерфейс можно использовать в OBS через browser source или захват окна. Для продакшена до внедрения протестируйте приём WebRTC-потока в собственной вещательной инфраструктуре.
Lucy 2.5 или Lucy 2.1?
Согласно сравнению версий fal, Lucy 2.5 расширяет набор операций редактирования — объекты, одежда, персонажи, атрибуты, фоны, стили и VFX — и заявляет лучшее следование промптам, изоляцию правок и точность работы с референсами. Lucy 2.1 остаётся доступной на fal как более ранний realtime-endpoint, если вам нужна базовая версия с уже известным поведением. Лучше протестировать обе на собственном материале.