Модели Givon AI

Выбери модель под задачу: создать изображение, оживить фото или собрать видеосцену. На странице модели видны возможности, ограничения и актуальная стоимость; для разработчиков там же доступна схема API.

Видео

35
FLUX 3от 10 токенов/с
flux-3Black-forest-labs

Универсальная видео-модель Black Forest Labs: создаёт ролик из текста, первого кадра, пары первого и последнего кадров или до 10 ключевых кадров, а также продлевает готовое MP4-видео. 720p/1080p, 5–20 секунд, звук по желанию.

FLUX Video Upscale48 токенов/с
flux-video-upscaleBlack-forest-labs

Апскейлер видео от Black Forest Labs на базе FLUX 3: увеличивает исходный MP4-ролик в 1,5–3 раза с сохранением пропорций. Точный режим бережно сохраняет исходник, творческий восстанавливает и дорисовывает мелкие детали по опциональному промпту.

Gemini Omni 1.1 Flashот 28 токенов
gemini-omni-1.1-flashGoogle

Модель Google для роликов из текста, стартового кадра, изображений или короткого видео-референса, а также пары первого и последнего кадров. Создаёт синхронный звук и поддерживает разрешения от быстрых 360p-черновиков до 4K.

Gemini Omni Flashот 20 токенов
gemini-omni-videoGoogle

Мультимодальная модель Google: собирает ролик из текста, изображений и видео и правит готовый клип в диалоге. Бери, когда надо трансформировать снятое или смешать разные входы, а не снять кадр с нуля как Veo. Синхронный звук, до 4K.

Grok Imagine Videoот 1 токенов/с
grok-imagine-videoxAI

Быстрое короткое видео с синхронным звуком и точным следованием промпту. Продолжает клип с последнего кадра — удобно склеивать сцены. 480p/720p/1080p.

Grok Imagine Video 1.5от 1 токенов/с
grok-imagine-video-1.5xAI

Image-to-video от xAI: оживляет один исходный кадр с синхронным звуком и сильным следованием промпту, тянет клипы до 15 секунд в 480p/720p/1080p. В топ-3 арены image-to-video.

HappyHorse 1.0от 6 токенов/с
happyhorse-1.0Alibaba

Топовая видео-модель Alibaba: за один проход выдаёт клип с синхронным звуком и речью. Бери для кинематографичных многосценовых роликов с готовой озвучкой — из текста, кадра, набора референсов или правки исходного видео. 720p/1080p.

HappyHorse 1.1от 5,5 токенов/с
happyhorse-1.1Alibaba

Новый режим для роликов из текста, изображения или референсов: до 15 секунд, до 9 изображений-референсов, 720p/1080p. Звук создаётся автоматически и не выключается отдельно.

HeyGen Avatar IV3 токенов/с
heygen-photo-avatarHeyGen

Говорящий аватар из одного фото: модель читает тон и ритм голоса и сама лепит живую мимику и жесты рук. Синхронизация по тексту или готовой озвучке.

Kling 2.6от 3 токенов/с
kling-2.6Kling

Синхронный звук одним проходом — речь, эмбиент и эффекты сразу в кадре, без отдельного дубляжа. Бери для бюджетных клипов и говорящих голов, когда несколько сцен не нужны.

Kling 2.6 Motion8 токенов/с
kling-2.6-motionKling

Доступный motion-control: переносит движение с видео-референса на твоего персонажа. Бери для несложной моторики, когда не нужна точность тира 3.0.

Kling 3.0от 3 токенов/с
kling-3.0Kling

Флагман Kling: до 15с и 4K с удержанием образа персонажей между сценами, многосценовая режиссура и синхронный многоязычный звук.

Kling 3.0 Motion7 токенов/с
kling-3.0-motionKling

Переносит записанное движение, танец или жест с видео-образца на твоего персонажа целиком — с фиксацией лица и захватом сложной моторики. Бери, когда нужен точный повтор хореографии с лучшей консистентностью внешности.

Kling 3.0 Omniот 6,4 токенов/с
kling-3.0-omniKling

Многосценовое видео с синхронным звуком: переносит образ и голос персонажа с видео-образца в новые сцены, но с этим образцом звук недоступен. Бери для связного нарратива с одним героем.

Kling 3.0 Turboот 5,5 токенов/с
kling-3.0-turboKling

Быстрый режим для роликов из текста или изображения: до 15 секунд, 720p/1080p. Последний кадр и звук не поддерживаются.

Kling Avatar 2.0от 6 токенов/с
kling-digital-humanKling

Оживляет человека с фото по озвучке: синхронизирует речь, мимику и жесты. Подойдёт, когда нужен говорящий или поющий ведущий с одного портрета.

Kling Lip-Sync6 токенов/с
kling-lip-syncKling

Перекладывает движение губ на готовом видео под новую звуковую дорожку. Бери, когда ролик снят и нужен только дубляж, локализация или замена речи.

Kling O1от 5,5 токенов/с
kling-o1Kling

Сливает до 7 ракурсов одного субъекта (Elements) и держит его внешний вид строго консистентным через весь клип. Бери для разворотов персонажа, повторяющихся героев и демо продукта.

MiniMax H3от 12 токенов/с
minimax-h3MiniMax

768P/2K-видео со стереозвуком из текста, первого и последнего кадра или набора изображений и аудио-референсов. Бери 768P для более доступных итераций, 2K — для финальной детализации, до 15 секунд.

MiniMax H3 Max by falот 6 токенов/с
minimax-h3-maxMiniMax

Быстрая post-trained версия MiniMax H3 от fal для точного следования промпту и сильной эстетики. Создаёт видео со звуком из текста, первого и опционального последнего кадра; 480P/768P, 5–15 секунд.

MiniMax H3 Max Turbo by falот 3 токенов/с
minimax-h3-max-turboMiniMax

Самая быстрая версия H3 Max от fal: видео со звуком из текста, первого и опционального последнего кадра быстрее реального времени. 480P/768P, 5–15 секунд.

Seedance 2.0от 4,2 токенов/с
seedance-2.0BytePlus

Отвечает на режиссёрские команды — ракурс, движение камеры, смена планов — через описание, со звуком в одном проходе. Бери для кинематографичных кадров по референсам, вплоть до 4K.

Seedance 2.0 Fastот 3,8 токенов/с
seedance-2.0-fastBytePlus

Та же кинематографичность и контроль камеры, но заметно быстрее — для итераций и объёма. Синхронный звук и референсы, до 720p.

Seedance 2.0 Miniот 1,5 токенов/с
seedance-2.0-miniBytePlus

Самый доступный режим для быстрых генераций из текста, изображения или референсов: 480p/720p, длительность 4–15 секунд. Видео- и аудио-референсы доступны не во всех режимах.

Seedance 2.5от 13,5 токенов/с
seedance-2.5BytePlus

Флагманская Seedance для генерации и редактирования видео из текста, изображений и референсов видео/аудио. 480p/720p/1080p, 4–30 секунд.

SwitchX Videoот 9 токенов/с
switchx-videoBeeble

Меняет в уже снятом видео фон, объект или свет по тексту, одному референсу и опциональной маске, сохраняя субъект — его форму, движение и мимику. Длительность берётся из исходника, на выходе 720p или 1080p.

Sync Lipsync v312 токенов/с
sync-lipsync-v3Sync

Синхронизирует видео или фото спикера с выбранной озвучкой с помощью модели sync-3 от sync.

Topaz Astra
topaz-astraTopaz

Creative Video Upscale & Enhancement от Topaz: улучшает уже готовый GenAI-ролик, дорисовывая детали и текстуру при апскейле до 4K. Это workflow исходное видео → улучшенное видео с опциональным промптом для управляемого рестайлинга.

Topaz Starlight Precise 2.5
topaz-starlight-preciseTopaz

Точное улучшение уже готового видео от Topaz: восстанавливает лица, материалы, фактуры и текст без творческого рестайлинга, с выводом до 4K.

Veo 3.1от 14 токенов/с
veo-3.1Google

Флагман Google для премиальных кинокадров: изображение до 4K с синхронным звуком — диалог, звуки и эмбиенс из коробки. До 3 референсов держат персонажа и стиль стабильными.

Veo 3.1 Fastот 2 токенов/с
veo-3.1-fastGoogle

Та же чёткость до 4K и синхронный звук, что у флагмана, но заметно быстрее и дешевле. Рабочая лошадка для итераций и большинства продакшен-задач.

Veo 3.1 Liteот 3 токенов/с
veo-3.1-liteGoogle

Самый доступный тир Veo: до 1080p (без 4K) и звук, который можно включать и выключать. Бери, когда нужен большой объём контента для соцсетей, а 4K ни к чему.

Wan 2.7 Videoот 6 токенов/с
wan-2.7-videoAlibaba

Генерация и редактирование видео в одном движке: из текста, из фото, с заданным финальным кадром или правкой готового клипа по описанию. До 1080p.

Wan 3.0от 4 токенов/с
wan-3.0Alibaba

Универсальная Wan 3.0: текст-в-видео, первый и последний кадры, а также референсы изображений, видео и аудио. Встроенный звук включён по умолчанию и переключается; 480p, 720p и 1080p, 2–30 секунд.

Wan 3.0 Primeот 7 токенов/с
wan-3.0-primeAlibaba

Отдельная версия Wan 3.0 Prime для текст-в-видео, первого и последнего кадров и мультимодальных референсов. Встроенный звук включён по умолчанию и переключается; 480p, 720p и 1080p, 2–30 секунд.

Изображения

22
ChatGPT Images 2.0от 1 токенов
gpt-image-2OpenAI

Флагман OpenAI для сложных изображений: точно держит длинные инструкции, многоэлементную композицию и текст внутри кадра на разных языках. Бери под инфографику, слайды, упаковку и многоязычные постеры; 1K/2K/4K, правки по всей картинке.

Grok Imagine1,5 токенов
grok-imaginexAI

Базовый image-тир от xAI: генерация и редактирование всей картинки по тексту без маски, сборка из нескольких референсов. Бери для быстрых концептов и диалоговых правок, когда не нужна точность тира Pro.

Grok Imagine Image 2.01,5 токенов
grok-imagine-image-2.0xAI

Новое поколение Grok Imagine для генерации изображений: точнее выполняет инструкции, увереннее рисует текст и лучше сохраняет визуальную согласованность сложной сцены.

Grok Imagine Pro2 токенов
grok-imagine-proxAI

Старший тир Grok Imagine: больше детализации и аккуратный текст в кадре, точно держит композицию по подробному описанию. Бери, когда базовому тиру не хватает качества картинки.

Higgsfield Soul 2.0от 3 токенов
higgsfield-soul-2Higgsfield

Фотореалистичная text-to-image модель Higgsfield Soul 2.0 для выразительных портретов, кампаний и редакционных сцен в 720p или 1080p.

MAI Image 2.5от 4,5 токенов
mai-image-2.5Microsoft

MAI Image 2.5: генерация и редактирование изображений.

MAI Image 2.5 Proот 15 токенов
mai-image-2.5-proMicrosoft

MAI Image 2.5 Pro: генерация и редактирование изображений.

Muse Image1 токенов
muse-imageMeta

Muse Image: генерация и редактирование изображений.

Nano Banana2 токенов
nano-bananaGoogle

Входной тир семейства Google: самая доступная генерация изображений в 1K. Диалоговое редактирование и слияние референсов — для объёма и быстрых черновиков.

Nano Banana 2от 3 токенов
nano-banana-2Google

Универсальный Flash-тир Google: до 4K, аккуратный текст, низкая задержка и консистентность по референсам. Бери для быстрых итераций и объёмной генерации, когда нужен сильный результат дешевле Pro.

Nano Banana 2 Lite2 токенов
nano-banana-2-liteGoogle

Самый быстрый и лёгкий тир Nano Banana 2 для 1K-черновиков, быстрых визуальных итераций и недорогих правок. Бери для объёмных идей, референсных набросков и маркетинговых вариантов, когда не нужен 2K/4K.

Nano Banana Proот 2 токенов
nano-banana-proGoogle

Премиальный Google-тир для сложных бренд-сцен: хорошо держит style guide, референсы, свет и фактуры материалов. Бери для отполированных продуктовых и портретных визуалов, многоэлементных композиций и 4K-финалов.

Qwen Image 3.01,5 токенов
qwen-image-3Alibaba

Стандартная модель Qwen для генерации и редактирования изображений: сильна в сложных макетах, тексте и многоязычных визуалах. Поддерживает 1K/2K и до трёх входных изображений.

Qwen Image 3.0 Proот 2 токенов
qwen-image-3-proAlibaba

Pro-модель Qwen для генерации и редактирования изображений: хорошо следует подробному описанию и подходит для сцен с текстом в кадре. Поддерживает 1K/2K и до трёх входных изображений.

Recraft V4от 3 токенов
recraft-v4Recraft

Recraft V4: генерация изображений по тексту.

Recraft V4.1от 3 токенов
recraft-v4.1Recraft

Recraft V4.1: генерация изображений по тексту.

Seedream 4.5от 2 токенов
seedream-4.5BytePlus

Кинематографичный свет и стабильный образ персонажа между генерациями. Бери для продуктовых каталогов, чарактер-сетов и правок по референсу — стабильная рабочая модель: 2K/4K, до 14 референсов.

Seedream 5.0 Lite2 токенов
seedream-5BytePlus

Лёгкий Seedream 5.0: рассуждает над сложным промптом и сама ищет в сети — собирает многоэлементные сцены и кадры по актуальной повестке. Правит по примеру-референсу, тянет до 3K.

Seedream 5.0 Proот 2 токенов
seedream-5-proBytePlus

Seedream для фотореалистичных коммерческих hero-кадров, товарной фотографии и правок по размеченному референсу. Сильна в естественном свете, коже и материалах, хорошо держит явно заданный арт-дирекшн; 1K/2K, до 10 референсов.

SwitchX Imageот 6 токенов
switchx-imageBeeble

Релайтинг и композитинг от Beeble: переносит на исходное фото объект, фон или свет по тексту, одному референсу и опциональной маске — с физически корректным светом, не генерируя картинку с нуля. 720p и 1080p.

Wan 2.7 Image1,5 токенов
wan-2.7-imageAlibaba

Упор на портреты и лица: черты, макияж и причёску задаёшь через референсы. Бери для аватаров, бьюти и консистентных серий персонажей. Разрешение до 2K.

Wan 2.7 Image Pro4 токенов
wan-2.7-image-proAlibaba

4K-тир Wan с режимом рассуждения над промптом: точнее держит сложные многошаговые инструкции и текст внутри кадра — вплоть до таблиц и формул. Бери для тяжёлых деливериблов вроде постеров и упаковки.