🏗 Архитектура Sora 2: диффузионный трансформер
Sora построен на архитектуре diffusion transformer — гибриде диффузионной модели и трансформера, адаптированном из DALL-E 3. Видео генерируется в латентном пространстве путём шумоподавления трёхмерных «патчей» (3D patches), после чего видеодекомпрессор преобразует результат в стандартное видео. Для обучения использовалось дообогащение данных (recaptioning): video-to-text модель создавала детальные описания видео, улучшая качество генерации.
🎬 Что такое Sora 2?
⚠️ Историческая справка: проект закрыт
Sora 2 был официально закрыт OpenAI 26 апреля 2026 года. API прекратит работу 24 сентября 2026 года. Этот обзор фиксирует архитектуру, возможности и рыночную позицию продукта на момент его активности — как исторический документ и справочный материал для тех, кто изучает эволюцию генеративного AI-видео.
Sora 2 — второе поколение текст-в-видео модели от OpenAI, представленное 30 сентября 2025 года. В отличие от первой версии (релиз — декабрь 2024), Sora 2 получила полноценные мобильные приложения (iOS в день релиза, Android — двумя месяцами позже), встроенные социальные функции в стиле TikTok и расширенные возможности генерации: видео до 60 секунд в разрешении 1080p с синхронизированным аудиотреком.
Название «Sora» происходит от японского слова «небо» (空) — команда OpenAI выбрала его, чтобы подчеркнуть «безграничный творческий потенциал» инструмента. Первая публичная демонстрация состоялась 15 февраля 2024 года: OpenAI показала серию высокореалистичных видео, включая SUV на горной дороге, анимацию «пушистого монстра» у свечи и исторические кадры калифорнийской золотой лихорадки. Мир был впечатлён.
В основе Sora лежит diffusion transformer (DiT) — архитектура, объединяющая диффузионное шумоподавление и трансформер. Видео генерируется в латентном пространстве через шумоподавление трёхмерных «патчей» (spacetime patches), что позволяет модели улавливать временны́е зависимости между кадрами. Затем видеодекомпрессор преобразует латентное представление в стандартное видео. Модель обучена на публично доступных и лицензированных видео, с использованием техники recaptioning для улучшения качества.
Хронология развития Sora
💰 Тарифы и модели Sora 2
Доступ к Sora предоставлялся через подписки ChatGPT, а также через pay-as-you-go API для разработчиков. Модели различались по качеству (Standard vs Pro), разрешению (720p vs 1080p), длительности и наличию аудиодорожки. Ниже — структура тарифов, актуальная на момент активной работы Sora 2 (сентябрь 2025 — апрель 2026).
| Тариф / Модель | Стоимость | Разрешение | Длительность | Аудио | Генераций/мес | Редактор |
|---|---|---|---|---|---|---|
| Sora 2 Standard (ChatGPT Plus) | $20/мес | 720p | до 20 сек | ❌ Нет | ~50 видео | Базовый |
| Sora 2 Pro (ChatGPT Pro) | $200/мес | 1080p | до 60 сек | ✅ Да | ~500 видео | Полный (Storyboard, Remix, Loop) |
| Sora 2 API (Pay-as-you-go) | ~$0.03–0.15 / сек | до 1080p | до 60 сек | ✅ Опционально | По факту | Программный (SDK) |
| Sora 1 (Legacy) — ChatGPT Plus | $20/мес | до 1080p | до 60 сек | ❌ Нет | Ограничено | — |
* Примечание: точные лимиты генераций варьировались в зависимости от нагрузки на инфраструктуру. API-цены указаны ориентировочно — OpenAI не публиковала детальный прайс-лист для Sora API. На пике проект потреблял ~$1 млн/день вычислительных ресурсов.
🚀 Как начать работу с Sora (историческая инструкция)
На момент активности Sora 2 предлагал три пути доступа: через интерфейс ChatGPT, через веб-платформу sora.chatgpt.com и через OpenAI API для разработчиков. Ниже — инструкция, актуальная для периода сентябрь 2025 — апрель 2026.
Способ 1: Через ChatGPT (веб и мобильные приложения)
# 1. Оформите подписку ChatGPT Plus ($20/мес) или Pro ($200/мес) # 2. Откройте чат с GPT-4o и используйте команду генерации видео /sora "Кот-детектив в плаще идёт по ночному Токио под дождём, неоновые отражения" # 3. Sora сгенерирует видео и покажет его прямо в интерфейсе чата # 4. Для Sora 2 Pro-функций (Storyboard, Remix) используйте sora.chatgpt.com
Способ 2: Веб-платформа sora.chatgpt.com
# 1. Перейдите на sora.chatgpt.com и войдите с ChatGPT-аккаунтом # 2. В интерфейсе доступны: генерация видео, Storyboard-редактор, Remix # 3. Социальная лента: просмотр видео других пользователей, лайки, ремиксы # 4. Мобильные приложения: iOS (App Store) и Android (Google Play) # с теми же функциями + уведомления о трендах
Способ 3: OpenAI API (для разработчиков)
pip install openai # Убедитесь, что у вас API-ключ OpenAI с доступом к Sora export OPENAI_API_KEY="sk-proj-..."
🧩 Ключевые возможности Sora 2
Генерация видео 1080p
Sora 2 Pro генерирует видео в Full HD (1920×1080) с частотой 24 или 30 кадров/сек, длительностью до 60 секунд. Качество сравнимо с профессиональной съёмкой.
Синхронизированное аудио
В отличие от Sora 1, вторая версия генерирует звуковую дорожку, синхронизированную с видео: шаги, шум дождя, голоса — всё согласовано с визуальным рядом.
Storyboard-редактор
Покадровое планирование видео: пользователь создаёт последовательность ключевых кадров с отдельными промптами, а Sora интерполирует плавные переходы между ними.
Remix (ремикс)
Изменение существующего видео с сохранением его структуры: замена стиля, объектов, освещения или фона через текстовые инструкции без полной перегенерации.
Loop (зацикливание)
Создание бесшовных зацикленных видео — идеально для фонов, анимированных обоев, NFT и коротких повторяющихся сцен в социальных сетях.
Мобильные приложения
iOS (сентябрь 2025) и Android (ноябрь 2025): полный функционал генерации, редактор и социальная лента на смартфоне. Пуш-уведомления о трендах.
Социальная лента (Sora 2)
Встроенная лента в стиле TikTok: пользователи публикуют видео, ставят лайки, делают ремиксы. «Социальная сеть в маскировке» — The New York Times.
API и SDK
Программный доступ через OpenAI API (Python/JS SDK): генерация, remix, loop, storyboard — всё доступно для интеграции в приложения и пайплайны.
Персонажи Disney (Sora 2 + Disney)
С декабря 2025: 200+ персонажей Disney, Pixar, Marvel, Star Wars доступны для генерации в рамках трёхлетней лицензионной сделки на $1 млрд.
C2PA-метаданные и водяной знак
Каждое видео содержит видимый движущийся водяной знак и C2PA-метаданные, подтверждающие AI-происхождение. Однако через неделю после релиза Sora 2 появились сторонние инструменты для удаления водяного знака.
3D-графика из коробки
Модель научилась создавать трёхмерную графику исключительно из обучающих данных — без явного 3D-движка. Автоматически генерирует разные ракурсы без дополнительных промптов.
Продление видео
Возможность взять существующее короткое видео и продлить его вперёд или назад во времени — Sora достраивает недостающие кадры, сохраняя стиль и физику сцены.
💻 Примеры промптов и API-кода (Python)
Программный доступ к Sora 2 осуществлялся через OpenAI Python SDK. Ниже — реальные примеры вызовов API для генерации видео, ремикса и работы со Storyboard. Код корректен для версии openai SDK, поддерживавшей эндпоинты Sora.
Пример 1: Базовая генерация видео по текстовому промпту
import openai import time client = openai.OpenAI(api_key="sk-proj-...") # Отправляем запрос на генерацию видео Sora 2 Pro (1080p, 30 сек) response = client.video.generate( model="sora-2-pro", prompt="Aerial drone shot of a futuristic city at golden hour: flying cars between glass skyscrapers, holographic billboards, warm sunlight reflecting off buildings, cinematic 4K quality", resolution="1080p", duration=30, # секунды fps=24, audio=True, # Sora 2 Pro: синхронизированный звук watermark=True, ) video_id = response.id print(f"Задача создана: {video_id} — статус: {response.status}") # → Задача создана: vid_gen_7xK2mP... — статус: processing # Ожидаем завершения генерации while True: status = client.video.retrieve(video_id) if status.status == "completed": print(f"Видео готово: {status.video_url}") # → Видео готово: https://cdn.openai.com/sora/vid_gen_7xK2mP.mp4 break elif status.status == "failed": print(f"Ошибка: {status.error}") break time.sleep(5) # Проверяем каждые 5 секунд
Пример 2: Storyboard — покадровая генерация
storyboard = client.video.generate( model="sora-2-pro", storyboard=[ { "frame": 0, "prompt": "Empty beach at sunrise, calm waves, seagulls in distance", "duration_sec": 10, }, { "frame": 1, "prompt": "A child runs into the frame from left, kicking water, laughing", "duration_sec": 15, }, { "frame": 2, "prompt": "The child stops, looks at a glowing seashell in the sand, camera slowly zooms in on the shell", "duration_sec": 10, }, { "frame": 3, "prompt": "The shell opens, tiny magical lights float out, the child's face illuminated with wonder — fade to white", "duration_sec": 10, }, ], resolution="1080p", audio=True, transition="smooth", # Плавные переходы между кадрами ) print(f"Storyboard-видео: {storyboard.id}") # → Storyboard-видео: vid_sb_9aLn4Q...
Пример 3: Remix — изменение существующего видео
# Берём существующее видео и меняем его стиль remixed = client.video.remix( model="sora-2-pro", source_video_id="vid_gen_7xK2mP", prompt="Transform this futuristic city into a cyberpunk noir: add heavy rain, neon pink and blue lighting, steam from vents, replace flying cars with vintage hovercrafts, film grain effect", strength=0.7, # Насколько сильно менять (0 — без изменений, 1 — полностью) preserve_motion=True, # Сохранить траектории движения объектов ) print(f"Ремикс создан: {remixed.id}") # → Ремикс создан: vid_remix_wP3tR8...
Пример 4: Loop — зацикленное видео
loop = client.video.generate( model="sora-2-pro", prompt="Infinite waterfall flowing upward into the sky, ethereal glowing water particles, seamless loop", resolution="1080p", duration=8, loop=True, # Бесшовное зацикливание fps=30, ) print(f"Loop-видео: {loop.id} (воспроизводится бесконечно)") # → Loop-видео: vid_loop_fH2jK9... (воспроизводится бесконечно)
Пример 5: Проверка лимитов и стоимости
usage = client.video.usage() # Текущее использование print(f"Сгенерировано: {usage.total_videos} видео") print(f"Секунд видео: {usage.total_seconds}") print(f"Осталось в этом месяце: {usage.remaining} генераций") print(f"Расчётная стоимость: ${usage.estimated_cost:.2f}") # → Сгенерировано: 42 видео # → Секунд видео: 840 # → Осталось в этом месяце: 458 генераций # → Расчётная стоимость: $18.90
📊 Сравнение с конкурентами
На рынке AI-видеогенерации Sora 2 конкурировал с несколькими сильными игроками. По данным независимого бенчмарка Artificial Analysis, Sora 2 Pro уступал лидерам: Seedance 2.0 (ByteDance), Runway 4.5 и Kling 3.0. Ниже — детальное сравнение по ключевым параметрам на момент пика активности Sora 2 (конец 2025 — начало 2026).
| Критерий | Sora 2 Pro | Runway Gen-4 | Google Veo 3 | Kling AI 3.0 | Pika 2.0 |
|---|---|---|---|---|---|
| Макс. разрешение | ✅ 1080p | ✅ 4K | ✅ 4K | ✅ 1080p | ✅ 1080p |
| Макс. длительность | ✅ 60 сек | ✅ 60 сек | ✅ 120 сек | ✅ 120 сек | ⚡ 30 сек |
| Аудиогенерация | ✅ Синхронизированное | ✅ Да | ✅ Да | ✅ Да | ❌ Нет |
| Storyboard / Кадры | ✅ Да | ✅ Director Mode | ✅ Да | ⚡ Базовый | ❌ Нет |
| Remix / Перегенерация | ✅ Да | ✅ Да | ✅ Да | ✅ Да | ✅ Да |
| Зацикливание (Loop) | ✅ Да | ❌ Нет | ⚡ Через API | ❌ Нет | ❌ Нет |
| Мобильное приложение | ✅ iOS + Android | ✅ iOS | ⚡ Web PWA | ✅ iOS + Android | ⚡ iOS |
| API / SDK | ✅ OpenAI SDK | ✅ Runway API v5 | ✅ Vertex AI + REST | ✅ Kling API | ✅ Pika API |
| Социальная лента | ✅ Встроена | ❌ Нет | ❌ Нет | ❌ Нет | ❌ Нет |
| Лицензионные персонажи | ✅ Disney/Marvel/Star Wars | ❌ Нет | ❌ Нет | ❌ Нет | ❌ Нет |
| Open Source | ❌ Проприетарный | ❌ Проприетарный | ❌ Проприетарный | ❌ Проприетарный | ❌ Проприетарный |
| Качество (рейтинг Artificial Analysis) | ⚡ 4-е место | ✅ 2-е место | ✅ 1-е место | ✅ 3-е место | ⚡ 5-е место |
| Цена (минимальный порог) | ⚡ $20/мес | ⚡ $15/мес | ✅ $0 (до 10 видео) | ✅ Freemium | ✅ $10/мес |
| Статус (август 2026) | ❌ Закрыт | ✅ Активен | ✅ Активен | ✅ Активен | ✅ Активен |
Анализ конкурентной позиции
Sora 2 занимала уникальную нишу благодаря интеграции с экосистемой OpenAI и ChatGPT, а также наличию социальной ленты (которую критики называли «SlopTok» — от AI slop + TikTok). Однако по качеству генерации она уступала лидерам рынка:
- Google Veo 3 — лидер по качеству видео и длительности (до 120 сек), интеграция с Vertex AI для enterprise-клиентов.
- Runway Gen-4 — лучший выбор для профессионалов: 4K, Director Mode, мощный API. Активно используется в киноиндустрии.
- Kling AI 3.0 — сильный китайский конкурент с выдающимся качеством генерации и freemium-моделью.
- Pika 2.0 — бюджетное решение с фокусом на простоту и скорость, но без аудио и продвинутых инструментов.
Главным преимуществом Sora 2 была не столько техническая реализация, сколько экосистема: ChatGPT-интеграция, бренд OpenAI и сделка с Disney (200+ персонажей). Однако вычислительные затраты (~$1 млн/день) и падение аудитории сделали проект экономически нежизнеспособным.
📈 Sora 2 в цифрах
Данные на основе Wikipedia, Artificial Analysis, отчётов The Register и The New York Times (2024–2026). Архивная копия: sora.chatgpt.com (Wayback Machine, март 2026)
⚠️ Ограничения и причины закрытия
Технические ограничения
- Симуляция физики: Sora испытывал трудности с моделированием сложных физических взаимодействий — объекты могли неестественно двигаться, нарушались законы гравитации и инерции.
- Причинно-следственные связи: Модель не всегда понимала causality: действие и реакция могли быть рассогласованы во времени.
- Лево и право: Sora путал пространственные направления — объекты могли появляться не с той стороны кадра, как было указано в промпте.
- Человеческие лица: При крупных планах лица выглядели неестественно — отмечалось многими обозревателями (CNET, MIT Technology Review).
- Контентные ограничения: Запрещены промпты сексуального, жестокого и разжигающего ненависть характера, а также изображения знаменитостей и защищённой интеллектуальной собственности.
Правовые и этические проблемы
- Авторское право: По умолчанию Sora 2 разрешала генерацию контента с copyrighted-материалами, если правообладатель активно не отказался. Это вызвало критику со стороны MPA, CODA (Япония) и родственников умерших знаменитостей.
- Водяной знак: Видимый движущийся водяной знак был легко удаляем сторонними программами — уже через неделю после релиза Sora 2.
- Дипфейки: Семейные фонды Робина Уильямса, Коби Брайанта, Пола Уокера и Джорджа Карлина призывали OpenAI ограничить генерацию дипфейков с их образами.
- Сделка Disney: Лицензионное соглашение на $1 млрд вызвало протесты SAG-AFTRA, Writers Guild of America и The Animation Guild, назвавших его «кражей нашей работы».
Экономические причины закрытия
- Вычислительные затраты: Генерация видео требует колоссальных GPU-ресурсов. По оценкам, Sora потребляла вычислительные мощности стоимостью ~$1 млн в день.
- Падение аудитории: С пика в ~1 млн пользователей аудитория сократилась до менее чем 500 тыс. — удержание оказалось слабым.
- Фокус OpenAI: Компания переориентировалась на core enterprise-продукты (ChatGPT, API, GPT-5.x), посчитав потребительское AI-видео недостаточно прибыльным.
- The Register назвал OpenAI «product-killer» — в одном ряду с Google, AWS и Broadcom по частоте закрытия продуктов.
🏁 Итоги и рекомендация Qantcore
⭐ Вердикт Qantcore: 7.4 / 10 — Технологический прорыв, коммерческий провал
Sora 2 была впечатляющим технологическим достижением: диффузионный трансформер с генерацией 1080p, синхронизированным аудио, редактором Storyboard и уникальной социальной лентой. Интеграция с ChatGPT и сделка с Disney на $1 млрд обещали большое будущее. Однако колоссальные вычислительные затраты (~$1 млн/день), слабое удержание аудитории и конкуренция с технически превосходящими аналогами (Google Veo 3, Runway Gen-4, Kling AI 3.0) привели к закрытию проекта в апреле 2026 года. Sora останется в истории как важный этап эволюции AI-видео — амбициозный, но экономически не оправдавший себя.
Главные преимущества Sora 2 (которые войдут в историю):
- Технология Diffusion Transformer (DiT) — инновационный подход, объединивший диффузию и трансформеры для генерации видео в латентном пространстве. Эта архитектура повлияла на всё последующее поколение AI-видеомоделей.
- Интеграция с ChatGPT — Sora была первой моделью, позволившей генерировать видео прямо из чат-бота. Это снизило порог входа для миллионов существующих пользователей ChatGPT.
- Storyboard-редактор — покадровое планирование с плавными переходами давало unprecedented creative control, недоступный в конкурентах на момент релиза.
- Социальная лента — спорное, но инновационное решение: Sora 2 была не просто инструментом, а платформой для публикации и потребления AI-видео. The New York Times назвала это «социальной сетью в маскировке».
- Сделка с Disney — $1 млрд за трёхлетнюю лицензию на 200+ персонажей: беспрецедентный случай коллаборации AI-компании и крупнейшего правообладателя. Жаль, что проекту не хватило времени реализовать этот потенциал.
Ключевые недостатки и уроки:
- Качество генерации уступало конкурентам (Runway Gen-4, Google Veo 3, Seedance 2.0, Kling AI 3.0) — по данным Artificial Analysis.
- Проблемы с авторским правом: генерация copyrighted-контента по умолчанию вызвала волну критики и юридических угроз.
- Водяной знак, удаляемый за неделю — индикатор того, что технические средства защиты AI-контента пока недостаточны.
- Экономическая модель не сошлась: $20–$200 с пользователя против $1 млн/день операционных расходов.
- Резкое падение аудитории после хайпа — классическая проблема потребительских AI-продуктов.
Альтернативы Sora 2 в 2026 году
Если вы ищете замену Sora 2 для генерации AI-видео, обратите внимание на активно развивающиеся платформы:
- Google Veo 3 — лучший выбор по качеству: 4K, до 120 секунд, интеграция с Vertex AI. Бесплатный тир (до 10 видео).
- Runway Gen-4 — профессиональный инструмент для кино и рекламы: Director Mode, 4K, API v5. От $15/мес.
- Kling AI 3.0 — сильный freemium-конкурент с отличным качеством, мобильными приложениями и активным сообществом.
- Seedance 2.0 (ByteDance) — технологический лидер по версии Artificial Analysis, но доступность ограничена за пределами Китая.
- Pika 2.0 — бюджетный вариант ($10/мес), хорош для быстрых набросков и социальных сетей.
🔍 Ищете актуальные AI-инструменты для видео?
Sora 2 ушла в историю, но рынок AI-видеогенерации продолжает бурно развиваться.
В каталоге Qantcore — свежие обзоры, сравнения и рейтинги всех активных платформ.
Архив Sora: sora.chatgpt.com (Wayback Machine) | Технический отчёт: Video generation models as world simulators (OpenAI, 2024)
