• Новости
  • Генерация видео
  • Генерация изображений
  • Генерация звука
  • Генерация текста
  • Обзор сервисов
ИИ для профессионалов
Нейросети в бизнесе: автоматизация, аналитика, контент.
Автор

admin

admin

    Генерация видео

    Wan3.0 от Alibaba превращает презентации и отчёты в 30-секундные ролики

    admin 02.09.2026


    Alibaba официально запустила Wan3.0 — видеомодель, которая делает ролик длиной до 30 секунд из текста, картинок, аудио и обычных офисных файлов. Презентацию, отчёт или веб-страницу можно отдать модели целиком и получить готовое видео. Запуск состоялся 24 августа.

    Содержание

    1. Презентация на входе, ролик на выходе
    2. Тридцать секунд и десять картинок
    3. Лицо героя не плывёт между сценами
    4. Вчетверо дешевле Veo 3.1
    5. Текст в кадре пока хромает
    6. Три двери в Wan3.0
    7. Статья превращается в короткий ролик
    8. Открытые веса остались в Wan2.2

    Wan — линейка видеомоделей Alibaba , которую компания развивает с 2025 года и держит в своём облаке. Третье поколение подаётся под лозунгом «видео из чего угодно», потому что кроме текстового запроса модель принимает готовые рабочие файлы. В открытом предварительном доступе Wan3.0 провёл чуть больше двух недель, с 6 августа. Работать с ним можно через Alibaba Cloud Model Studio и Qwen Cloud по идентификатору wan3.0-video, а потребительский сайт wan.video пока открыт только для участников программы.

    Презентация на входе, ролик на выходе

    От привычных text-to-video генераторов Wan3.0 отличает приём документов. Модель читает DOC, XLS, PPT, PDF, TXT и Markdown, понимает форматы Apple Keynote, Pages и Numbers, принимает ссылку на веб-страницу и собирает по ним видеоряд. Квартальный отчёт становится видеосводкой, обучающий модуль — мини-курсом, рекламная презентация — роликом для соцсетей.

    Аппетит у Wan3.0 при этом умеренный. За один запрос принимается один файл или одна ссылка, до 100 МБ и до 50 страниц. Годовой отчёт на две сотни страниц целиком не зайдёт.

    Такой вход переводит Wan3.0 из разряда «красивая пятисекундная заставка» в разряд производственного инструмента. Материал для ролика у компании обычно уже лежит в файловом хранилище и до сих пор требовал монтажёра.

    Тридцать секунд и десять картинок

    Предельная длина ролика у Wan3.0 — 30 секунд за одну генерацию, без склейки из кусков. Это вдвое больше, чем у прошлого поколения Wan2.7. Разрешение на выбор — 480p, 720p или 1080p. За один запрос модель принимает сразу несколько источников:

    • текстовый промпт;
    • до 10 изображений;
    • до 5 видеофрагментов;
    • до 5 аудиодорожек;
    • документ или ссылку на веб-страницу.

    Платформа подсказывает оптимальную длительность под сюжет и умеет продолжать готовый ролик.

    Лицо героя не плывёт между сценами

    Главный акцент Alibaba делает на согласованности. Wan3.0 удерживает внешность персонажа, вид товара, планировку пространства, единый стиль и голос от сцены к сцене — то самое место, где генеративное видео обычно рассыпается. Отдельно компания заявляет о разнообразии лиц и более живой мимике, независимых замеров пока нет.

    Звук Wan3.0 выдаёт синхронно с картинкой, вместе с речью, музыкой и эффектами, озвучка мультиязычная. Второй практичный момент — точечные правки. Поменять изображение, реплику или поворот сюжета можно без полной перегенерации, что для тридцатисекундного ролика экономит и время, и деньги.

    Вчетверо дешевле Veo 3.1

    Стоимость доступа к Wan3.0 через API считается посекундно. В базовом тарифе выходит так:

    • 480p — $0,05 за секунду, $1,50 за тридцатисекундный ролик;
    • 720p — $0,10 и $3 соответственно;
    • 1080p — $0,20 и $6.

    Есть и тариф Prime с более быстрой генерацией, где те же секунды идут по $0,068, $0,14 и $0,28. С 24 августа по 23 сентября Alibaba держит на базовом тарифе скидку 30%.

    Google Veo 3.1 в базовой версии просит около $0,40 за секунду, вчетверо больше, чем Wan3.0 в максимальном качестве. Ценовая агрессия объяснима. Релиз вышел следом за размещением акций почти на $10 млрд, и эти деньги идут в ИИ-инфраструктуру.

    Текст в кадре пока хромает

    Слабые места Alibaba называет сама. Качество надписей внутри кадра и качество звука в Wan3.0 компания признаёт требующими доработки. Для модели, которую продают как конвертер презентаций в видео, признание неудобное, потому что в презентации текст и есть основное содержание.

    Пока надёжнее готовить титры и озвучку отдельно, а Wan3.0 отдавать только видеоряд.

    Три двери в Wan3.0

    Попробовать Wan3.0 без корпоративного контракта можно тремя путями. Первый — сайт wan.video и его генератор, вход через Google или GitHub. Доступ там пока по членству, с очередью и лимитами, но несколько роликов новичку обычно дают.

    Дальше идут Alibaba Cloud Model Studio и Qwen Cloud. Новым аккаунтам дают стартовую бесплатную квоту, заметнее всего в сингапурском регионе. Взамен нужен аккаунт Alibaba Cloud с верификацией, а консоль рассчитана на разработчика.

    Самый короткий путь — сторонние онлайн-генераторы видео, которые уже подключили Wan3.0. Там она идёт по кредитам, часть сервисов раздаёт стартовый пакет бесплатно. Приём документов появляется у них не сразу, так что PDF и презентации стоит проверить до оплаты.

    Статья превращается в короткий ролик

    Владельцам сайтов и авторам Wan3.0 интересен как дешёвый способ получить видеоверсию текста. Материал отдаётся модели ссылкой, на выходе вертикальный ролик под соцсети. Первые пробы дешевле гонять по 5–10 секунд в 480p. Десять роликов по 15 секунд в 720p — это 150 секунд генерации, около $15.

    Открытые веса остались в Wan2.2

    Репутацию линейке Wan сделали открытые версии. Wan2.1 и Wan2.2 выходили под лицензией Apache 2.0, их можно было скачать и запустить на своём железе, и именно это собрало вокруг модели сообщество энтузиастов. Начиная с Wan2.5 линейка закрылась, и за год смены версий наружу больше ничего не вышло.

    Судить об успехе релиза стоит по тому, появится ли открытая сборка третьего поколения ближе к зиме. Если её не будет, Wan окончательно переезжает в разряд обычных облачных сервисов, где спорят ценой за секунду. По этой цене Wan3.0 пока спорит убедительно.


    Ниже то, что у меня получилось сгенерировать с Wan 3.0 загрузив эту новость текстом 😂



    Источник

    02.09.2026 0 комментариев
    0 VKOdnoklassnikiEmail
  • Новости

    FIA планирует ввести ИИ в Формуле-1 для контроля выезда болидов за пределы трассы

    admin 02.09.2026
    02.09.2026

    Международная автомобильная федерация (FIA) намерена использовать технологии искусственного интеллекта для автоматизации контроля пересечения гоночных болидов «Формулы-1» за пределы разметки. Планируется, …

    0 VKOdnoklassnikiEmail
  • Обзор сервисов

    ChatGPT Images 2.0. Создание картинок с нуля теперь происходит иначе, и это заметно

    admin 02.09.2026
    02.09.2026

    Помните, как год назад весь интернет был завален фотографиями в стиле Studio Ghibli? Это случилось в марте 2025-го, когда OpenAI …

    0 VKOdnoklassnikiEmail
  • Обзор сервисов

    OpenAI представила новые голосовые модели GPT-Live-1 для более естественного общения

    admin 02.09.2026
    02.09.2026

    OpenAI выпустила новые голосовые модели под названием GPT-Live-1 и GPT-Live-1 mini, заявив, что они звучат более естественно и лучше справляются с очередностью …

    0 VKOdnoklassnikiEmail
  • Обзор сервисов

    Как создать видео с эффектом Soul в Higgsfield AI: пошаговое руководство

    admin 02.09.2026
    02.09.2026

    ???? Введение Higgsfield AI — мощная нейросеть для генерации видео с уникальными визуальными эффектами. Один из самых узнаваемых среди них …

    0 VKOdnoklassnikiEmail
  • Новости

    Mac становится ИИ‑платформой Apple: спрос на локальные модели разогнал продажи и привёл к дефициту Mac mini и Studio

    admin 02.09.2026
    02.09.2026

    В свежем квартальном отчёте Apple на первый план вышли продажи iPhone и доходы от сервисов, однако наиболее показательной «тихой» историей …

    0 VKOdnoklassnikiEmail
  • Генерация звука

    ElevenLabs теперь можно подключить к Claude через MCP

    admin 02.09.2026
    02.09.2026

    ElevenLabs представила MCP-сервер для Claude. Он позволяет управлять агентами ElevenLabs из чата в Claude. Коннектор уже появился в каталоге Claude: …

    0 VKOdnoklassnikiEmail
  • Генерация текста

    Alibaba представила Qwen 3.8‑Max на 2,4 трлн параметров — открытые веса выйдут на следующей неделе

    admin 01.09.2026
    01.09.2026

    Alibaba представила Qwen3.8‑Max — новую флагманскую ИИ-модель с 2,4 трлн параметров. Сейчас она доступна в Qwen Studio и через API, …

    0 VKOdnoklassnikiEmail
  • Генерация текста

    OpenAI урезала лимиты ChatGPT и Codex? Что известно

    admin 01.09.2026
    01.09.2026

    Пользователи ChatGPT/Codex с подписками Plus и Pro в последние дни жалуются, что недельный лимит стал расходоваться заметно быстрее. Несколько человек …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Google довела ролики Gemini Omni до сорока секунд и сделала черновики втрое дешевле

    admin 01.09.2026
    01.09.2026

    Gemini Omni 1.1 Flash научилась достраивать снятую сцену продолжениями и доводить ролик до сорока секунд, а перед чистовой генерацией показывать …

    0 VKOdnoklassnikiEmail
Новые
Старые

Свежие записи

  • СМИ требуют санкций против OpenAI за сокрытие доказательств по делу об авторских правах
  • ElevenLabs добавила генерацию речи, музыки, изображений и видео в MCP
  • OpenAI покажет человекоподобного робота в 2027 году
  • Google Bard теперь отвечает в реальном времени и позволяет прервать ответ на полуслове
  • Claude Reflect: Anthropic показывает, насколько ИИ уже встроился в вашу жизнь

Свежие комментарии

Нет комментариев для просмотра.

Новые статьи

  • СМИ требуют санкций против OpenAI за сокрытие доказательств по делу об авторских правах

    16.09.2026
  • ElevenLabs добавила генерацию речи, музыки, изображений и видео в MCP

    16.09.2026
  • OpenAI покажет человекоподобного робота в 2027 году

    15.09.2026
  • Google Bard теперь отвечает в реальном времени и позволяет прервать ответ на полуслове

    15.09.2026
  • Claude Reflect: Anthropic показывает, насколько ИИ уже встроился в вашу жизнь

    15.09.2026
  • Cerebras Systems подала заявку на IPO после крупных сделок с OpenAI и AWS

    15.09.2026

Рубрики

  • Генерация видео (108)
  • Генерация звука (23)
  • Генерация изображений (88)
  • Генерация текста (68)
  • Новости (72)
  • Обзор сервисов (47)

СМИ требуют санкций против OpenAI за сокрытие доказательств...

16.09.2026

ElevenLabs добавила генерацию речи, музыки, изображений и видео...

16.09.2026

OpenAI покажет человекоподобного робота в 2027 году

15.09.2026

Google Bard теперь отвечает в реальном времени и...

15.09.2026

Claude Reflect: Anthropic показывает, насколько ИИ уже встроился...

15.09.2026

Обзоры

  • СМИ требуют санкций против OpenAI за сокрытие доказательств по делу об авторских правах

    16.09.2026
  • Claude Reflect: Anthropic показывает, насколько ИИ уже встроился в вашу жизнь

    15.09.2026
  • OpenAI закрывает браузер Atlas и переносит его ИИ-функции в ChatGPT и Chrome

    14.09.2026

Выбор редакции

  • OpenAI API: как получить API-ключ, как пополнить баланс и оплатить из России

    04.07.2026
  • Tesla запускает свой сервис роботакси в Далласе и Хьюстоне

    14.09.2026
  • Runway выпустила Aleph 2.0: точечное ИИ-редактирование видео по одному кадру

    10.09.2026

Популярное

  • 1

    Wan2.2 научилась рисовать: видеомодель от Krea теперь создаёт впечатляющие изображения по запросу

    24.06.2026
  • 2

    Промты для открытки на 23 февраля: +нейросети для создания открытки

    21.06.2026
  • 3

    Google встроил в Gemini генератор музыки Lyria 3

    21.06.2026
  • Email
  • Vk
  • Rss
  • Yandex

@2026 - innovatepro.ru


Наверх
ИИ для профессионалов
  • Новости
  • Генерация видео
  • Генерация изображений
  • Генерация звука
  • Генерация текста
  • Обзор сервисов