• Новости
  • Генерация видео
  • Генерация изображений
  • Генерация звука
  • Генерация текста
  • Обзор сервисов
ИИ для профессионалов
Нейросети в бизнесе: автоматизация, аналитика, контент.
Автор

admin

admin

    Новости

    OpenAI расширила Realtime API: новые голосовые модели для диалога, перевода и транскрибации

    admin 01.08.2026


    API OpenAI будет включать ряд новых функций голосового интеллекта, призванных помочь разработчикам создавать приложения, способные разговаривать с пользователями, транскрибировать и переводить разговоры.

    Новый GPT‑Realtime‑2 компании — это ещё одна голосовая модель, созданная для реалистичной вокальной симуляции, которая может вести диалог с пользователями. Однако, в отличие от предшественника (GPT‑Realtime‑1.5), эта модель построена на рассуждениях уровня GPT‑5, которые, по словам OpenAI, были разработаны для работы с более сложными запросами пользователей.

    Компания также запускает GPT‑Realtime‑Translate, который, как и следует из названия, предназначен для предоставления услуг перевода в реальном времени, которые в разговорном режиме «не отстают» от пользователя. Функция включает более 70 входных языков (то есть языков, которые она может понимать) и 13 выходных языков (языков, на которые она передаёт речь говорящему).

    Наконец, компания также запустила новую возможность транскрибации — GPT‑Realtime‑Whisper, которая предоставляет пользователям функцию преобразования речи в текст в реальном времени, фиксируемую по мере происходящих взаимодействий.

    «Вместе модели, которые мы запускаем, переводят аудио в реальном времени от простого обмена репликами к голосовым интерфейсам, которые действительно могут выполнять работу: слушать, рассуждать, переводить, транскрибировать и предпринимать действия по мере развития разговора», — заявили в компании.

    Для кого будут полезны эти обновления? Очевидная целевая аудитория — компании, желающие расширить возможности службы поддержки. Однако OpenAI также отмечает, что её новые функции помогут в широком спектре областей, включая образование, медиа, мероприятия и платформы для создателей контента.

    Насколько бы полезными эти инструменты ни казались с точки зрения корпоративного использования, также представляется вероятным, что ими могут злоупотреблять. Компания заявила, что внедрила защитные механизмы, чтобы не допустить использования новых функций для создания спама, мошенничества или других форм онлайн-злоупотреблений. В систему встроены определённые триггеры, чтобы «разговоры могли быть остановлены, если будет обнаружено, что они нарушают наши правила в отношении вредоносного контента», — сообщила OpenAI.

    Все новые голосовые модели включены в Realtime API OpenAI. Translate и Whisper тарифицируются поминутно, тогда как GPT‑Realtime‑2 — по потреблению токенов.

    Источник: TechCrunch



    Источник

    01.08.2026 0 комментариев
    0 VKOdnoklassnikiEmail
  • Обзор сервисов

    Промокоды для Higgsfield AI — как получить и активировать

    admin 01.08.2026
    01.08.2026

    Higgsfield AI стремительно набирает популярность среди креаторов, блогеров и маркетологов. Но несмотря на удобство и качество, у многих пользователей возникает …

    0 VKOdnoklassnikiEmail
  • Обзор сервисов

    Топ-10 видео, созданных с помощью Higgsfield AI

    admin 01.08.2026
    01.08.2026

    ???? Лучшие примеры видео, созданных с помощью Higgsfield AI Higgsfield AI покорила мир коротких видео своими мощными эффектами и уникальными …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Революционная платформа KLING AI для генерации видео теперь доступна каждому

    admin 01.08.2026
    01.08.2026

    Китайская платформа KLING AI, которая нашумела благодаря своим выдающимся возможностям генерации видео, теперь открыта для всех без необходимости телефонной верификации. …

    0 VKOdnoklassnikiEmail
  • Новости

    Искусственный интеллект получил правила игры в российской медицине

    admin 01.08.2026
    01.08.2026

    ​В России вступил в силу новый ГОСТ, регламентирующий применение технологий искусственного интеллекта в сфере здравоохранения. Стандарт был разработан при участии …

    0 VKOdnoklassnikiEmail
  • Генерация изображений

    Alibaba выпустила Qwen-Image-3.0 без весов и бенчмарков, но с промптами на 4500 токенов

    admin 31.07.2026
    31.07.2026

    Alibaba выпустила Qwen-Image-3.0 — третье поколение генератора изображений с прицелом на практическую пользу: длинные детальные подписи, читаемый мелкий текст, сборка …

    0 VKOdnoklassnikiEmail
  • Новости

    Нейросеть будет «следить» за мусорными полигонами России

    admin 31.07.2026
    31.07.2026

    РЭО анонсировал создание нейросети для мониторинга мусорных полигонов России. Система, запуск которой ожидается в 2024 году, будет выявлять различные нарушения …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Adobe запустила Firefly Video Model – генератор AI-видео с общим доступом

    admin 30.07.2026
    30.07.2026

    Firefly Video Model теперь могут протестировать все желающие. Этот инструмент позволяет создавать 5-секундные видеоролики в 1080p на основе текстовых описаний …

    0 VKOdnoklassnikiEmail
  • Новости

    Казахстанские университеты вводят курсы по искусственному интеллекту в партнерстве с Google

    admin 30.07.2026
    30.07.2026

    ВУЗы Казахстана в сотрудничестве с Google запускают пилотный проект по обучению искусственному интеллекту. Министр науки страны подчеркивает важность подготовки студентов …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Google Veo 2 дебютировал на Freepik: новая эра в создании видео с помощью ИИ

    admin 29.07.2026
    29.07.2026

    Платформа Freepik первой в мире внедрила Google Veo 2 — новую модель генерации видео от Google DeepMind. Интеграция этой технологии …

    0 VKOdnoklassnikiEmail
Новые
Старые

Свежие записи

  • СМИ требуют санкций против OpenAI за сокрытие доказательств по делу об авторских правах
  • ElevenLabs добавила генерацию речи, музыки, изображений и видео в MCP
  • OpenAI покажет человекоподобного робота в 2027 году
  • Google Bard теперь отвечает в реальном времени и позволяет прервать ответ на полуслове
  • Claude Reflect: Anthropic показывает, насколько ИИ уже встроился в вашу жизнь

Свежие комментарии

Нет комментариев для просмотра.

Новые статьи

  • СМИ требуют санкций против OpenAI за сокрытие доказательств по делу об авторских правах

    16.09.2026
  • ElevenLabs добавила генерацию речи, музыки, изображений и видео в MCP

    16.09.2026
  • OpenAI покажет человекоподобного робота в 2027 году

    15.09.2026
  • Google Bard теперь отвечает в реальном времени и позволяет прервать ответ на полуслове

    15.09.2026
  • Claude Reflect: Anthropic показывает, насколько ИИ уже встроился в вашу жизнь

    15.09.2026
  • Cerebras Systems подала заявку на IPO после крупных сделок с OpenAI и AWS

    15.09.2026

Рубрики

  • Генерация видео (108)
  • Генерация звука (23)
  • Генерация изображений (88)
  • Генерация текста (68)
  • Новости (72)
  • Обзор сервисов (47)

СМИ требуют санкций против OpenAI за сокрытие доказательств...

16.09.2026

ElevenLabs добавила генерацию речи, музыки, изображений и видео...

16.09.2026

OpenAI покажет человекоподобного робота в 2027 году

15.09.2026

Google Bard теперь отвечает в реальном времени и...

15.09.2026

Claude Reflect: Anthropic показывает, насколько ИИ уже встроился...

15.09.2026

Обзоры

  • СМИ требуют санкций против OpenAI за сокрытие доказательств по делу об авторских правах

    16.09.2026
  • Claude Reflect: Anthropic показывает, насколько ИИ уже встроился в вашу жизнь

    15.09.2026
  • OpenAI закрывает браузер Atlas и переносит его ИИ-функции в ChatGPT и Chrome

    14.09.2026

Выбор редакции

  • ElevenLabs запустила Studio 3.0 — это полноценный ИИ-редактор для видео

    23.06.2026
  • Stable Audio 3.0. На что способна новая музыкальная ИИ-модель Stability AI

    01.08.2026
  • Банки Беларуси интегрируют искусственный интеллект для борьбы с мошенничеством

    27.07.2026

Популярное

  • 1

    Wan2.2 научилась рисовать: видеомодель от Krea теперь создаёт впечатляющие изображения по запросу

    24.06.2026
  • 2

    Промты для открытки на 23 февраля: +нейросети для создания открытки

    21.06.2026
  • 3

    Google встроил в Gemini генератор музыки Lyria 3

    21.06.2026
  • Email
  • Vk
  • Rss
  • Yandex

@2026 - innovatepro.ru


Наверх
ИИ для профессионалов
  • Новости
  • Генерация видео
  • Генерация изображений
  • Генерация звука
  • Генерация текста
  • Обзор сервисов