• Новости
  • Генерация видео
  • Генерация изображений
  • Генерация звука
  • Генерация текста
  • Обзор сервисов
AITopGuide
Новости нейросетей и полезная информация об ИИ
Автор

admin

    Генерация текста

    Qwen выпустила Qwen-Audio-3.0-TTS — ИИ-модели для озвучки текста и клонирования голоса

    admin 20.07.2026


    Alibaba представила линейку моделей Qwen-Audio-3.0-TTS для синтеза речи. В неё вошли Flash — для озвучки с минимальной задержкой и Plus — с упором на качество генерации.

    Модели доступны через API Alibaba Cloud Model Studio в регионах Сингапур и Китай (Пекин). Flash стоит $0,15, а Plus — $0,20 за 10 тысяч входных символов. Подробности в материале Postium.

    Что умеет нейросеть Qwen-Audio-3.0-TTS

    Модели поддерживают 16 языков, включая русский, английский, китайский, японский, корейский, немецкий, французский, итальянский, португальский, тайский, индонезийский, малайский и вьетнамский.

    Стиль речи можно задать обычным текстом: например, попросить модель говорить медленнее, эмоциональнее, шёпотом или в манере диктора. В текст также можно добавлять теги для эмоций и звуковых действий: смеха, вздоха, кашля, шёпота или пения.

    Клонирование голоса доступно в версии Flash. Для этого нужно загрузить аудиозапись, создать голос через API, а затем указать его идентификатор при генерации. По данным Qwen, новая версия лучше работает с неидеальными записями.

    Как подключить Qwen-Audio-3.0-TTS

    Для работы потребуется API-ключ Alibaba Cloud Model Studio. В запросе нужно указать модель qwen-audio-3.0-tts-flash или qwen-audio-3.0-tts-plus, а также выбрать голос и передать текст для озвучки.

    Модели поддерживают потоковую генерацию аудио через WebSocket. Сейчас API работает только в однонаправленном потоковом режиме.

    Почему это важно? Днём ранее Qwen представила Qwen 3.8 Max Preview — новую языковую модель. Теперь компания выпустила отдельные модели для синтеза речи. Это позволит использовать Qwen в голосовых ассистентах, сервисах озвучки контента и приложениях с клонированием голоса без подключения отдельного TTS-сервиса.

    Итог: В Alibaba Cloud Model Studio появились две ИИ-модели для многоязычной озвучки — Qwen-Audio-3.0-TTS.



    Источник

    20.07.2026 0 комментариев
    0 VKOdnoklassnikiEmail
  • Генерация изображений

    Ideogram выпустила Ideogram 4.0 с открытыми весами и управлением макетом через JSON

    admin 20.07.2026
    20.07.2026

    Ideogram представила версию 4.0 — новую text-to-image модель с открытыми весами для генерации изображений, дизайна и типографики. Компания называет её …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Higgsfield AI представила 10 кинематографических эффектов для видео

    admin 20.07.2026
    20.07.2026

    Higgsfield AI представила новый пакет визуальных эффектов Higgsfield Effects с 10 кинематографическими инструментами, которые упрощают создание профессиональных видео. Новые возможности, …

    0 VKOdnoklassnikiEmail
  • Новости

    UnitQ представляет нового помощника на базе ИИ для анализа отзывов клиентов

    admin 20.07.2026
    20.07.2026

    Стартап UnitQ запускает нового чат-бота, который помогает компаниям анализировать отзывы клиентов из разных источников, делая аналитику доступной каждому сотруднику. Содержание …

    0 VKOdnoklassnikiEmail
  • Обзор сервисов

    Как получить промокоды для Higgsfield AI: все способы и советы

    admin 20.07.2026
    20.07.2026

    ???? Введение Многие пользователи интересуются, как получить промокод для Higgsfield AI, чтобы использовать сервис бесплатно или со скидкой. В этой …

    0 VKOdnoklassnikiEmail
  • Генерация изображений

    Comfy MCP: ComfyUI подключает ИИ-агентов к своим пайплайнам генерации

    admin 19.07.2026
    19.07.2026

    Команда ComfyUI открыла публичную бету Comfy MCP — коннектор, через который ИИ-агенты вроде Claude, Codex, Cursor и Hermes управляют пайплайнами …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Lightricks анонсировала LTXV-13B: новую эру в генерации видео

    admin 19.07.2026
    19.07.2026

    LTXV-13B — передовая открытая модель для генерации видео с 13 миллиардами параметров, обеспечивающую высокое качество и доступность. Эта разработка обещает …

    0 VKOdnoklassnikiEmail
  • Генерация изображений

    Промт для Nano Banana: Киношный 3D-дизайн авто с детализацией

    admin 19.07.2026
    19.07.2026

    Этот промт для Nano Banana позволяет генерировать фотореалистичные изображения автомобилей с кинематографической эстетикой. Он идеален для визуализации концептов, создания рекламных …

    0 VKOdnoklassnikiEmail
  • Обзор сервисов

    Как Higgsfield AI создаёт эффект «Bullet Time»: разбор технологии

    admin 19.07.2026
    19.07.2026

    Higgsfield AI — одна из немногих нейросетей, способных воссоздавать эффект «bullet time», хорошо известный по фильмам вроде Матрицы. В этой …

    0 VKOdnoklassnikiEmail
  • Генерация изображений

    Google выпустила Nano Banana 2 Lite и Gemini Omni Flash

    admin 18.07.2026
    18.07.2026

    30 июня Google открыла доступ к двум новым моделям генеративной графики и видео — Nano Banana 2 Lite и Gemini …

    0 VKOdnoklassnikiEmail
Новые
Старые

Свежие записи

  • 20 промтов для осенней ИИ-фотосессии в нейросетях
  • ElevenLabs добавила генерацию речи, музыки, изображений и видео в MCP
  • OpenAI покажет человекоподобного робота в 2027 году
  • ElevenLabs выпустила Music v2.5 с улучшенным звуком и точным следованием запросу
  • Думейт: от отчета к инструментам доработки

Свежие комментарии

Нет комментариев для просмотра.

Новые статьи

  • 20 промтов для осенней ИИ-фотосессии в нейросетях

    17.09.2026
  • ElevenLabs добавила генерацию речи, музыки, изображений и видео в MCP

    15.09.2026
  • OpenAI покажет человекоподобного робота в 2027 году

    14.09.2026
  • ElevenLabs выпустила Music v2.5 с улучшенным звуком и точным следованием запросу

    13.09.2026
  • Думейт: от отчета к инструментам доработки

    12.09.2026
  • Universal Music и ElevenLabs запустят музыкальную ИИ-платформу

    11.09.2026

Рубрики

  • Генерация видео (113)
  • Генерация звука (23)
  • Генерация изображений (89)
  • Генерация текста (68)
  • Новости (79)
  • Обзор сервисов (36)

20 промтов для осенней ИИ-фотосессии в нейросетях

17.09.2026

ElevenLabs добавила генерацию речи, музыки, изображений и видео...

15.09.2026

OpenAI покажет человекоподобного робота в 2027 году

14.09.2026

ElevenLabs выпустила Music v2.5 с улучшенным звуком и...

13.09.2026

Думейт: от отчета к инструментам доработки

12.09.2026

Обзоры

  • Higgsfield AI: Революция в создании видео с искусственным интеллектом

    30.07.2026
  • Как создать видео с эффектом Soul в Higgsfield AI: пошаговое руководство

    29.07.2026
  • Как оплатить Higgsfield AI и какие есть тарифы: подробный гайд

    28.07.2026

Выбор редакции

  • Qwen представила Qwen3.7-Max — модель для ИИ-агентов, написания кода и автоматизации

    02.07.2026
  • Kling 2.0 открывает новую главу в генерации визуального контента

    24.07.2026
  • Видео-мем «Возьми телефон, детка» (Toxi$): что это за тренд и как повторить его с помощью ИИ

    03.07.2026

Популярное

  • 1

    Промты для открытки на 23 февраля: +нейросети для создания открытки

    21.06.2026
  • 2

    Wan2.2 научилась рисовать: видеомодель от Krea теперь создаёт впечатляющие изображения по запросу

    24.06.2026
  • 3

    Higgsfield AI create video: создание видео с нуля

    21.06.2026
  • Pinterest
  • Youtube
  • Email
  • Vk
  • Rss
  • Yandex

@2026- All Right Reserved.


Наверх
AITopGuide
  • Новости
  • Генерация видео
  • Генерация изображений
  • Генерация звука
  • Генерация текста
  • Обзор сервисов