alicloud-ai-audio-tts-realtime — Преобразование текста в речь в реальном времени
Решение задачи создания высокопроизводительных голосовых приложений стало проще благодаря alicloud-ai-audio-tts-realtime. Этот репозиторий предоставляет архивные версии моделей преобразования текста в речь (TTS) в реальном времени, основанных на серии Qwen от Alibaba Cloud, обеспечивая минимальную задержку при потоковой передаче речи. Использование искусственного интеллекта позволяет создавать интерактивные и отзывчивые голосовые интерфейсы.
Модуль включает в себя большую языковую модель и предоставляет нормализованный интерфейс (tts.realtime) для запросов TTS, а также скрипт проверки совместимости. Поддерживаются модели, такие как qwen3-tts-flash-realtime и qwen3-tts-vd-realtime-2026-01-15, оптимизированные для работы в реальном времени с использованием WebSockets и DashScope SDK.
Внедрение AI-агента на базе Qwen TTS Models позволяет легко интегрировать функциональность преобразования текста в речь в ваши приложения. Для работы требуется установка SDK и настройка ключа API DashScope. Предоставленные модели обеспечивают низкую задержку и высокую производительность, что идеально подходит для приложений, требующих мгновенной голосовой обратной связи.
$ ls -R related_skills/
alicloud-ai-entry-modelstudio — Централизованный шлюз для AI-сервисов Alibaba Cloud
discover-infra: Скилл для автоматического анализа инфраструктуры
terraform-skill: Скилл для автоматизации инфраструктуры
edge-router — Интеллектуальная маршрутизация задач для экономии ресурсов
npx skills add https://github.com/openclaw/skills/tree/main/skills/cinience/alicloud-ai-audio-tts-realtime
[HINT] Скачивает всю директорию скилла с GitHub: SKILL.md и все связанные файлы