alicloud-ai-audio-tts-voice-clone — Клонирование голоса из аудиозаписей с AI
Решение для создания реалистичных голосовых копий на основе существующих аудиозаписей. Используя искусственный интеллект и возможности платформы DashScope, данный модуль предоставляет доступ к архивированным моделям клонирования голоса, позволяя воспроизвести тембр речи из предоставленных образцов. Это достигается благодаря интеграции с большой языковой моделью и упрощает процесс создания персонализированных голосовых решений.
Модуль включает в себя набор Voice Cloning Models, стандартизированный Normalized TTS Interface и локальный вспомогательный скрипт для удобной работы. Для работы требуется установка SDK DashScope в виртуальной среде (Virtualenv) и наличие ключа API. Поддерживаемые модели: qwen3-tts-vc-2026-01-22 и qwen3-tts-vc-realtime-2026-01-15. При работе с AI-агентом важно использовать чистые аудиозаписи с минимальным уровнем шума.
Функциональность позволяет генерировать аудио на основе текстовых запросов, используя клонированный голос. Входные параметры включают текст, голосовой образец и, опционально, имя голоса и режим потоковой передачи. Выходные данные содержат URL аудио, идентификатор голоса и идентификатор запроса. Необходимо соблюдать требования конфиденциальности и политики при клонировании голосов.
$ ls -R related_skills/
docx — Автоматизация создания и обработки документов .docx
alibabacloud-emr-starrocks-manage: Скилл управления StarRocks
azure-ai-translation-ts — TypeScript клиент для сервиса Azure Translation
deploy-model: Скилл для умного деплоя моделей OpenAI
npx skills add https://github.com/openclaw/skills/tree/main/skills/cinience/alicloud-ai-audio-tts-voice-clone
[HINT] Скачивает всю директорию скилла с GitHub: SKILL.md и все связанные файлы