Клонирование голоса в 2026 году перестало быть магией и стало
4 июня 2026 г. · 1 мин чтения · Максим Космов

Клонирование голоса в 2026 году перестало быть магией и стало обычным инструментом. Разрыв между гигантом ElevenLabs и открытыми решениями вроде XTTS стал минимальным. На динамиках телефона средний слушатель путает синтез с живым человеком в 8 случаях из 10. Роботизированное звучание ушло в прошлое, теперь алгоритмы копируют даже дыхание и случайные паузы.
С ценами всё забавно. Премиум сегмент от ElevenLabs обходится примерно в 15 долларов за час аудио. Более быстрые модели стоят около 5 долларов. Но если развернуть XTTS на своем сервере, цена падает до смешных величин. Около 50 центов за час чистого времени. Для Telegram-каналов это находка. Больше не нужно перезаписывать сообщение двадцать раз из-за лифта во дворе или пролетающего самолета.
Главное не угореть с юридической частью. Правила игры изменились. Простого договора с диктором уже мало. Площадки требуют прямого согласия на клонирование. Если использовать чужой тембр без нотариальной бумажки, пост или ролик живут всего пару часов. Авторское право на манеру речи теперь отдельный актив
Читайте дальше
Налоговая, которая сама себя чинит (и не просит денег)
OpenAI, Thrive и Crete собрали налогового агента на Codex. Звучит как очередной стартап с презентацией «уберём бухгалтеров», но тут интереснее
Amazon Bedrock Ops Alert: первый прогон
Вдохновились заявкой Amazon о "трёх-слойном" решении для автоматического мониторинга. Ожидали, что система сама будет ловить сбои, поднимать сигналы и даже формировать поддерж-кейсы без лишних шумов
AWS Fundamental NEXUS: табличная модель в SageMaker JumpStart
Сразу бросается в глаза, что процесс деплоя сведён к нескольким кликам, а SageMaker берёт на себя всё, от подготовки окружения до масштабирования. Для тех, кто пока «путает» модели и инфраструктуру, э...