Рубріки: Новини

Новий безкоштовний інструмент Microsoft створює 90-хвилинні подкасти з тексту

Дмитро Сімагін

Компанія Microsoft представила новий проект з відкритим кодом VibeVoice, який перетворює текст на реалістичну мову і здатний генерувати повноцінні подкасти тривалістю до 90 хвилин. Про це повідомляє Windows Central.

На відміну від звичних рішень на базі Copilot, VibeVoice сфокусований виключно на Text-to-Speech (TTS). Користувач вводить текст, а модель перетворює його на аудіофайл з кількома голосами, імітуючи природну розмову.

Система підтримує до чотирьох різних спікерів і зберігає природні паузи і послідовність мови, що відрізняє її від багатьох традиційних TTS-моделей.

Вже є дві версії: з 1,5 млрд параметрів (генерує до 90 хвилин мови з контекстним вікном 64k) і з 7 млрд параметрів (обмеження до 45 хвилин при контексті 32k, але вища якість). У майбутньому з’явиться полегшена версія на 0,5 млрд параметрів, яка розрахована на генерацію стрімів у реальному часі.

Для локального запуску потрібно від 7 до 18 Гб відеопам’яті GPU, однак протестувати VibeVoice можна і онлайн, скориставшись веб-інтерфейсом. Зараз модель навчена працювати лише англійською та китайською мовами, але в майбутньому розробники планують додати нові мови. Вихідний код проекту можна знайти на GitHub та Hugging Face.

У Microsoft зазначають, що система вміє передавати емоції та підтримує багатоголосся, але поки що слабко справляється зі співом. Надалі планується запровадити клонування голосів. Окрім очевидних застосувань для подкастів та відеороликів, технологія може стати цінним інструментом для освітніх сервісів.

Нагадаємо, що днями Microsoft почала тестувати нову функцію Windows 11, яка дозволяє переносити сеанс роботи з Android-програмою на ПК. Поки ця можливість доступна виключно з додатком Spotify і лише для учасників preview-програм у Dev та Beta Channels.

Останні статті

Штучний інтелект «поглинув» 500 000 вакансій програмістів. Чого чекати далі?

Дослідження економістів Федеральної резервної системи США Ліланда Крейна та Пола Сото свідчить про тектонічні зсуви…

14.04.2026

Українці майже наздогнали американців за показником активного використання штучного інтелекту

Згідно зі свіжим опитуванням Gallup, впровадження штучного інтелекту в США досягло історичного рубежу. Вперше в…

14.04.2026

Чому майбутнє розробки – за low-code: думка та кейси експерта

За даними фахівців у сфері корпоративного управління, IT повільно, але впевнено стає слабким місцем у…

14.04.2026

Rockstar Games відмовилась платити хакерам $200 000: викрадені дані злито в мережу (спойлер: нічого цікавого там немає)

Хакерське угруповання ShinyHunters оприлюднило частину викрадених корпоративних даних Rockstar Games. Це сталося після того, як…

14.04.2026

Microsoft розробляє власного локального агента — альтернативу OpenClaw

Компанія Microsoft продовжує агресивну експансію у сферу автономних ШІ-агентів. Згідно з останніми звітами, технологічний гігант…

14.04.2026

Ліміти запитів до LLM змушують розробників підлаштовувати свій робочий графік

Минув той час, коли співробітники підлаштовували свій день під графік роботи колег або дедлайни. Тепер…

14.04.2026