Рубріки: Новини

Новий безкоштовний інструмент Microsoft створює 90-хвилинні подкасти з тексту

Дмитро Сімагін

Компанія Microsoft представила новий проект з відкритим кодом VibeVoice, який перетворює текст на реалістичну мову і здатний генерувати повноцінні подкасти тривалістю до 90 хвилин. Про це повідомляє Windows Central.

На відміну від звичних рішень на базі Copilot, VibeVoice сфокусований виключно на Text-to-Speech (TTS). Користувач вводить текст, а модель перетворює його на аудіофайл з кількома голосами, імітуючи природну розмову.

Система підтримує до чотирьох різних спікерів і зберігає природні паузи і послідовність мови, що відрізняє її від багатьох традиційних TTS-моделей.

Вже є дві версії: з 1,5 млрд параметрів (генерує до 90 хвилин мови з контекстним вікном 64k) і з 7 млрд параметрів (обмеження до 45 хвилин при контексті 32k, але вища якість). У майбутньому з’явиться полегшена версія на 0,5 млрд параметрів, яка розрахована на генерацію стрімів у реальному часі.

Для локального запуску потрібно від 7 до 18 Гб відеопам’яті GPU, однак протестувати VibeVoice можна і онлайн, скориставшись веб-інтерфейсом. Зараз модель навчена працювати лише англійською та китайською мовами, але в майбутньому розробники планують додати нові мови. Вихідний код проекту можна знайти на GitHub та Hugging Face.

У Microsoft зазначають, що система вміє передавати емоції та підтримує багатоголосся, але поки що слабко справляється зі співом. Надалі планується запровадити клонування голосів. Окрім очевидних застосувань для подкастів та відеороликів, технологія може стати цінним інструментом для освітніх сервісів.

Нагадаємо, що днями Microsoft почала тестувати нову функцію Windows 11, яка дозволяє переносити сеанс роботи з Android-програмою на ПК. Поки ця можливість доступна виключно з додатком Spotify і лише для учасників preview-програм у Dev та Beta Channels.

Останні статті

У КПІ будуть викладати «Програмування комп’ютерних ігор» за підтримки GSC Game World

Київський політехнічний інститут (КПІ) та найвідоміша українська геймдев-студія GSC Game World, розробник гри S.T.A.L.K.E.R. 2:…

28.11.2025

Хакери модифікували GPT для розробки шкідливих скриптів та проведення фішингових атак

Дослідники Unit42 з Palo Alto Networks проаналізували дві кастомні LLM-моделі, створені на базі GPT: WormGPT…

28.11.2025

Команда мови програмування Zig відмовляється від GitHub на користь Codeberg

Репозиторій мови Zig мігрує з GitHub до Codeberg, некомерційної компанії з хостингу Git, яка базується…

28.11.2025

Google обмежує безкоштовний доступ до Gemini 3 Pro через «високий попит»

Google запроваджує обмеження для безкоштовних користувачів на доступ до LLM-моделі Gemini 3 Pro та генератора…

28.11.2025

Українським IT-фахівцям треба готуватись до збільшення податків: уряд погодився на умови МВФ

Кабінет міністрів України погодився з пропозицією скасувати податкові пільги в обмін на новий пакет фінансування…

28.11.2025

Microsoft працює над новим способом оновлення програм із Microsoft Store

Останні preview-збірки Windows 11 демонструють, що Microsoft готує новий спосіб оновлення програм з каталогу Microsoft…

27.11.2025