Рубріки: Новини

Новий безкоштовний інструмент Microsoft створює 90-хвилинні подкасти з тексту

Дмитро Сімагін

Компанія Microsoft представила новий проект з відкритим кодом VibeVoice, який перетворює текст на реалістичну мову і здатний генерувати повноцінні подкасти тривалістю до 90 хвилин. Про це повідомляє Windows Central.

На відміну від звичних рішень на базі Copilot, VibeVoice сфокусований виключно на Text-to-Speech (TTS). Користувач вводить текст, а модель перетворює його на аудіофайл з кількома голосами, імітуючи природну розмову.

Система підтримує до чотирьох різних спікерів і зберігає природні паузи і послідовність мови, що відрізняє її від багатьох традиційних TTS-моделей.

Вже є дві версії: з 1,5 млрд параметрів (генерує до 90 хвилин мови з контекстним вікном 64k) і з 7 млрд параметрів (обмеження до 45 хвилин при контексті 32k, але вища якість). У майбутньому з’явиться полегшена версія на 0,5 млрд параметрів, яка розрахована на генерацію стрімів у реальному часі.

Для локального запуску потрібно від 7 до 18 Гб відеопам’яті GPU, однак протестувати VibeVoice можна і онлайн, скориставшись веб-інтерфейсом. Зараз модель навчена працювати лише англійською та китайською мовами, але в майбутньому розробники планують додати нові мови. Вихідний код проекту можна знайти на GitHub та Hugging Face.

У Microsoft зазначають, що система вміє передавати емоції та підтримує багатоголосся, але поки що слабко справляється зі співом. Надалі планується запровадити клонування голосів. Окрім очевидних застосувань для подкастів та відеороликів, технологія може стати цінним інструментом для освітніх сервісів.

Нагадаємо, що днями Microsoft почала тестувати нову функцію Windows 11, яка дозволяє переносити сеанс роботи з Android-програмою на ПК. Поки ця можливість доступна виключно з додатком Spotify і лише для учасників preview-програм у Dev та Beta Channels.

Останні статті

Чому сертифікована платформа швидше масштабується: технічний погляд та досвід команди SharksCode

Коли говорять про масштабування ІТ-продукту, зазвичай мають на увазі збільшення обсягу інфраструктури, щоб витримати більше…

27.02.2026

Китай розповсюджує теорію змови про «криптовалютну гегемонію» США

Китайський Національний центр реагування на комп’ютерні віруси (CVERC) оприлюднив звіт під гучною назвою «Top Player».…

27.02.2026

Григорович повернувся: найвідоміший український гейм-розробник анонсував новий проект S.T.R.A.N.G.E.R

Засновник відомої української геймдев-студії GSC Game World Сергій Григорович активно працює над новим проектом у…

27.02.2026

Microsoft теж виходить на ринок агентів. Зустрічайте Copilot Tasks

Microsoft анонсувала бета-версію нового інструмента штучного інтелекту під назвою Copilot Tasks. За словами компанії, він…

27.02.2026

Магія інновацій: як перетворити щоденний догляд на справжнє мистецтво за допомогою смарт-девайсів

Весна 2026 року диктує нові правила турботи про себе, де технології стають не просто зручним…

27.02.2026

«Claude cпочатку відмовлявся та заперечував»: хакер змусив LLM стати його спільником у нападі на уряд Мексики

Невідомий хакер використав модель штучного інтелекту Claude для серії атак на державні установи Мексики. За…

27.02.2026