Створення фонетично репрезентативного тексту для української мови
Тип публікації :
Бакалаврська робота
Дата випуску :
6 липня 2026 р.
Автор(и) :
Пласкальна, Анастасія Дмитрівна
бакалавр
Науковий(і) керівник(и)/редактор(и) :
Мова основного тексту :
Ukrainian
eKNUTSHIR URL :
Цитування :
[APA 7] Пласкальна, А. Д. (2026). Створення фонетично репрезентативного тексту для української мови [Бакалаврська робота, Київський національний університет імені Тараса Шевченка]. eKNUTSHIR. https://ir.library.knu.ua/handle/15071834/31291
[ДСТУ] Пласкальна А. Д. Створення фонетично репрезентативного тексту для української мови : кваліфікаційна робота бакалавра : 03 Гуманітарні науки / наук. кер. В. В. Робейко. Київ, 2026. 68 с. URL: https://ir.library.knu.ua/handle/15071834/31291 (дата звернення: 22.08.2026).
У бакалаврській роботі досліджено проблему створення фонетично репрезентативного тексту для української мови. Актуальність роботи зумовлена потребою розвитку сучасних мовних технологій, зокрема систем автоматичного розпізнавання мовлення, синтезу мовлення, створення мовленнєвих корпусів та фонетичних баз даних для української мови. Якість роботи таких систем значною мірою залежить від наявності мовного матеріалу, який забезпечує достатнє представлення фонетичних одиниць та їхніх комбінацій у природному мовленні.
Метою роботи є розроблення фонетично репрезентативного тексту українською мовою на основі статистичного аналізу трифонів. Для досягнення поставленої мети було проаналізовано теоретичні засади фонетичної репрезентативності, особливості використання фонетично збалансованих текстів у мовних технологіях, а також сучасні підходи до створення мовленнєвих корпусів.
Матеріалом дослідження став український переклад твору Льюїса Керролла «Аліса в Країні чудес». Для обробки тексту було розроблено програмний комплекс мовою Python, який здійснює автоматичне транскрибування тексту у фонетичний запис та статистичний аналіз трифонних послідовностей. У результаті було сформовано базу трифонів, визначено їхню частотність та проаналізовано структуру трифонного інвентарю корпусу.
На основі отриманих статистичних даних створено фонетично репрезентативний текст, що містить найважливіші трифонні поєднання української мови. Запропонований текст є зв’язним, граматично коректним і придатним для використання під час запису мовленнєвих корпусів, тестування систем автоматичного розпізнавання мовлення та синтезу мовлення.
Практичне значення роботи полягає у можливості використання розробленого тексту та програмних засобів у фонетичних дослідженнях, мовленнєвих технологіях і подальших роботах зі створення українських мовленнєвих ресурсів.
Метою роботи є розроблення фонетично репрезентативного тексту українською мовою на основі статистичного аналізу трифонів. Для досягнення поставленої мети було проаналізовано теоретичні засади фонетичної репрезентативності, особливості використання фонетично збалансованих текстів у мовних технологіях, а також сучасні підходи до створення мовленнєвих корпусів.
Матеріалом дослідження став український переклад твору Льюїса Керролла «Аліса в Країні чудес». Для обробки тексту було розроблено програмний комплекс мовою Python, який здійснює автоматичне транскрибування тексту у фонетичний запис та статистичний аналіз трифонних послідовностей. У результаті було сформовано базу трифонів, визначено їхню частотність та проаналізовано структуру трифонного інвентарю корпусу.
На основі отриманих статистичних даних створено фонетично репрезентативний текст, що містить найважливіші трифонні поєднання української мови. Запропонований текст є зв’язним, граматично коректним і придатним для використання під час запису мовленнєвих корпусів, тестування систем автоматичного розпізнавання мовлення та синтезу мовлення.
Практичне значення роботи полягає у можливості використання розробленого тексту та програмних засобів у фонетичних дослідженнях, мовленнєвих технологіях і подальших роботах зі створення українських мовленнєвих ресурсів.
Ключові слова :
фонетично репрезентативний текст трифон транскрибування українська мова корпусна лінгвістика автоматичне розпізнавання мовлення синтез мовлення мовленнєвий корпус phonetically representative text triphone phonetic transcription Ukrainian language corpus linguistics automatic speech recognition speech synthesis speech corpus
Галузі знань та спеціальності :
03 Гуманітарні науки
03 Гуманітарні науки::035 Філологія
Галузі науки і техніки (FOS) :
Гуманітарні науки
Мови та література
Лінгвістика
Файл(и) :![Ескіз]()
Вантажиться...
Формат :
Adobe PDF
Розмір :
1.51 MB
Контрольна сума :
(MD5):203d54c99c5b970181e6be9b2b1ef88f
