Репозитарій КНУ
Увійти(current)
  1. Головна
  2. Кваліфікаційні роботи | Qualifying works
  3. Бакалаврські роботи | Bachelor theses
  4. Автоматичне визначення сарказму в українськомовних текстах

Автоматичне визначення сарказму в українськомовних текстах

Тип публікації :
Бакалаврська робота
Дата випуску :
2024
Автор(и) :
Ботвин Сніжанна Іванівна
Науковий(і) керівник(и)/редактор(и) :
Робейко Валентина Василівна
Мова основного тексту :
ua
eKNUTSHIR URL :
https://ir.library.knu.ua/handle/15071834/2874
Цитування :
[APA 7] Ботвин, С. І. (2024). Автоматичне визначення сарказму в українськомовних текстах [Бакалаврська робота, Київський національний університет імені Тараса Шевченка]. eKNUTSHIR. https://ir.library.knu.ua/handle/15071834/2874
[ДСТУ] Ботвин С. І. Автоматичне визначення сарказму в українськомовних текстах : кваліфікаційна робота бакалавра : 03 Гуманітарні науки / наук. кер. В. В. Робейко. Київ, 2024. 77 с. URL: https://ir.library.knu.ua/handle/15071834/2874 (дата звернення: 25.07.2026).
Кваліфікаційна робота спрямована на дослідження теми автоматичної класифікації українськомовних текстів на саркастичні або несаркастичні. Актуальність теми зумовлена відсутністю розробок для автоматичного виявлення сарказму саме в текстах, написаних українською мовою. Кінцева мета даного дослідження — запропонувати рішення для класифікації українськомовних текстів на такі, що містять сарказм, або ж ні. Об’єктом дослідження є українськомовні тексти. Предмет дослідження — лінгвістичні прояви сарказму в обраних текстах та способи їх автоматичної ідентифікації.
У першому розділі вказано такі відмінності сарказму від гумору, іронії, сатири: недоброзичливість, агресивність, наявність конкретної цілі, відсутність наміру викликати зміни в суспільстві. Розглянуто підходи для завдання автоматичної ідентифікації сарказму в текстах, а саме: правила, традиційне машинне навчання та глибоке. Визначено, що для такої бінарної класифікації тексту використовуються короткі та довгі тексти з можливим додаванням контексту різного типу. Також описано проблематику сарказму з боку автора та читача; вказано причини, чому сарказм важко визначити в тексті. До того ж проілюстровано основні ознаки сарказму на прикладі українськомовних текстів: гіперболу, пунктуаційні знаки, прагматичні ознаки (емотикони, емоджі, написання слова великими літерами), невідповідність, пародіювання російської вимови.
У другому розділі описано створення навчальної вибірки для завдання автоматичної ідентифікації саркастичного тексту. Також створено синтетичні саркастичні текстові дані та зроблено їх порівняння зі справжніми саркастичними даними. Проведено експерименти з моделями машинного навчання, включно з коригуванням гіперпараметрів та додаванням синтетичних даних. Запропоновано та опубліковано у вільному доступі систему, яка приймає текст від користувача та подає мітку для вказаного повідомлення — сарказм / не сарказм.
Ключові слова :
сарказм автоматичне виявлення сарказму машинне навчання класифікація текстів синтетичні дані sarcasm automatic sarcasm detection machine learning text classification synthetic data
Галузі знань та спеціальності :
03 Гуманітарні науки
03 Гуманітарні науки::035 Філологія
Галузі науки і техніки (FOS) :
Мови та література
Файл(и) :
Вантажиться...
Ескіз
Завантажити
Формат :

Adobe PDF

Розмір :

923.51 KB

Контрольна сума :

(MD5):3a6be31ee9034b8224b949aec622b9a0

Creative Commons Attribution-NonCommercial 4.0 International
Якщо не вказано інше, ця робота розповсюджується на умовах ліцензії Creative Commons Attribution-NonCommercial 4.0 International
Контакти
  • ir.library@knu.ua
  • (044) 239-33-30
  • м. Київ, вул. Володимирська, 58, к. 42

Побудовано за допомогою Програмне забезпечення DSpace-CRIS - Розширення підтримується та оптимізується 4Наука

  • Доступність
  • Політика приватності
  • Угода користувача
  • Надіслати відгук