Автоматичне транскрибування та ідентифікація у змішаному українсько-англійському мовленні

dc.contributor.advisorІгнатенко, Олексійuk_UA
dc.contributor.authorНікітін, Руслан uk_UA
dc.date.accessioned2026-08-27T09:26:43Z
dc.date.available2026-08-27T09:26:43Z
dc.date.issued2026
dc.description.abstractМагістерська робота присвячена оцінюванню та порівнянню сучасних архітектур автоматичного розпізнавання мовлення на задачі транскрибування змішаного українсько-англійського мовлення. Досліджено особливості роботи локальних Encoder-Decoder моделей, комерційних API-сервісів та мультимодальних великих мовних моделей, а також методи ізольованого оцінювання помилок (метрика CS-WER) і зворотної текстової нормалізації. Розроблено спеціалізований еталонний корпус uk-en-code-mixed-asr-2h з параметрами: 448 аудіозаписів загальною тривалістю понад 2 години, ІТ-домен, 99,6 % внутрішньореченнєвого перемикання кодів. Реалізовано настільний застосунок для транскрибування повного циклу, який об'єднує підсистеми детектування активності мовлення із двопороговим гістерезисом, розпізнавання тексту та діаризації з міжсесійною ідентифікацією мовців на основі векторів ECAPA-TDNN. Експериментальне порівняння 49 конфігурацій моделей показало такі результати (загальний WER після ITN-нормалізації): найкраща мультимодальна Audio-LLM Gemini 3.1 Pro – 0,105, найкращий комерційний API ElevenLabs Scribe v2 – 0,134, найкраща локальна модель Whisper large-v3-turbo – 0,167. Встановлено, що показник помилок на англійських термінах системно перевищує помилки на українських словах у 3-10 разів. Застосування алгоритму ITN знизило кількість помилок на англіцизмах у середньому на 13 %, що доводить орфографічну, а не акустичну природу збоїв (кирилична транслітерація термінів). Дослідження моделей наскрізного перекладу виявило неспроможність традиційних архітектур коректно обробляти ІТ-сленг через дослівне калькування. Натомість мультимодальні Audio-LLM продемонстрували високу ефективність у семантичній адаптації українського професійного жаргону в технічну англійську мову, що робить переклад життєздатною альтернативою транскрибуванню з ITN.uk_UA
dc.identifier.urihttps://ekmair.ukma.edu.ua/handle/123456789/40997
dc.language.isoukuk_UA
dc.statusfirst publisheduk_UA
dc.subjectавтоматичне розпізнавання мовленняuk_UA
dc.subjectASRen_US
dc.subjectcode-switchingen_US
dc.subjectзмішане українсько-англійське мовленняuk_UA
dc.subjectCS-WERen_US
dc.subjectзворотна текстова нормалізація (ITN)uk_UA
dc.subjectдіаризаціяuk_UA
dc.subjectідентифікація мовцяuk_UA
dc.subjectмагістерська роботаuk_UA
dc.titleАвтоматичне транскрибування та ідентифікація у змішаному українсько-англійському мовленніuk_UA
dc.typeOtheruk_UA
Files
Original bundle
Now showing 1 - 2 of 2
Loading...
Thumbnail Image
Name:
Nikitin_Mahisterska_robota_1.pdf
Size:
231.1 KB
Format:
Adobe Portable Document Format
Loading...
Thumbnail Image
Name:
Nikitin_Mahisterska_robota.pdf
Size:
962.61 KB
Format:
Adobe Portable Document Format
License bundle
Now showing 1 - 1 of 1
No Thumbnail Available
Name:
license.txt
Size:
1.71 KB
Format:
Item-specific license agreed upon to submission
Description: