TILSHUNOSLIK TADQIQOTLARIDA KORPUS TEXNOLOGIYALARI VA SUN’IY INTELLEKT: RAQAMLI FILOLOGIK TAHLIL MEZONLARI
CORPUS TECHNOLOGIES AND ARTIFICIAL INTELLIGENCE IN LINGUISTIC STUDIES: PRINCIPLES AND CRITERIA OF DIGITAL PHILOLOGICAL ANALYSIS
Mazkur maqolada tilshunoslik tadqiqotlarida axborot texnologiyalari, korpus metodologiyasi, tabiiy tilni qayta ishlash, elektron lug‘atchilik, avtomatik tarjima, nutqni tanish va sun’iy intellekt asosidagi matn tahlilining ilmiy qiymati yoritiladi. Tadqiqotda 180 ta ilmiy-uslubiy manba va raqamli platforma tavsifidan tuzilgan 42 600 tokenli tahliliy korpus asosida raqamli vositalarning filologik izlanishlardagi qo‘llanish ko‘lami baholandi. Natijalarga ko‘ra, korpus qidiruvi 24.7%, morfologik tahlil 17.3%, semantik teglash 14.9%, avtomatik tarjima 13.5%, avtoreferat chiqarish 9.6%, nutq/OCR vositalari 8.2% va savol-javob tizimlari 5.4% ulush bilan qayd etildi.
The article examines information technologies, corpus methodology, natural language processing, electronic lexicography, machine translation, speech recognition, and AI-based text analysis in contemporary linguistic research. The study relies on an analytical corpus of 42,600 tokens compiled from 180 scholarly-methodological sources and digital platform descriptions. The findings show that corpus search accounts for 24.7%, morphological parsing for 17.3%, semantic tagging for 14.9%, machine translation for 13.5%, automatic summarizing for 9.6%, speech/OCR instruments for 8.2%, and question-answering systems for 5.4%.
Keywords: computational linguistics, corpus methodology, natural language processing, electronic dictionary, artificial intelligence, machine translation, speech technologies, linguistic annotation.