Medžuslověnsky języčny korpus i lexikon
Integrovana naučno-istraživatelska platforma za automatizovanu obrabotku prirodnago języka (NLP) i komparativny analiz slověnskyh językovyh system. Sodrži v sebě verificirovanny lexikon praslověnskyh korenjev, mnogojęzyčny paralelny korpus i semantičny graf odnošenj.
Osnovni možnosti platformy
Mnogopisemnaja ortografična konversija
Dynamična transliteracija tekstovyh masivov medžu kirilicojų i latinicejų (naučna isv-notacija) grafičnymi systemami. Modul obezpěčaje automatičnu adaptaciu vizualizaciji lexem i fonetičnoj transkripciji (IPA) pod lokalni metadaty uživatelja.
Morfemno-semantično kartiranje
Dekompozicija lexem na derivacijni morfemy i integracija v mnogouråvnevy graf znania. Systema ustanovljaje vagy sinonimičnoj, antonimičnoj i koręnoj blizosti entitetov, vizualizujųči klastery kognatov i praslověnskyh etymologičnyh svęzej.
Kros-językovo leksično poråvnanje
Komparativny analiz i semantično sopostavljenje medžuslověnskyh lexem s paralelnymi denotatami v 16 živyh slověnskyh językah. Arhitektura poddržaje strogu relacijnu verifikaciju i validaciju prěvodnyh ekvivalentov expertnym soobščestvom.
Paralelny lingvističny korpus
Polnotekstovo i lexiko-sintaxično iskanje po segmentirovanym tekstovym masivam (KWIC). Systema poddržaje mortologičnu razmětku (POS-tagging) i učityvaje statistične metriky čęstotnosti upotrěby slovoform dlja precisijnago ranžirovanja vydači.
5
Flavorizacij
636.72K
Tokenov v korpusu
1.05
Zipf Alpha
44.89%
Pokrytje lexikona
Хотите внести вклад в развитие лексикона?
Зарегистрируйтесь в системе, чтобы получить доступ к базовым функциям или запросить права модератора.