Soviet CorpusMA Thesis
Corpus linguistics toolkit for Soviet census methodology texts (1926-1989): VLM extraction, orthography canonicalization, lemmatization, concordance, keyword, and register analysis.
Loading...
Soviet Corpus for VLM extraction and diachronic census-text analysis, Alpha Nurseries native-plant tooling, and other public-interest data systems.
Corpus linguistics toolkit for Soviet census methodology texts (1926-1989): VLM extraction, orthography canonicalization, lemmatization, concordance, keyword, and register analysis.
Native plant finder for wholesale buyers and restoration professionals: React/MapLibre UI, Express/GraphQL API, PostGIS spatial queries, PMTiles maps, and a Python data pipeline.
Open-source Python CLI for auditable OCR and document-extraction runs, with page-level provenance, quality signals, budgets, review queues, and reproducible reruns.
Open-source Python CLI for auditable OCR and document-extraction runs, with page-level provenance, quality signals, budgets, review queues, and reproducible reruns.
Native plant finder for wholesale buyers and restoration professionals: React/MapLibre UI, Express/GraphQL API, PostGIS spatial queries, PMTiles maps, and a Python data pipeline.
Corpus linguistics toolkit for Soviet census methodology texts (1926-1989): VLM extraction, orthography canonicalization, lemmatization, concordance, keyword, and register analysis.
Demographic study of Tatarstan: population trends, ethnic composition, and health indicators from Russian statistical data.
Analysis of American diplomat Eugene Schuyler's observations and diplomatic activities in Russian Turkestan during the late 19th century.
Policy analysis of the Anti-Ballistic Missile Treaty and its implications for US-Russia strategic relations, examining Russian reactions from 2002-2018.
Historical analysis of negotiations between Bashkir nationalists and Bolsheviks during the formation of the Bashkir ASSR (1917-1920), and of ethnic autonomy in early Soviet state-building.