1999 · 24 citations · 28 references
EngineeringQuery ModelSemanticsCorpus LinguisticsText MiningApplied LinguisticsNatural Language ProcessingLanguage DocumentationInformation RetrievalComputational LinguisticsQuery ExpansionCorpus AnalysisMixed Language QueryLanguage StudiesMachine TranslationEntity DisambiguationCross-language RetrievalNearest NeighborCross-lingual Natural Language ProcessingMonolingual QueriesLinguisticsWord-sense Disambiguation
We propose a mixed language query disambiguation approach by using co-occurrence information from monolingual data only. A mixed language query consists of words in a <i>primary language</i> and a <i>secondary language</i>. Our method translates the query into monolingual queries in either language. Two novel features for disambiguation, namely contextual word voting and 1-best contextual word, are introduced and compared to a baseline feature, the nearest neighbor. Average query translation accuracy for the two features are 81.37% and 83.72%, compared to the baseline accuracy of 75.50%.
28
Unsupervised word sense disambiguation rivaling supervised methods
David Yarowsky · 1995 · 2.4K citations · Full text
Retrieving collocations from text: Xtract
Frank Smadja · 1993 · 799 citations