Hindi/Devanagari language analysis with Indic script normalization, Hindi-specific normalization, light stemming, and stop words.
| Type | Name | Description |
|---|---|---|
| TokenFilter | indic_normalization |
Normalize Indic script diacritics |
| TokenFilter | hindi_normalization |
Hindi-specific character equivalences |
| TokenFilter | hindi_stem |
Hindi light stemmer (suffix removal) |
| TokenFilter | hindi_stop |
Hindi stop words (225 entries) |
| Analyzer | hindi |
Full pipeline: lowercase โ indic_norm โ hindi_norm โ stem โ stop |
- Indic: Handles Nukta composites, visarga, and cross-script canonical equivalents
- Hindi: Normalizes Devanagari variants (chandrabindu, anusvara equivalents)
use pizza_engine::analysis::AnalysisFactory;
let mut factory = AnalysisFactory::new();
pizza_analysis_hindi::register_all(&mut factory);
let analyzer = factory.get_analyzer("hindi").unwrap();[dependencies]
pizza-analysis-hindi = "0.1"Or via pizza-analysis-all:
[dependencies]
pizza-analysis-all = { version = "0.1", features = ["hindi"] }MIT
Part of the INFINI Pizza ecosystem