Locations
Nationwide recruitment and recording coverage
Dialect authenticity comes from collecting where the dialect is actually spoken. Our partner studios and field recruiters cover metros, tier-2 cities and their surrounding rural belts.

- Bambaiya Hindi-Marathi contact speech with constant three-way switching; the densest code-mixing environment in India.MaharashtraMumbai Data Collection
- Khari Boli Hindi with strong Punjabi and Haryanvi influence; corporate Hinglish is the default professional register.Delhi NCRDelhi Data Collection
- Urban Kannada under heavy multilingual contact; the strongest Indian English pool in the country.KarnatakaBengaluru Data Collection
- Telangana Telugu alongside Dakhini Urdu, producing a lexical mix found nowhere else.TelanganaHyderabad Data Collection
- Madras Bashai colloquial Tamil, sharply different from literary Tamil used in read-speech corpora.Tamil NaduChennai Data Collection
- Puneri Marathi, the prestige standard, with a large student population for younger age bands.MaharashtraPune Data Collection
- Rarhi standard Bengali in cholit register, with heavy English mixing in professional speech.West BengalKolkata Data Collection
- Standard Amdavadi Gujarati; trade and finance vocabulary is heavily English.GujaratAhmedabad Data Collection
- Lucknawi Urdu and Awadhi-influenced Hindi; the reference point for formal Urdu register.Uttar PradeshLucknow Data Collection
- Marwari-influenced Hindi, distinct from Delhi Khari Boli in vowel quality and lexicon.RajasthanJaipur Data Collection
- Kamrupi and standard Assamese; gateway to Upper Assam and Barak Valley fielding.AssamGuwahati Data Collection
- Coastal standard Odia; western Sambalpuri requires separate fielding from Sambalpur.OdishaBhubaneswar Data Collection
- Central Kerala Malayalam; Malabar variety needs Kozhikode fielding.KeralaKochi Data Collection
- Puadhi and Majhi Punjabi contact zone with Hindi; useful for tone-variation coverage.Punjab & HaryanaChandigarh Data Collection
- Varhadi Marathi, materially different from Puneri standard and largely missing from public corpora.MaharashtraNagpur Data Collection
- Kongu Tamil, distinct in lexicon and intonation from Chennai speech.Tamil NaduCoimbatore Data Collection
- Coastal Andhra Telugu, the literary standard reference.Andhra PradeshVijayawada Data Collection
- Malwi-influenced Hindi; central India variety absent from Delhi-centric corpora.Madhya PradeshIndore Data Collection
- Bhojpuri and Magahi-influenced Hindi, a major deployment market and a major corpus gap.BiharPatna Data Collection
- Surti Gujarati with distinctive intonation; large migrant Hindi-speaking population.GujaratSurat Data Collection
Need coverage outside these cities?
Rural and tier-3 collection is routine for us — we deploy mobile recording kits and local recruiters. Tell us the region and the quota.