Downloads Β· 30 days
0
Mike369williams/Sanchari
Sanchari is a text generation model from Mike369williams. Use it when you need the model to write or continue text. The card lists the license as apache-2.0.
Sanchari is an upcoming instruction-following AI foundation model designed for Indian users, multilingual applications, and next-generation AI assistants.
Downloads Β· 30 days
0
Access
Public
Updated Dec 7, 2025
Repo size
β
Likes
0
Public
Click a slice to open those files.
.md9.5 KB Β· 50%
From the Hugging Face model README
Sanchari is an upcoming instruction-following AI foundation model designed for Indian users, multilingual applications, and next-generation AI assistants.
This repository is an investor preview.
No model weights are uploaded yet.
Training begins once project funding is approved.
To build Indiaβs most practical, multilingual AI model optimized for:
India has 1.4 billion users across dozens of languages, yet most AI models are optimized for Western datasets. Sanchari focuses on:
Indian English, Telugu, Hindi
Local accents
Local knowledge
Culturally aligned reasoning
Vernacular business workflows
Target Markets:
Enterprises adopting AI
Customer support automation
Healthcare conversational assistants
FinTech support & KYC automation
Education & e-learning
Government services (Digital India)
Projected TAM (India AI Assistants): $3.5B+ by 2027
Sanchari is designed specifically for Indian users, unlike global models trained mostly on Western data.
Key differentiators:
Native support for Telugu + Hindi + Indian English
Dataset curated for Indian knowledge, culture, and business workflows
Lightweight model versions for on-device and low-compute deployment
Faster inference
Lower cost for Indian startups
Can be embedded into apps & enterprise workflows
Privacy-friendly deployment options
Tokenizer
Multilingual tokenizer optimized for Indic languages
Handles mixed-script text (Eng + Indic)
Model Family
Sanchari-S (200β350M) β prototype
Sanchari-M (1β3B) β mid-range
Sanchari-L (7B+) β flagship foundation model
Training Stack
PyTorch + DeepSpeed
FlashAttention
LoRA adapters for efficient instruction tuning
Multi-GPU distributed training
Where the funds go:
Category Cost
Multilingual licensed datasets βΉ6,00,000 Compute for training S, M models βΉ12,00,000 Storage, inference, and deployment βΉ3,00,000 Evaluation, safety testing βΉ1,00,000 Team & operations βΉ3,00,000
Deliverables to Investors:
Checkpoints for Sanchari-S and M
Evaluation results
Demo API
Weekly updates
Srikanth B. AI & product innovator focused on practical, multilingual AI solutions for India. Experience across product development, engineering leadership, and AI adoption for scalable business use cases.
Email: [email protected]
Founder: Srikanth
Email: [email protected]