~/projects/istidlal-libraryREADME.md
Digital library
Istidlal Library
A broad source corpus that combines serious reading tools with modern multilingual retrieval.
cat problem.md
The problem
Important Arabic and Urdu texts remain distributed across inconsistent scans, formats, and search interfaces, limiting both discovery and structured research.
cat system.md
The system
Istidlal Library is being built as a unified corpus with normalized text, OCR and ingestion pipelines, traditional reading tools, and search that combines lexical and semantic signals.
~/projects/istidlal-librarycapabilities.map
inspect --capabilities
What the system handles
- Unified Arabic and Urdu source corpus
- OCR, normalization, and ingestion pipelines
- Hybrid and multilingual search
- AI-assisted discovery grounded in original texts
cat evidence.log
Current build status.
In active developmentDesigned for a large multilingual corpus