~/projects/istidlal-libraryREADME.md

Digital library

Istidlal Library

A broad source corpus that combines serious reading tools with modern multilingual retrieval.

status
in progress
category
Digital library
stack
PostgreSQL · OCR · embeddings · hybrid search · AI retrieval

cat problem.md

The problem

Important Arabic and Urdu texts remain distributed across inconsistent scans, formats, and search interfaces, limiting both discovery and structured research.

cat system.md

The system

Istidlal Library is being built as a unified corpus with normalized text, OCR and ingestion pipelines, traditional reading tools, and search that combines lexical and semantic signals.

~/projects/istidlal-librarycapabilities.map

inspect --capabilities

What the system handles

  • Unified Arabic and Urdu source corpus
  • OCR, normalization, and ingestion pipelines
  • Hybrid and multilingual search
  • AI-assisted discovery grounded in original texts

cat evidence.log

Current build status.

In active developmentDesigned for a large multilingual corpus