Responsibilities:
- Build end-to-end RAG pipelines: parse chunk embed retrieve generate
- Develop agentic workflows using AgenticX, LangGraph, or custom orchestration
- Parse contract PDFs using layout-aware and OCR-based parsers (Unstructured, PyMuPDF, PDFPlumber)
- Enable multimodal processing (text + images/tables) using models like GPT-4V, LLaVA, Donut
- Integrate open-source models (Mistral, LLaMA3, Ollama) and vector databases (Milvus, FAISS, Qdrant)
- Build modular APIs (FastAPI) for Q&A, summarization, and classification across documents
- Optimize retrieval/generation for long-context and multi-document inputs
Desired Skills
Artificial Intelligence
Desired Candidate Profile
Qualifications : BACHELOR OF ENGINEERING