Production experience with Kubernetes, AWS services (S3, Lambdas, SQS, IAM), or equivalent cloud tooling.
Experience with document ingestion pipelines and unstructured data storage (PDF/text ingestion, OCR, parsing).
Experience building Retrieval-Augmented Generation (RAG) solutions and using vector databases (Pinecone, Milvus, Weaviate, FAISS).
Experience deploying and monitoring LLM-based features: model selection, cost control, rate limiting, caching, observability.
Familiarity with LLM frameworks/APIs (OpenAI, Anthropic, Llama-family) and embeddings workflows.
Strong understanding of cloud-native architectures, observability (logs/metrics/tracing), reliability, and cost optimization.