Verified project record
confident-ai/deepeval
An open-source evaluation framework, modeled after Pytest, for unit testing and evaluating large language model applications. It provides ready-to-use metrics to help development teams assess LLM quality, compare model outputs, and detect prompt drifting.