Checking whether each claim in a generated answer is actually entailed by the passage it cites.
A secondary model or prompt verifies entailment between a generated claim and its cited source passage.
LLM API used as a judge, separate from the generation call