AI Explainability, Trust, and Calibration / Multi-System Explanation Comparison and Evaluation

When users need to evaluate multiple AI systems simultaneously, how can their explanation quality be quantified and compared?