[1]
2026. Benchmarking Truthfulness Metrics in Health-Oriented Large Language Models via Automated Fact Verification Pipelines. International Journal of Computational Health & Machine Learning. 4, 2 (Jul. 2026).