https://arxiv.org/abs/2511.20703
[2511.20703] PropensityBench: Evaluating Latent Safety Risks in Large Language Models via an...
Abstract page for arXiv paper 2511.20703: PropensityBench: Evaluating Latent Safety Risks in Large Language Models via an Agentic Approach