paper
referenced-only
paper:2024a2024a. Evaluating and inducing personality in pre-trained language models
Similar preprints — Semantic Scholar
Cited by (1)
- Spotting Out-of-Character Behavior: Atomic-Level Evaluation of Persona Fidelity in Open-Ended Generation
Conventional response-level persona evaluation systematically inflates fidelity scores by collapsing multi-sentence outputs into a single score, masking sentence-level Out-of-Character (OOC) deviation