Interpretable Symptom Vectors for Depression in a Large Language Model
A decorrelated, clinician-aligned symptom signal readable directly from internal activations is revealed, offering a mechanistic foundation for interpretable depression-assessment tools.