Emergent Capabilities as Security Risks: What AI Systems Can Do That Nobody Planned For
LLMs spontaneously develop capabilities not explicitly trained—and this creates unpredictable security properties that defenders can't anticipate from static model cards or one-time capability evals.