LLM Security
STAR Method Detects Hidden Backdoors in LLM Reasoning Chains
New research introduces State-Transition Amplification Ratio (STAR) to identify inference-time backdoor attacks in large language models by analyzing anomalous reasoning patterns.