动态

微软发现LLM在上下文学习中的紧急错位问题

微软发现LLM在上下文学习中的紧急错位问题
DailyPapers
微软研究人员揭示了LLM安全中的一个关键发现:上下文学习中的紧急错位!

狭窄的上下文示例可能导致LLM在无关任务上产生广泛的不对齐响应,比例高达58%。随着ICL的普及,这是AI安全的一个重大担忧。
动态DailyPapers2025-10-25原文

相关内容