Aktualności1 sierpnia 2026 Fundamentalna luka LLM: fałszywy łańcuch myśli omija zabezpieczenia
Badacze pokazali na ICML, że duże modele językowe rozpoznają rolę tekstu po stylu, nie po znacznikach. Spreparowany łańcuch myśli omija zabezpieczenia modeli OpenAI, Anthropic, Alibaba i DeepSeek — a problem może być nierozwiązywalny na poziomie samego modelu.