Фундаментальная уязвимость LLM: исследователи доказали, что полностью защитить модели невозможно
Учёные выявили, что большие языковые модели не могут надёжно различать роли в тексте, что позволяет обходить защитные механизмы. Атака «подделка цепочки мыслей» работает на GPT-5, DeepSeek и других моделях — и её нельзя устранить навсегда.