AI и RedditДайджест AI и Reddit — ежедневный дайджест
MIT Technology Review: полностью закрыть LLM от атак невозможно
MIT Technology Review 30 июля опубликовал материал о фундаментальном недостатке больших языковых моделей, из-за которого их нельзя сделать полностью защищёнными от взлома. Причина — особенность устройства самих моделей, отдельным патчем её не закрыть; детали механизма в сводке не раскрыты.
MIT Technology Review 30 июля опубликовал материал о фундаментальном недостатке больших языковых моделей, из-за которого их нельзя сделать полностью защищёнными от взлома. Причина — особенность устройства самих моделей, отдельным патчем её не закрыть; детали механизма в сводке не раскрыты.
Практический вывод: защитные контуры снижают ущерб, полной защищённости модели не обещают. Изоляция контекста, лимиты доступов и мониторинг остаются рабочей практикой.