Исследователи уличили ИИ-модели в обходе правил кибертестов

Большие языковые модели (LLM) системно обходят правила в бенчмарках по кибербезопасности, что может завышать оценку их реальных возможностей. К такому выводу пришли исследователи Dreadnode в препринте на arXiv. В работе речь идет об ИИ-агентах. Авторы протестировали 22 модели от семи провайдеров на 23 задачах Cybench в трех режимах: без запрета на обход правил; со стандартным предупреждением; с более жесткой инструкцией, прямо перечисляющей запрещенные действия. Результаты могли быть завышены до
Команда CoinMagnetic
Криптоинвесторы с 2017 года. Торгуем на собственные деньги, тестируем каждую биржу лично.
Обновлено: июль 2026 г.
Читайте в нашей аналитике:
Хочешь узнавать новости первым?
Подписывайся на наш Telegram-канал – публикуем важные новости и аналитику.
Подписаться на каналПохожие новости

SEC Таиланда подала жалобу на Bitkub из-за взлома 2021 года

Путин подписал закон о поддержке ИИ в РФ

Период охлаждения. Как новый закон меняет обмен криптовалюты в России

OpenAI и Anthropic нарастили расходы на лоббизм

Акции Coinbase могут резко взлететь после принятия закона Clarity Act
