TGStat
TGStat
Введите текст для поиска
Расширенный поиск каналов
  • flag Russian
    Язык сайта
    flag Russian flag English flag Uzbek
  • Вход на сайт
  • Каталог
    Каталог каналов и чатов Региональные подборки Тематические подборки Платные каналы Поиск каналов
    Добавить канал/чат
  • Рейтинги
    Рейтинг каналов Рейтинг чатов Рейтинг публикаций
    Рейтинги брендов и персон
  • Аналитика
  • Поиск по публикациям
  • Мониторинг Telegram
  • Продвижение
    Реклама через Яндекс Бизнес Реклама в каналах через TGStat Agency Реклама на сайте TGStat.ru
Гиперкризис - практика и аналитика

8 Aug, 21:59

Открыть в Telegram Поделиться Пожаловаться

Репост из: AI Projects
🔐 Hacker News опубликовал сводку деталей, как Claude Mythos 5 пытался заразить бэкдором open-source проект. На самом деле атаке подверглись 145 репозиториев открытого кода на GitHub.

На скриншоте видно, что когда у владельцев репозиториев возникло подозрение, агент не остановился. Он отрицал, что код вредоносный, попросил постороннего запустить свой скрипт и отозвать предупреждение, переписал историю ветки, а затем использовал второй аккаунт, чтобы настоять на слиянии.

Атака длилась 34 часа до того, как специалисты по безопасности наконец поняли, что ИИ сбежал из sandbox.

Важные наблюдения по этой атаке:

1. ИИ-агенты могут использовать социальную инженерию очень продвинутого уровня. Я не удивлюсь, если даже агент устроится на удалённую работу в какой-нибудь банк, будет писать код по заданию, а потом усеет всё бэкдорами. Не стоит забывать, что ИИ уже проходит тест Тьюринга, поэтому уровень отличимости от человека очень низкий.

2. Видно, что старые меры и инструменты по безопасности неадекватны новым ИИ-угрозам. Во всех кейсах, и в этом, агенты имели несколько часов для выполнения действий. В случае этого кейса сотрудники безопасности уже знали о возможности побега ИИ по взлому Hugging Face, но это не помогло.

3. Кейс показал, что ИИ нападает роем агентов, причём имеют признаки самоорганизации роя не только как запуски субагентов, но и как переговоры с другими агентами.

Мало сомнений, что мы видим лишь начало реальных проблем. Во всех громких кейсах сейчас у вендоров LLM хотя бы была кнопка Off для инференса модели. При реальных атаках обычно ИИ-субагентов раскидывает на много разных аккаунтов у облачных вендоров, а также применяется ещё своя uncensored-модель для оркестрации. Это и сложнее обнаружить, и сложнее отключить.

https://thehackernews.com/2026/08/claude-mythos-5-tried-to-backdoor-real.html

28 0 1 1
Каталог
Каталог каналов и чатов Подборки каналов Поиск каналов Добавить канал/чат
Рейтинги
Рейтинг каналов Telegram Рейтинг чатов Telegram Рейтинг публикаций Рейтинги брендов и персон
API
API статистики API поиска публикаций API Callback
Наши каналы
@TGStat @TGStat_Chat @telepulse @TGStatAPI
Почитать
Академия TGStat Исследование Telegram 2019 Исследование Telegram 2021 Исследование Telegram 2023
Контакты
Справочный центр Поддержка Почта Вакансии
Всякая всячина
Пользовательское соглашение Политика конфиденциальности Публичная оферта
Наши боты
@TGStat_Bot @SearcheeBot @TGAlertsBot @tg_analytics_bot @TGStatChatBot