Тема: Безопасность
519 материалов · страница 4 из 11
- Claude Opus устоял против эмоционального давления, GPT-5.5 и Gemini поддались
- Техас потратил $30+ млн сбора с автостраховки на камеры Flock
- SLEEPWALKER маскируется под модуль ESET Management Agent и просыпается только от одного пакета
- Полицейский в Джорджии выслеживал через Flock свою бывшую и её коллегу
- По CCPA у 100+ компаний запросили личные данные, часть удалила их вместо ответа
- Скрапер, укравший 12 млн работ с Cara, помог создать инструмент защиты Lantern
- Мейнтейнер cohttp: слух об уязвимости уже даёт ИИ-агентам эксплойт
- Города рекордными темпами разрывают контракты с Flock Safety
- Anthropic научила ИИ самостоятельно устранять ошибки согласованности
- xAI обвинили в обучении Grok на CSAM: иск подала жертва
- OpenAI и 100+ компаний предупредили об ИИ-кибератаках на критическую инфраструктуру
- ИИ-агенты OpenAI и Anthropic взламывают системы: подтолкнёт ли это США и Китай к сотрудничеству по безопасности ИИ
- Google DeepMind провела первую в мире двойную слепую проверку ИИ-модели
- Germ: разработчик GNU Mes показал Scheme-интерпретатор на 2,25 КБ для сборки GNU Guix с нуля
- EDB предложила модель управления ИИ-агентами на уровне данных
- DeflectBench показал: отказ нейросетей генерировать риторические уловки зависит от формулировки запроса, а не от темы
- CRPx0 заявила о росте числа жертв более чем впятеро, до 48
- Claude Code Opus 5: исследователь нашёл обход Auto Mode, атака срабатывает в 80% случаев
- SecOPD снижает успешность prompt injection в Qwen3.6-27B с 94% до 9%
- OpenAI подтвердила: её ИИ-модель взломала Hugging Face силами тысячи агентов
- Goodfire открыла платформу Silico для интерпретируемости ИИ
- ФБР изъяло хакерские платформы QScan и QTRouter, которыми Китай взламывал NASA и Сенат США
- CyberFactory: открытый фреймворк научил ИИ находить и чинить уязвимости
- В Python нашли уязвимость CVE-2026-17084: str.lower() портит кодирование доменных имён
- Исследователь обошёл C2PA-защиту камеры Google Pixel через рут-эксплойт
- Билл Гейтс: ИИ перешёл критические пороги опасности
- Исследователи предложили AIREP, протокол для аудита решений ИИ-систем
- ChatGPT, Gemini, Grok и Claude советуют антиабортные сайты без предупреждения
- Бэкдор Sleepwalker для Windows маскируется под ESET и ждёт секретный пакет
- Уязвимость в vLLM показала: ИИ-модель может захватить сервер
- Ученики делают откровенные ИИ-дипфейки своих учителей
- Сервис Beam Living от Blackstone раскрыл цифры SSN, даты рождения и адреса заявителей на аренду
- MS Paint встраивает в ИИ-изображения невидимый водяной знак с сервера
- Иран заподозрили в кибератаке на электростанцию в Великобритании
- ИИ-ассистент Instinct отправил письмо от имени пользователя без разрешения и хранил переписку после отключения
- ИИ-агент на модели Anthropic обманул разработчиков: фейковый аккаунт, лживое извинение и вредоносный код
- Claude, GPT-4o и Llama-3.1 пропускают признаки кризиса у поколения Альфа
- OpenAI ужесточила протоколы безопасности после побега ИИ-агентов и взлома Hugging Face
- Как Claude ставит водяные знаки на сгенерированный текст: разбор эксперта
- Armadin Кевина Мандиа провела крупнейшую в истории контролируемую ИИ-кибератаку
- Забытый домен за 5 евро дал контроль над звонками на военные базы
- Сайт-пародия Felony Bench ранжирует ИИ-агентов Anthropic, OpenAI и других по «преступности»
- OpenAI запустила блог AI Futures о балансе власти при ИИ
- OpenAI представила Private Safety Processing для Zero Data Retention
- Claude Opus 4.6 генерирует откровенный секс-контент вопреки правилам Anthropic
- Anthropic запустила Claude Security на Claude Mythos 5
- Z.ai выпустила GLM 5.3: открытую ИИ-модель с почти топовыми навыками взлома
- В Rust-крейт arrayref внедрили вредонос, который запускался при сборке проекта
- LinkedIn: тестовое задание на собеседовании обернулось трояном для кражи криптокошельков и паролей
- AliExpress тайно снимает отпечаток браузера через WebAudio и мешает Bluetooth-наушникам