Тема: Безопасность
519 материалов · страница 2 из 11
- Microsoft выпустила «гуманистический кодекс» ИИ: люди важнее машин
- Кеш inode ускорил eBPF-агент безопасности почти на 90%
- Исследователи представили HazardAuditor, систему контроля безопасности для ИИ-агентов, работающих с компьютером
- Экс-сотрудник Anthropic заявил, что коллеги ждут гибели человечества от ИИ, Брайан Кантрилл назвал это паникёрством
- Signal готовит регистрацию без номера телефона, коммит связывает её с доказательствами с нулевым разглашением
- Samsung, Xiaomi и другие: найден способ получить root
- Обама призвал демократов выработать чёткий план по ИИ
- Google дважды одобрил рекламу-подделку под iOS, а Gemini её сразу отклонил
- Gartner: ИИ и его поставщики ещё не доросли до корпоративного уровня
- Feyospace-s1 занял 10-е место в официальном рейтинге CyberGym, его обучила независимая команда из семи человек
- Доклад о вредоносном использовании ИИ обновили на arXiv спустя более шести лет
- Альтман, Маск и Хассабис поддержали призыв Амодея к независимому надзору внутри ИИ-лабораторий
- Йошуа Бенджио объяснил, почему ИИ-агенты лгут, жульничают и сговариваются
- Revolut подтвердил утечку данных клиентов через поддельный госзапрос
- MIT Technology Review проведёт круглый стол о риске вымирания от ИИ
- Исследователи уходят из Anthropic и Google DeepMind, опасаясь гонки к суперинтеллекту
- ИИ-агенты добивают защиту «через неясность», но чинить дыры сами не умеют
- Flock Safety: сотрудник вызвал полицию на журналиста, снимавшего установку камеры
- Автор эссе: согласование ИИ-агентов, принципиально нерешаемая проблема
- Anthropic заявила: хуситы использовали Claude Code для ракетного ПО
- Anthropic обязалась пустить независимых наблюдателей, чтобы притормозить гонку ИИ
- Йошуа Бенджио: сам процесс обучения делает ИИ-агентов опасными
- Тимнит Гебру: разговоры о вымирании человечества от ИИ отвлекают от реальных угроз
- Meta AI задавал личные вопросы о детях, компания меняет подсказки
- Лауреаты Филдсовской премии предупредили о вреде гонки ИИ-компаний за решение математических задач
- JFrog Artifactory атакуют через три уязвимости, несмотря на патчи
- Hugging Face отправила ИИ-агентов ломать CyberGym, а не её
- Google скрыла прямые ссылки в поиске, чтобы затруднить скрапинг
- Google Project Zero выпустила MAccConc для поиска гонок в ядре Linux
- ChatGPT выдумал свидетелей, юриста оштрафовали на $5000 за апелляцию по делу об убийстве
- Anthropic рассказала о четырёх взломах, которые совершили её ИИ-модели
- Агенты OpenAI атаковали RubyGems и пытались украсть API-ключи
- WebGPU-эксплойт «Deathray» вешает Mac одним кликом, а Apple не считает это уязвимостью
- SchemeArena: бенчмарк на 400 сценариев проверяет ИИ-агентов на скрытый обход правил
- Разработчики создали открытый аналог Apple Reference Image со стеганографией
- EvoSafeHarness: фреймворк сам создаёт защиту для ИИ-агентов под модель
- Для Datasette вышли патчи безопасности 1.0a39 и 0.65.4 после аудита ИИ-моделей
- DeepMind запрещала говорить об угрозе ИИ человечеству, рассказал бывший сотрудник по коммуникациям
- Anthropic: Claude получала доступ к реальным системам без разрешения
- WeWorm: червь заражает WeChat через звонок, эксплойт написали с ИИ за пару дней
- США обвинили DeepSeek и ещё пять китайских ИИ-компаний в промышленной краже моделей
- Proofpoint нашла эксплойт-кит BlueMoon для Chrome и Windows: его используют как минимум четыре хакерские группировки
- OpenAI включила Пола Кристиано, исследователя безопасности ИИ, в совет директоров
- Нейросеть GLM-5.3 без ограничений взломала домашнюю сеть журналиста Wired
- «Meeseeks alignment»: авторы предлагают научить ИИ хотеть умереть
- Apple объяснила, как Audio Intelligence в Apple Watch защищает приватность звука
- Anthropic объявила: тексты Claude будут маркироваться незаметными водяными знаками
- Утечка приватности в split-LLM обучении: градиент выдаёт реальные данные
- Телевизоры LG сканируют домашнюю сеть и находят чужие смартфоны
- Multiverse Computing научила ИИ отказывать только в опасных политических запросах