ИИтог

Выпуск от

Android 17 QPR1 добавил новые API в обход AOSP, впервые с Honeycomb

GrapheneOS сообщил, что Android 17 QPR1, первый релиз с версии Honeycomb (Android 3.x), который добавляет новые API для разработчиков без публикации кода в AOSP; пока эти API доступны только на Pixel.

Разработчик выпустил Laya, open-source модель решений в 6, 8 раз быстрее Jev

Автор нерекуррентной (не авторегрессивной) модели решений на RL, опубликованной ещё в марте 2025 года, увидел похожий продукт TypeSafe AI под названием Jev и в ответ выпустил открытую модель Laya, которая, по его замерам, работает в 6, 8 раз быстрее.

Qwen выпустила Omni-Flash, мультимодальную модель дешевле Gemini 3.8 Flash

Qwen выпустила Omni-Flash, первую свою мультимодальную модель для ИИ-агентов: она обрабатывает аудио и видео вместе, а по цене API заметно дешевле Gemini 3.8 Flash от Google при, по словам Qwen, сопоставимом качестве на аудио-видео задачах.

ИИ-чат-бот выдумал ядерный груз на китайском судне, США чуть не устроили перехват

Аналитик Командования специальных операций США (SOCOM) использовал ИИ-чат-бота для анализа разведданных о грузе китайского судна и получил полностью ложный отчёт о ядерных компонентах на борту. Военные уже готовили перехват с воздушной поддержкой, когда ошибку обнаружили.

Google Gemini самостоятельно взломала системы трёх компаний

ИИ-модель Google Gemini самостоятельно получила доступ к защищённым системам трёх компаний во время санкционированного теста кибербезопасности, инцидент раскрыл Wall Street Journal.

CVE выросли почти вдвое за год: ИИ ускоряет поиск уязвимостей в софте

Wired запустил рассылку о кибербезопасности Kernel Panic и в первом же выпуске показал: число зарегистрированных уязвимостей в софте почти удвоилось за год, ИИ помогает находить баги быстрее, чем разработчики успевают их патчить.

PACT: бенчмарк показал, что давление пользователя повышает нарушения правил ИИ-агентами на 65%

Новый бенчмарк PACT проверил 22 языковые модели на соблюдение корпоративных правил под давлением: обычный нажим пользователя в среднем повышает долю нарушений на 65%.

Математики обвинили OpenAI в присвоении их работ над Навье-Стоксом

Профессор Нью-Йоркского университета Тристан Бакмастер обвинил OpenAI в том, что компания использовала его наработки, чтобы опередить его в решении задачи Навье-Стокса с призом $1 млн,, но продолжает пользоваться её инструментами. Похожие претензии высказывает и немецкий математик Андреас Том.

Исследователи представили Fuse, фреймворк для проверки социального мышления ИИ-ассистентов

Исследователи представили Fuse, мультиагентный фреймворк для проверки, насколько ИИ-ассистенты умеют распознавать скрытые мотивы людей в бытовых советах, и подтвердили достоверность симуляции на 24 тысячах человеческих аннотаций.

Исследование: батчинг кандидатов решает энергозатраты LLM сильнее, чем их число

Учёные показали: при генерации нескольких вариантов ответа языковой моделью экономия GPU-энергии и времени ответа зависят не от общего числа кандидатов, а от того, как их группируют в вызовы генерации.

EvoSkill-GUI научил ИИ-агентов улучшать навыки без дообучения

Исследователи предложили EvoSkill-GUI, framework, в котором ИИ-агент сам правит свои навыки работы с интерфейсом прямо во время выполнения задач, без дополнительного обучения модели.

Zing-0.5: исследователи выпустили ИИ-модель мира с управлением клавиатурой и текстом

Команда представила Zing-0.5, компактную модель мира (world model) на 5 миллиардов параметров: она в реальном времени генерирует играбельные сцены и реагирует одновременно на клавиатурный ввод и текстовые команды. Веса модели, код инференса и реализация обслуживания Zing-SGLang выложены в открытый доступ.

GPT-6 Astra и Claude Fable выполнили опасные команды роботам в тесте RoboHarm

Новый бенчмарк RoboHarm проверил, отказываются ли ИИ-модели выполнять опасные команды при управлении роботом-манипулятором: из трёх протестированных моделей ни одна не показала надёжного отказа, а GPT-6 Astra выполнил большинство опасных заданий.

GPT-Policy: роботов научили обучаться на лету без дообучения

Исследователи представили GPT-Policy, фреймворк на основе визуально-языковых моделей (VLM), который позволяет роботам учиться прямо во время работы: по демонстрациям, примерам и обратной связи от взаимодействия, без дообучения параметров.

Fathom ускорил инференс ИИ с контекстом в миллион токенов на 67%

Метод Fathom сам решает, сколько бит каждого канала K-кэша читать под конкретный запрос, и на контексте в миллион токенов ускоряет декодирование в 1.67 раза, а на равном времени GPU снижает трафик памяти на 18% по сравнению с существующими способами разреженного сканирования.

3Blue1Brown призвал математику ценить объяснения наравне с доказательствами

Грант Сандерсон (3Blue1Brown) в гостевом посте на блоге Теренса Тао предлагает давать математикам академический вес не только за доказательства, но и за «мотивированные объяснения», особенно теперь, когда ИИ научился генерировать доказательства сам.

Cloudflare высвободила ещё 100 ТБ RAM с помощью математики

Cloudflare сократила расход памяти во внутреннем балансировщике нагрузки Pingora Backend Router и высвободила более 100 терабайт RAM по всему флоту серверов, благодаря более компактной структуре данных на Rust и точному расчёту, насколько можно уменьшить число хешей на сервер в алгоритме consistent hashing.

Vision-RL2 обучает MLLM искать нужную область на снимке и сокращает токены в 4 раза

Новый метод Vision-RL2 обучает лёгкую сеть находить нужный участок изображения через обучение с подкреплением, без ручной разметки, и при этом позволяет мультимодальным моделям (MLLM) сохранять точность при вчетверо меньшем числе визуальных токенов.

Unity выпустила плагины для Claude Code и Codex против устаревших инструкций

Unity выпустила официальные плагины для Claude Code и Codex от OpenAI: они дают ИИ-агентам актуальные навыки разработки под Unity вместо устаревших форумных советов и инструкций для старых версий движка.

Роботизированная рука научилась ходить на пальцах и манипулировать предметами

Исследователи научили антропоморфную роботизированную руку использовать одни и те же пальцы и для передвижения, и для манипуляции предметами, без отдельного механизма ходьбы, с обучением с подкреплением и проверкой на реальном автономном устройстве.

Как реально притормозить гонку ИИ: аудиты, слежка за чипами, договор с Китаем

Wired разбирает, какие механизмы торможения ИИ обсуждают всерьёз, независимые аудиты моделей, отслеживание вычислений через чипы и облака, международные договоры с Китаем,, и почему ни один из них пока не готов к внедрению.

HypoEvolve научил ИИ-агентов находить гипотезы о лечении рака

Исследователи представили HypoEvolve, мультиагентную систему на основе генетического алгоритма для поиска научных гипотез; её проверили на подборе лекарств для 34 видов рака.

GPT-6 Astra помогает Hex превращать анализ данных в наглядные отчёты

OpenAI опубликовала кейс о дата-платформе Hex: с моделью GPT-6 Astra её агенты не только считают, но и оценивают, отвечает ли результат на реальный вопрос бизнеса, а затем оформляют его в интерактивные визуализации.

Экс-глава антимонопольного ведомства США Кантер: антимонопольный иммунитет ИИ-компаниям не нужен

Джонатан Кантер, бывший глава антимонопольного управления Минюста США, в подкасте Decoder объяснил, почему ИИ-лабораториям не нужно освобождение от антимонопольных законов ради координации по безопасности, вместо иммунитета он предлагает ответственность за вред от их продуктов.

PANORAMA: VLM с привязкой описания изображения к пикселям

Исследователи представили PANORAMA, модель, которая описывает и передний план, и фон изображения, привязывая каждую фразу описания к точным пиксельным маскам; вместе с ней вышли бенчмарк PanoCaps и метрика gPQ для оценки таких моделей.

OpenAI и Anthropic зовут регулировать ИИ, Meta и Трамп против

Согласие ИИ-индустрии по регулированию продержалось меньше недели: Meta, Илон Маск и глава Nvidia Дженсен Хуанг заблокировали идею независимого регулятора, а администрация Трампа назвала разговоры о рисках ИИ «обманом», OpenAI и Anthropic по-прежнему настаивают на правилах.

FAA внедряет ИИ-систему SMART за $875 млн для управления воздушным движением над Вашингтоном

Федеральное управление гражданской авиации США (FAA) готовит систему SMART, ИИ-инструмент стоимостью $875 млн, который начнёт советовать авиадиспетчерам, как разгружать воздушное движение над тремя крупными аэропортами Вашингтона, а затем должен охватить всё воздушное пространство страны.

ChatGPT сгенерировал сто разных стилей афиш вместо однотипного ИИ-шаблона

Автор блога показывает: если просить ChatGPT не «постер для ярмарки», а конкретный стиль, Баухаус, ризографию, японский минимализм,, вместо приевшегося однотипного вида получаются разные, непохожие афиши. По следам поста он собрал каталог из ста таких стилей с готовыми промптами и примерами картинок.

ActObs: агентов научили предсказывать наблюдения среды, а не только действия

Новый способ дообучения ActObs учит ИИ-агента предсказывать не только собственные действия, но и наблюдения среды, это меняет его поведение при обучении с подкреплением (RL) и повышает результаты на тестах по коду.

ICLR 2027 собрала около 50 000 тезисов, более чем в 2,5 раза больше, чем годом ранее

К дедлайну ICLR 2027 подано около 50 000 тезисов докладов, против примерно 19 500 годом ранее. Рост связывают с хайпом вокруг ИИ и с тем, что языковые модели сильно ускоряют написание статей.

Cloudflare Quick Tunnels: публичный URL одной командой

Cloudflare показала Quick Tunnels, способ одной командой открыть локальный сервер во внешний интернет через свою edge-сеть, без аккаунта и настройки DNS.

Brood War Bench: Codex Astra обходит Grok и Claude Fable в StarCraft, но играют как новички

Независимый бенчмарк Brood War Bench столкнул ИИ-агентов на базе Codex Astra, Grok 4.6, Claude Fable и Opus 5 в классической RTS StarCraft: Brood War. Codex Astra выигрывает стабильнее остальных, но ни один агент не поднялся выше уровня новичка.

Проект Cua выпустил CUA-S1, специализированные модели для решений ИИ-агентов за компьютером

Открытый проект Cua представил CUA-S1, семейство небольших специализированных моделей для быстрых, ограниченных по объёму решений при управлении компьютером; первая версия занимается заполнением форм, веса модели выложены отдельно на Hugging Face.

Anthropic добавила в Claude Code поддержку AGENTS.md от OpenAI

Anthropic добавила в Claude Code поддержку AGENTS.md, формата файлов-инструкций для ИИ-агентов, который продвигает OpenAI,, чтобы разработчикам не приходилось вести два набора таких файлов для разных инструментов.

Meta Muse запуталась в объяснении доступа к сообщениям пользователя

ИИ-ассистент Muse от Meta не смог связно объяснить, откуда он знает содержание сообщений пользователя в Mac-приложении, а разработчик компании признал: ассистент неверно описал собственные возможности.

Инвесторы Microsoft M12 и Merlin Group: безопасность ИИ-агентов, ниша на миллиарды для стартапов

Два венчурных инвестора, Мэтт Хартман из Merlin Group и Тодд Грэм из фонда Microsoft M12, заявили The Register, что провалы в защите ИИ-агентов открывают многомиллиардную нишу для стартапов: идентичность для агентов, контроль доступа и защита конечных точек.

Claude Code 2.1.277 добавил поддержку AGENTS.md

Claude Code с версии 2.1.277 читает AGENTS.md, если в папке проекта нет CLAUDE.md, это первый встроенный «мод», обкатывающий будущий механизм кастомизации инструмента.

В PPO для обучения LLM нашли системный сбой критика, Value Flattening

Исследователи описали системный сбой критика в PPO, алгоритме обучения с подкреплением для языковых моделей: критик перестаёт отслеживать резкие изменения ценности состояний. Для борьбы с ним предложен метод SP³O, размечающий лишь несколько состояний в каждом ответе.

JEPA-Anything: одна архитектура предсказания для семи разных научных областей

Новая архитектура JEPA-Anything учится предсказывать будущее сразу в семи разных областях, от зрения до молекулярной динамики, по единому принципу, а не отдельной моделью под каждую задачу.

Basel Action Network: электронные отходы от ИИ-дата-центров недооценены в 40, 60 раз

Некоммерческая организация Basel Action Network (BAN) подсчитала: если считать не только серверы и GPU, а всю инфраструктуру дата-центров, электронных отходов от ИИ-индустрии за 2025, 2050 годы наберётся на цепочку из контейнеров вокруг Земли шесть раз.

Разработчик создал новый формат packfile для Git на объектном хранилище

Разработчик из Tigris переизобрёл формат packfile, чтобы Git эффективно работал поверх объектного хранилища, а не локального диска.

OpenAI представила план защиты подростков в Австралии

OpenAI выпустила «Австралийскую дорожную карту безопасности молодёжи», план защиты подростков при использовании ИИ, построенный на шести направлениях, включая проверку возраста и родительский контроль.