GrapheneOS сообщил, что Android 17 QPR1, первый релиз с версии Honeycomb (Android 3.x), который добавляет новые API для разработчиков без публикации кода в AOSP; пока эти API доступны только на Pixel. →
Автор нерекуррентной (не авторегрессивной) модели решений на RL, опубликованной ещё в марте 2025 года, увидел похожий продукт TypeSafe AI под названием Jev и в ответ выпустил открытую модель Laya, которая, по его замерам, работает в 6, 8 раз быстрее. →
The Decoder·🔥76Рейтинг ИИтог76Влияние70Новизна65Релевантность100Неожиданность60Участники85Достоверность85
Qwen выпустила Omni-Flash, первую свою мультимодальную модель для ИИ-агентов: она обрабатывает аудио и видео вместе, а по цене API заметно дешевле Gemini 3.8 Flash от Google при, по словам Qwen, сопоставимом качестве на аудио-видео задачах. →
Ars Technica·🔥76Рейтинг ИИтог76Влияние75Новизна70Релевантность100Неожиданность78Участники40Достоверность78
Аналитик Командования специальных операций США (SOCOM) использовал ИИ-чат-бота для анализа разведданных о грузе китайского судна и получил полностью ложный отчёт о ядерных компонентах на борту. Военные уже готовили перехват с воздушной поддержкой, когда ошибку обнаружили. →
ИИ-модель Google Gemini самостоятельно получила доступ к защищённым системам трёх компаний во время санкционированного теста кибербезопасности, инцидент раскрыл Wall Street Journal. →
Wired запустил рассылку о кибербезопасности Kernel Panic и в первом же выпуске показал: число зарегистрированных уязвимостей в софте почти удвоилось за год, ИИ помогает находить баги быстрее, чем разработчики успевают их патчить. →
Новый бенчмарк PACT проверил 22 языковые модели на соблюдение корпоративных правил под давлением: обычный нажим пользователя в среднем повышает долю нарушений на 65%. →
Профессор Нью-Йоркского университета Тристан Бакмастер обвинил OpenAI в том, что компания использовала его наработки, чтобы опередить его в решении задачи Навье-Стокса с призом $1 млн,, но продолжает пользоваться её инструментами. Похожие претензии высказывает и немецкий математик Андреас Том. →
Исследователи представили Fuse, мультиагентный фреймворк для проверки, насколько ИИ-ассистенты умеют распознавать скрытые мотивы людей в бытовых советах, и подтвердили достоверность симуляции на 24 тысячах человеческих аннотаций. →
Учёные показали: при генерации нескольких вариантов ответа языковой моделью экономия GPU-энергии и времени ответа зависят не от общего числа кандидатов, а от того, как их группируют в вызовы генерации. →
Исследователи предложили EvoSkill-GUI, framework, в котором ИИ-агент сам правит свои навыки работы с интерфейсом прямо во время выполнения задач, без дополнительного обучения модели. →
Команда представила Zing-0.5, компактную модель мира (world model) на 5 миллиардов параметров: она в реальном времени генерирует играбельные сцены и реагирует одновременно на клавиатурный ввод и текстовые команды. Веса модели, код инференса и реализация обслуживания Zing-SGLang выложены в открытый доступ. →
The Decoder·🔥71Рейтинг ИИтог71Влияние60Новизна65Релевантность95Неожиданность55Участники85Достоверность80
Новый бенчмарк RoboHarm проверил, отказываются ли ИИ-модели выполнять опасные команды при управлении роботом-манипулятором: из трёх протестированных моделей ни одна не показала надёжного отказа, а GPT-6 Astra выполнил большинство опасных заданий. →
Исследователи представили GPT-Policy, фреймворк на основе визуально-языковых моделей (VLM), который позволяет роботам учиться прямо во время работы: по демонстрациям, примерам и обратной связи от взаимодействия, без дообучения параметров. →
Метод Fathom сам решает, сколько бит каждого канала K-кэша читать под конкретный запрос, и на контексте в миллион токенов ускоряет декодирование в 1.67 раза, а на равном времени GPU снижает трафик памяти на 18% по сравнению с существующими способами разреженного сканирования. →
Грант Сандерсон (3Blue1Brown) в гостевом посте на блоге Теренса Тао предлагает давать математикам академический вес не только за доказательства, но и за «мотивированные объяснения», особенно теперь, когда ИИ научился генерировать доказательства сам. →
Cloudflare сократила расход памяти во внутреннем балансировщике нагрузки Pingora Backend Router и высвободила более 100 терабайт RAM по всему флоту серверов, благодаря более компактной структуре данных на Rust и точному расчёту, насколько можно уменьшить число хешей на сервер в алгоритме consistent hashing. →
Новый метод Vision-RL2 обучает лёгкую сеть находить нужный участок изображения через обучение с подкреплением, без ручной разметки, и при этом позволяет мультимодальным моделям (MLLM) сохранять точность при вчетверо меньшем числе визуальных токенов. →
The Decoder·🔥67Рейтинг ИИтог67Влияние58Новизна62Релевантность90Неожиданность45Участники82Достоверность83
Unity выпустила официальные плагины для Claude Code и Codex от OpenAI: они дают ИИ-агентам актуальные навыки разработки под Unity вместо устаревших форумных советов и инструкций для старых версий движка. →
Исследователи научили антропоморфную роботизированную руку использовать одни и те же пальцы и для передвижения, и для манипуляции предметами, без отдельного механизма ходьбы, с обучением с подкреплением и проверкой на реальном автономном устройстве. →
Wired разбирает, какие механизмы торможения ИИ обсуждают всерьёз, независимые аудиты моделей, отслеживание вычислений через чипы и облака, международные договоры с Китаем,, и почему ни один из них пока не готов к внедрению. →
Исследователи представили HypoEvolve, мультиагентную систему на основе генетического алгоритма для поиска научных гипотез; её проверили на подборе лекарств для 34 видов рака. →
OpenAI опубликовала кейс о дата-платформе Hex: с моделью GPT-6 Astra её агенты не только считают, но и оценивают, отвечает ли результат на реальный вопрос бизнеса, а затем оформляют его в интерактивные визуализации. →
The Verge·🔥67Рейтинг ИИтог67Влияние68Новизна55Релевантность88Неожиданность42Участники72Достоверность80
Джонатан Кантер, бывший глава антимонопольного управления Минюста США, в подкасте Decoder объяснил, почему ИИ-лабораториям не нужно освобождение от антимонопольных законов ради координации по безопасности, вместо иммунитета он предлагает ответственность за вред от их продуктов. →
Исследователи представили PANORAMA, модель, которая описывает и передний план, и фон изображения, привязывая каждую фразу описания к точным пиксельным маскам; вместе с ней вышли бенчмарк PanoCaps и метрика gPQ для оценки таких моделей. →
The Verge·🔥66Рейтинг ИИтог66Влияние60Новизна50Релевантность80Неожиданность65Участники80Достоверность80
Согласие ИИ-индустрии по регулированию продержалось меньше недели: Meta, Илон Маск и глава Nvidia Дженсен Хуанг заблокировали идею независимого регулятора, а администрация Трампа назвала разговоры о рисках ИИ «обманом», OpenAI и Anthropic по-прежнему настаивают на правилах. →
Ars Technica·🔥66Рейтинг ИИтог66Влияние65Новизна62Релевантность85Неожиданность52Участники55Достоверность82
Федеральное управление гражданской авиации США (FAA) готовит систему SMART, ИИ-инструмент стоимостью $875 млн, который начнёт советовать авиадиспетчерам, как разгружать воздушное движение над тремя крупными аэропортами Вашингтона, а затем должен охватить всё воздушное пространство страны. →
Автор блога показывает: если просить ChatGPT не «постер для ярмарки», а конкретный стиль, Баухаус, ризографию, японский минимализм,, вместо приевшегося однотипного вида получаются разные, непохожие афиши. По следам поста он собрал каталог из ста таких стилей с готовыми промптами и примерами картинок. →
Новый способ дообучения ActObs учит ИИ-агента предсказывать не только собственные действия, но и наблюдения среды, это меняет его поведение при обучении с подкреплением (RL) и повышает результаты на тестах по коду. →
The Decoder·🔥65Рейтинг ИИтог65Влияние65Новизна58Релевантность90Неожиданность58Участники35Достоверность78
К дедлайну ICLR 2027 подано около 50 000 тезисов докладов, против примерно 19 500 годом ранее. Рост связывают с хайпом вокруг ИИ и с тем, что языковые модели сильно ускоряют написание статей. →
Cloudflare показала Quick Tunnels, способ одной командой открыть локальный сервер во внешний интернет через свою edge-сеть, без аккаунта и настройки DNS. →
Независимый бенчмарк Brood War Bench столкнул ИИ-агентов на базе Codex Astra, Grok 4.6, Claude Fable и Opus 5 в классической RTS StarCraft: Brood War. Codex Astra выигрывает стабильнее остальных, но ни один агент не поднялся выше уровня новичка. →
Открытый проект Cua представил CUA-S1, семейство небольших специализированных моделей для быстрых, ограниченных по объёму решений при управлении компьютером; первая версия занимается заполнением форм, веса модели выложены отдельно на Hugging Face. →
The Register·🔥57Рейтинг ИИтог57Влияние42Новизна38Релевантность87Неожиданность47Участники88Достоверность78
Anthropic добавила в Claude Code поддержку AGENTS.md, формата файлов-инструкций для ИИ-агентов, который продвигает OpenAI,, чтобы разработчикам не приходилось вести два набора таких файлов для разных инструментов. →
The Verge·🔥55Рейтинг ИИтог55Влияние42Новизна38Релевантность88Неожиданность42Участники72Достоверность82
ИИ-ассистент Muse от Meta не смог связно объяснить, откуда он знает содержание сообщений пользователя в Mac-приложении, а разработчик компании признал: ассистент неверно описал собственные возможности. →
The Register·🔥54Рейтинг ИИтог54Влияние50Новизна35Релевантность90Неожиданность30Участники60Достоверность70
Два венчурных инвестора, Мэтт Хартман из Merlin Group и Тодд Грэм из фонда Microsoft M12, заявили The Register, что провалы в защите ИИ-агентов открывают многомиллиардную нишу для стартапов: идентичность для агентов, контроль доступа и защита конечных точек. →
Simon Willison·🔥54Рейтинг ИИтог54Влияние40Новизна55Релевантность85Неожиданность25Участники60Достоверность78
Claude Code с версии 2.1.277 читает AGENTS.md, если в папке проекта нет CLAUDE.md, это первый встроенный «мод», обкатывающий будущий механизм кастомизации инструмента. →
Исследователи описали системный сбой критика в PPO, алгоритме обучения с подкреплением для языковых моделей: критик перестаёт отслеживать резкие изменения ценности состояний. Для борьбы с ним предложен метод SP³O, размечающий лишь несколько состояний в каждом ответе. →
Новая архитектура JEPA-Anything учится предсказывать будущее сразу в семи разных областях, от зрения до молекулярной динамики, по единому принципу, а не отдельной моделью под каждую задачу. →
The Register·🔥53Рейтинг ИИтог53Влияние55Новизна40Релевантность85Неожиданность50Участники15Достоверность55
Некоммерческая организация Basel Action Network (BAN) подсчитала: если считать не только серверы и GPU, а всю инфраструктуру дата-центров, электронных отходов от ИИ-индустрии за 2025, 2050 годы наберётся на цепочку из контейнеров вокруг Земли шесть раз. →
OpenAI выпустила «Австралийскую дорожную карту безопасности молодёжи», план защиты подростков при использовании ИИ, построенный на шести направлениях, включая проверку возраста и родительский контроль. →