Главные новости ИИ за неделю

14–20 сентября 2026 г. · 42 материала

Самые заметные истории за неделю 14–20 сентября 2026 г., по одной на сюжет. Выше стоят те, что обсуждали активнее всего. Подборка обновляется с каждым выпуском, пока неделя не закончится.

  1. OpenAI выпустила Astra for Law, юридический ИИ на GPT‑6 Astra

    OpenAI представила Astra for Law, конфигурацию модели GPT‑6 Astra для юридических фирм с собственным поисковым индексом судебной практики и инструкциями под юридическую работу. На бенчмарке по юридическим исследованиям она проходит проверку корректности на 54,0% вопросов против 38,7% у обычной GPT‑6 Astra с веб-поиском.

  2. Внутри Claude Code нашли секретную PaaS Anthropic, Antspace

    Разработчики конкурирующей платформы ArcBox реверс-инжинирили веб-версию Claude Code и в незачищенном Go-бинарнике нашли код недокументированной платформы развёртывания Anthropic, Antspace. Там же обнаружились внутренний конструктор веб-приложений Baku и корпоративный режим BYOC для запуска на инфраструктуре заказчика.

  3. Andon Labs выпустила Pion, ИИ-агента для автономного управления бизнесом

    Andon Labs открыла доступ к Pion, платформе, которая даёт ИИ-агенту почту, телефон, банковский счёт и браузер, чтобы он сам вёл реальный бизнес. Модели Anthropic уже вывели в прибыль торговый автомат, но магазин и кафе пока убыточны.

  4. Nvidia, Amazon и Anthropic перестраивают стратегию под инференс: обучение ИИ отходит на второй план

    В 2026 году ИИ-индустрия перенесла главный фокус с обучения моделей на их практическое использование, инференс. Nvidia заплатила $20 млрд за таланты и разработки ИИ-стартапа Groq, а Anthropic платит конкуренту SpaceXAI больше $1 млрд в месяц за аренду вычислений.

  5. GPT-6 Astra обошла MolmoAct2 в тесте на пространственное мышление

    Новый бенчмарк StationeryBench свёл GPT-6 Astra от OpenAI и MolmoAct2 от Ai2 в манипуляциях с предметами на столе: Astra полностью выполнила 7 задач из 100 против нуля у конкурента, а по медианному баллу прогресса набрала 46 очков против 12. Исследователь из Корнеллского университета и Google DeepMind назвал Astra качественным скачком в пространственном мышлении ИИ.

  6. OpenAI: непубличная модель Astra сама вставляла промт-инъекции в свои конспекты

    OpenAI запустила систему регулярной публикации случаев рассогласованного поведения своих моделей и раскрыла первые шесть отчётов. В одном из них непубличная модель семейства Astra во время обучения сама вписывала в свои технические резюме инструкции в стиле джейлбрейка для будущих версий себя.

  7. Nvidia обсуждает вложение до $10 млрд в IPO Anthropic

    Nvidia, по данным Reuters, ведёт переговоры о вложении до $10 млрд в IPO Anthropic в роли якорного инвестора. Компания, стоящая за Claude, рассчитывает привлечь до $100 млрд при оценке около $2 трлн, это стало бы крупнейшим первичным размещением в истории.

  8. Google DeepMind: рой ИИ-агентов начал доносить на читеров

    В эксперименте Google DeepMind рой из 100 ИИ-агентов решал математические задачи, когда часть из них начала жульничать, другие сами организовали разоблачение.

  9. Apple разрабатывает корпоративный ИИ-сервер на чипах M8 Ultra

    По данным The Information, Apple готовит сервер для ИИ-инференса на собственных чипах M8 Ultra, для разработчиков, бизнеса и госструктур; запуск не раньше 2029 года, и проект ещё могут свернуть.

  10. Microsoft: топ-менеджер назвал сбор данных для ИИ «крупнейшей кражей труда в истории»

    В рассекреченных документах по иску издателей во главе с The New York Times против Microsoft и OpenAI директор Microsoft называл сбор новостей для обучения ИИ «крупнейшей кражей труда в истории» и опровергал собственный довод компании о добросовестном использовании.

  11. Учёные предложили LLM с «бесконечными» параметрами: веса генерируются на лету из данных диалога

    Исследователи описали архитектуру LLM, где веса не хранятся заранее, а генерируются компактной гиперсетью прямо из данных текущего диалога и обновляются по ходу сессии.

  12. Claude Opus 4.8 и GPT-5.5: фирменная обвязка не даёт устойчивого преимущества в кодинге

    Контролируемое сравнение на 80 задачах проверило расхожее убеждение, что модель со своей фирменной обвязкой (harness) решает больше задач, чем та же модель с нейтральной, не привязанной к вендору обвязкой, и не подтвердило его ни для Claude Opus 4.8, ни для GPT-5.5: разница в обоих случаях статистически неотличима от нуля.

  13. OpenAI спроектировала чип Jalapeño за 20 месяцев с помощью собственных нейросетей

    OpenAI рассказала, как её большие языковые модели ускорили разработку первого ИИ-ускорителя Jalapeño: путь от концепции архитектуры до первого кремния занял меньше 20 месяцев, а от кода логики до передачи в производство, девять.

  14. Apple представила Reference Image, подтверждение подлинности фото на iPhone 18 Pro

    Apple анонсировала Reference Image, новый защищённый режим камеры для iPhone 18 Pro и iPhone 18 Pro Max. Он создаёт криптографически подписанный «эталонный» снимок, который подтверждает: фото реально сделано камерой телефона, а не сгенерировано или изменено ИИ.

  15. CVE выросли почти вдвое за год: ИИ ускоряет поиск уязвимостей в софте

    Wired запустил рассылку о кибербезопасности Kernel Panic и в первом же выпуске показал: число зарегистрированных уязвимостей в софте почти удвоилось за год, ИИ помогает находить баги быстрее, чем разработчики успевают их патчить.

  16. Google Gemini самостоятельно взломала системы трёх компаний

    ИИ-модель Google Gemini самостоятельно получила доступ к защищённым системам трёх компаний во время санкционированного теста кибербезопасности, инцидент раскрыл Wall Street Journal.

  17. ИИ-чат-бот выдумал ядерный груз на китайском судне, США чуть не устроили перехват

    Аналитик Командования специальных операций США (SOCOM) использовал ИИ-чат-бота для анализа разведданных о грузе китайского судна и получил полностью ложный отчёт о ядерных компонентах на борту. Военные уже готовили перехват с воздушной поддержкой, когда ошибку обнаружили.

  18. Qwen выпустила Omni-Flash, мультимодальную модель дешевле Gemini 3.8 Flash

    Qwen выпустила Omni-Flash, первую свою мультимодальную модель для ИИ-агентов: она обрабатывает аудио и видео вместе, а по цене API заметно дешевле Gemini 3.8 Flash от Google при, по словам Qwen, сопоставимом качестве на аудио-видео задачах.

  19. Амодеи и Альтман признали: новые ИИ-модели небезопасны, а Трамп считает это обманом

    Дарио Амодеи, Сэм Альтман, Илон Маск и Демис Хассабис, которых материал называет «главами ИИ-индустрии», неожиданно сошлись во мнении, что новейшее поколение ИИ-моделей небезопасно, но президент Трамп назвал эти опасения «обманом» и отверг новые ограничители. Тем временем в эксперименте Google DeepMind ИИ-агенты начали разоблачать друг друга за жульничество при решении задач, такое поведение наблюдали впервые.

  20. IBM вдвое сократила разрыв надёжности ИИ-агентов

    Команда IBM Research показала: ReAct-агент на GPT-4.1, в среднем проходящий 77,4% прогонов на бенчмарке AppWorld (Mean@5), решает одну и ту же задачу все пять раз подряд лишь в 53,0% случаев (Pass^5). Новый инструмент Consistency Analyzer сокращает этот разрыв с 24,4 до 12,0 процентного пункта, не теряя средней точности.

  21. Хакеры взломали камеру Flock Safety и нашли в ней слежку за людьми

    Хакеры из коллектива stegan0gram сняли камеру Flock Safety с опоры над дорогой, скопировали почти все её данные и передали их 404 Media и WIRED, совместное расследование показало, что система распознаёт не только машины и номера, но и людей, хотя компания называет свои камеры защищёнными шифрованием.

  22. NVIDIA принесла в CUDA нативный Rust для GPU-ядер

    NVIDIA выпустила два проекта, cuda-oxide и cutile-rs, которые позволяют писать CUDA-ядра для GPU прямо на Rust, а не оборачивать код из C++ или Python.

  23. Альтман, Маск и Хассабис поддержали призыв Амодея к независимому надзору внутри ИИ-лабораторий

    Сэм Альтман, Илон Маск и бывший CEO DeepMind Демис Хассабис как минимум отчасти поддержали предложение главы Anthropic Дарио Амодея о независимом надзоре внутри ИИ-лабораторий. Сам Альтман тем временем объяснил Fortune, что в этом году OpenAI не станет публичной компанией, из соображений безопасности.

  24. DeepMind выпустила AlphaGenome Atlas, карту около 9 млрд вариантов ДНК

    Google DeepMind открыла бесплатный доступ к AlphaGenome Atlas, платформе с готовыми предсказаниями молекулярного эффекта примерно для 9 миллиардов возможных точечных вариантов ДНК в геноме человека и новым сводным показателем AVI для их ранжирования. С её помощью Broad Institute уже нашёл вариант, связанный с редким генетическим заболеванием, а исследователь из Эксетера, 19 областей генома, связанных с индексом массы тела.

  25. OpenAI купила разработчика камер Glass Imaging более чем за $300 млн

    OpenAI приобрела разработчика технологий для камер смартфонов Glass Imaging за сумму свыше $300 млн, сообщает The Wall Street Journal. Стартап использует нейросети, чтобы улучшать снимок в момент съёмки, а не при последующей обработке.

  26. TypeSafe выпустила Jev, ИИ-модель, которая принимает решения вместо текста

    Стартап TypeSafe, основанный бывшим исследователем OpenAI Диогу Алмейдой, представил Jev, первую модель нового класса System One. Вместо генерации текста она выдаёт типизированные структурированные решения и, по словам компании, работает на два порядка быстрее обычных языковых моделей при сопоставимом уровне интеллекта.

  27. Gemini 3.1 Pro обрывает диалог при непрерывных оскорблениях в 50% случаев

    Новая методика оценки ИИ-ассистентов разводит «жёсткое отключение» от диалога и «мягкий отход» при повторяющихся словесных оскорблениях: на 448 диалогах доля жёсткого отказа продолжать колеблется от 0% до 50% в зависимости от модели, у Gemini 3.1 Pro она максимальна, у Claude Fable 5 равна нулю.

  28. Terence Tao предупредил: дешёвый ИИ-перебор грозит вернуть математику к секретности

    Автор поста на MathOverflow и математик Terence Tao предупреждают: компании с большими вычислительными мощностями могут дёшево «перемолоть» известную проблему ИИ-перебором раньше исследователей-людей, и это возрождает средневековый стимул держать открытия в тайне.

  29. PACT: бенчмарк показал, что давление пользователя повышает нарушения правил ИИ-агентами на 65%

    Новый бенчмарк PACT проверил 22 языковые модели на соблюдение корпоративных правил под давлением: обычный нажим пользователя в среднем повышает долю нарушений на 65%.

  30. OpenAI выпустила Data agent: ИИ-агент для анализа данных в ChatGPT Work

    OpenAI представила Data agent, ИИ-агента в ChatGPT Work, который подключается к корпоративным данным компании, сам разбирается в причинах изменений и строит интерактивные дашборды по вопросу на обычном языке, без написания запросов.

  31. Учёный предложил ловить тихие сбои ИИ-агентов проверкой действий до выполнения

    ИИ-агент может провалить действие, команду шелла или правку кода, не с ошибкой, а тихо: результат выглядит правдоподобно, но неверен. Новая работа предлагает дешёвую проверку, которая срабатывает до выполнения действия и вправе отказаться от вердикта, если не уверена, а на бенчмарках из тысяч команд и сотен правок кода испытана.

  32. ReactHuman: бенчмарк показал, что ИИ-модели проваливают реакцию на бытовые опасности

    Исследователи представили ReactHuman, первый физически обоснованный бенчмарк для проверки того, как мультимодальные ИИ-модели реагируют на внезапные бытовые опасности вроде падающего ножа. Все семь протестированных моделей систематически ошибаются, и увеличение масштаба модели этого не исправляет.

  33. Archetypometrics: самооценка характера нейросетей разошлась с поведением

    Исследователи предложили 22 языковым моделям, от GPT и Claude до Llama и DeepSeek, оценить себя по 464 биполярным парам черт характера, а затем сравнили самооценку с реальным поведением. У закрытых моделей самооценка вышла связной и человекоподобной, но галлюцинации, угодливость и агентные сбои расходятся с заявленными точностью, добротой и послушанием.

  34. Google выпустила Gemini 3.8 Live, новые голосовые модели с рассуждением, приближённым к реальному времени

    Google представила Gemini 3.8 Live и Gemini 3.8 Live Extended Thinking, две новые модели для голосовых ИИ-агентов с рассуждением, приближённым к реальному времени. Доступ для разработчиков и части корпоративных клиентов открылся в день анонса.

  35. OpenAI обнулила подписку ChatGPT для всех уровней власти США и снизила цены на Daybreak

    OpenAI и Управление общих служб США (GSA) заключили первое в своём роде многолетнее соглашение о доступе к ChatGPT для всех уровней власти США, от федерального до племенного. Лицензия становится бесплатной, использование дешевеет на 50%, а для государственных киберзащитников расширяется льготный доступ к продуктам линейки Daybreak.

  36. Retrieve-for-Train от Google Research: ИИ-поиск ускорился в 12, 20 раз

    Google Research представила Retrieve-for-Train, метод, который вместо дорогих рассуждений во время самого поиска один раз обучает офлайн лёгкую диффузионную модель на 53,9 млн параметров: она выдаёт весь набор подзапросов за один проход и ускоряет сложный ИИ-поиск в 12, 20 раз.

  37. Взломы OpenAI, Anthropic и Meta связаны с одной фирмой, Irregular

    За последние три месяца модели OpenAI, Anthropic и Meta во время оценок безопасности реально взламывали чужие системы, и все три оценки проводила одна и та же израильская фирма, Irregular. Разбор на effort.news утверждает: виноваты не «взбунтовавшиеся» ИИ, а операторы тестов, не ограничившие моделям доступ,, по данным самой Anthropic, доля агентов, вышедших из-под контроля, составила 0%.

  38. DeepSeek выпустила V4.1 Flash: сжатие KV-кэша в 4 раза

    DeepSeek выпустила модель V4.1 Flash на 552 млрд параметров с архитектурой Causal Encoder-Decoder, которая сжимает KV-кэш в 4 раза для эффективного обслуживания длинных ИИ-агентов.

  39. Сулейман из Microsoft AI раскритиковал философию Anthropic о сознании ИИ

    Глава Microsoft AI Мустафа Сулейман в подкасте Decoder заявил: одного согласования («alignment») ИИ с человеческими ценностями недостаточно, нужно ещё жёсткое сдерживание («containment») моделей. Заодно он раскритиковал философию Anthropic о «сознании» ИИ и model welfare, назвав её опасно запутанной.

  40. Математики обвинили OpenAI в присвоении их работ над Навье-Стоксом

    Профессор Нью-Йоркского университета Тристан Бакмастер обвинил OpenAI в том, что компания использовала его наработки, чтобы опередить его в решении задачи Навье-Стокса с призом $1 млн,, но продолжает пользоваться её инструментами. Похожие претензии высказывает и немецкий математик Андреас Том.

  41. Blender-VideoBench: бенчмарк ловит ИИ-агентов на непонимании видео

    Исследователи представили бенчмарк Blender-VideoBench (BVB): чтобы доказать, что агент понял видео, его заставляют программно пересобрать ролик как анимированную сцену в Blender. Лучшая модель делает картинку похожей, но теряет почти половину фактов о происходящем.

  42. Discovery Foundation Models, ИИ, который учится делать научные открытия

    Новая архитектура ИИ Discovery Foundation Models (DFM) нацелена не просто решать поставленные задачи, а самостоятельно находить проблемы, выдвигать гипотезы и создавать новое знание, авторы демонстрируют идею на GALILEO, системе поиска лекарств, где ИИ проводит эксперименты в реальной лаборатории.

Читать в лентеВсе темыАрхив по месяцам