Тема: Исследования
1268 материалов · страница 9 из 26
- EchoWM, омнимодальная world model с видео, звуком и навигацией от первого и третьего лица
- Alibaba предложила ERPO, новый метод регуляризации LLM
- AION-1 путает пометку детектора с самим объектом, и это искажает красное смещение
- Wazobia Eval, первый бенчмарк для эмоций и сарказма в нигерийском пиджине
- Топовые ИИ для распознавания речи подгоняют ответы под тесты, а не под звук
- Стэнфорд выяснил: разрыв в занятости молодёжи из-за ИИ вырос до 19%
- SchemaRouter сократил токены в RAG-агентах почти в 9 раз, ускорив ответы в 2,7 раза
- ReWorld: интерактивная world model научилась помнить сцену на минуты вперёд
- OX Alpha на OpenRouter оказался GLM от Z.ai
- MobilePA-Bench, новый тест для мобильных ИИ-агентов-планировщиков
- LitReview Arena: ИИ-агенты обыгрывают человека в обзорах литературы лишь в 23% случаев
- KVBoost сократил задержку до первого токена LLM в 4,49 раза за счёт переиспользования KV-кэша
- Исследователи представили RISE, адаптивную систему планирования для беспилотных авто
- ИИ научили рисовать не пикселями, а кодом, через обучение с подкреплением
- Block3D ускорил генерацию 3D-моделей по тексту в 5,15 раза
- Агенты обучения с подкреплением научились разгадывать скрытые правила игры Game of Hidden Rules
- Языковые модели внешне не предвзяты, но внутренне сохраняют предвзятость
- Учёные научились предсказывать скорость обучения MoE-моделей на триллионах токенов без дорогого перебора
- Учёные нашли рецепт устойчивых промптов для ИИ: разброс качества в кодинге упал на 40,7%
- SDAD: новая методология сочетает спецификации и ИИ-агентов в разработке ПО
- Pew Research Center: доля ИИ-текста в сети после ChatGPT превысила треть
- OmniAssistBench: новый бенчмарк выявил слабости ИИ-ассистентов в жестах и контексте диалога
- METR обнаружила: ИИ резко ускорил обнаружение уязвимостей в 2026 году
- Метод QCCS точнее отвечает на вопросы о фактах из середины медкарт, чем поиск
- InfinityEdit научился бесконечно редактировать видеопоток
- ИИ-инструменты для кода мешают начинающим разработчикам стать опытными
- Graph Engineering: новая парадигма организует ИИ-агентов в единую систему
- EviRank, метод переранжирования изображений без обучения, показавший лучшие результаты на пяти тестах
- Дети учат язык, используя в 100 000 раз меньше слов, чем ИИ
- WithEveryone: фреймворк генерирует групповые фото с точным сохранением лиц до 10 человек
- Вышел ProgramBench Vetted, усиленный тест ИИ-агентов на реверс-инжиниринг кода из бинарника
- vLLM и Qwen3.6-27B: квантование и бэкенды меняют ответы модели
- Учёные представили DA-LeWM, модель мира ИИ, которая точнее планирует действия
- SFT и RL научили ИИ-модели рассуждать по-гречески, бенчмарки точности этого не заметили
- Резонансную статью об ущербе от изменения климата отозвали из-за странных данных по Узбекистану
- Reflect Orbital: космические зеркала засветят ночное небо на десятки километров
- Мыши сохранили память, потеряв больше половины синапсов в искусственной спячке
- Mental World Modeling научил ИИ угадывать мысли и намерения людей
- Исследователи представили VA-Judger, модель, которая оценивает генерацию видео со звуком как человек
- Исследование объяснило, почему «навыки» помогают ИИ-агентам, и когда подводят
- IAR, метод, который встраивает знания документов в нейросеть без поиска
- FlashPrefill V2 ускоряет обработку длинного контекста LLM до 47 раз
- EXIMO: трёхэтапный метод дообучения VLA-роботов при помощи VLM
- C3LM, языковая модель для ретросинтеза, обученная на 45 млн реакций
- τ_0-VLA: робот получил модель мира и «время на раздумье»
- SWE-bench Science: лучший ИИ-агент (Claude Code) решает меньше половины научных задач
- SPADE: ИИ сам придумывает себе тренировочные задачи и учится на них
- SemaPLC: агент для кода ПЛК даёт 52,2 балла по динамике на реальном контроллере против 22, 31 у аналогов
- Repo0, фреймворк для генерации кода «с нуля» с приростом до 30 процентных пунктов
- Nvidia показала: обвязка (harness) важнее модели, Claude Opus 5 дал 100% на ARC-AGI-3