Тема: Исследования
1268 материалов · страница 11 из 26
- Large Discovery Model (LDM): архитектура ИИ для научных открытий обгоняет LLM-поиск
- IBM Research: ALTK-Evolve дозирует память ИИ-агента под модель
- HarnessEval-W оценивает модели мира роем ИИ-агентов вместо балла
- GxP-Agent: агентная система на базе DAG довела Claude Sonnet 4.6 до 100% точности в данных клинических испытаний
- ASI-Bench: без помощи человека ИИ-агенты теряют почти половину результата
- Agentic ESOpt: эволюционные стратегии вместо RL дообучают ИИ-агентов с минимумом GPU-памяти
- VibeWorlding: GPT-5.5 не справился с тестом на создание 3D-миров, open-source модели обошли его
- UI-Mate: открытый ИИ-агент обновил рекорд управления компьютером
- Учёные сравнили регулирование ИИ в ЕС, США и Китае и предложили машинно-проверяемый стандарт соответствия
- SimpleOPD: метод дистилляции переносит рассуждения от SU-01 в компактные модели
- Qwen3.5-4B обогнала GPT-5.4 без учителя и разметки
- MegaParts научилась генерировать 3D-объекты из 300 деталей
- Компилятор Rust научили безопасно выгружать вычисления на GPU
- GPT-4o и Gemini 2.5-Pro провалили тест на разгадывание слов по звуку ручки
- GPT-4.1 nano умеет сомневаться в диагнозах, но путается в спорных случаях
- Google представила PhotoScan: ИИ оценивает состав тела по фото смартфона почти как DXA-сканер
- GenRouter: единый маршрутизатор для агентной генерации изображений экономит до 95% вычислений
- FPO, метод дообучения LLM без обратного прохода: ускорение в 2.7, 3.2 раза при экономии памяти
- DiG-bench: топовые ИИ-модели решают 20% сложнейших задач, люди, 100%
- Claude Code и OpenClaw: RL-метод научил ИИ-агентов работать точнее
- AxiomProver впервые формально проверил доказательство теоремы о разрыве 246
- ACID-агент обошёл Claude Code и другие ИИ-агенты на 10,6%
- UniSwap подменяет лицо и голос в видео с говорящим человеком в потоковом режиме
- Учёные: LSP редко экономит токены кодовым ИИ-агентам сильнее grep
- У языковых моделей нашли модульную архитектуру мозга, похожую на человеческую
- SELR научил ИИ объяснять свои скрытые рассуждения без отдельного декодера
- RubricForge вдвое снижает ложные зачёты у ИИ-агентов
- RA-Bench: детекторы дипфейков не справляются с видео катастроф
- Qwen3.6-35B-A3B: поздние слои MoE-архитектуры выдерживают агрессивное отключение экспертов
- OmniScientist, ИИ-учёный, который проводит эксперименты по сырым данным
- Оценка семи ИИ-агентов на 36 задачах показала: методологической новизны почти нет
- MobileMem, бенчмарк долгосрочной памяти для мобильных ИИ-агентов
- LiveAnimate: диффузионная модель анимирует человека в реальном времени
- Кембридж и NVIDIA научили ИИ-агента и его оценщика эволюционировать вместе
- Intern-S2-Mobius: новая архитектура ускорила инференс модели почти в 4 раза
- InflationAgent: маршрутизатор ИИ-агентов учитывает «инфляцию токенов»
- Google: обучение ИИ отрицать сознание меняет его взгляды на животных и религию
- Gambit ускоряет вывод рассуждающих ИИ-моделей и экономит токены
- SKILLER даёт маленьким языковым моделям агентные навыки через обучение с подкреплением на естественном языке
- OmniScientist: ИИ-учёный воспринимает сырые данные напрямую, а не их сводки
- LycheeMemory V2 экономит до 86% токенов на память ИИ-агентов
- ИИ в разработке лекарств: доказательств пользы пока мало
- ИИ превосходит математиков не мышлением, а рабочей памятью
- ИИ-агент перенёс метеомодель CReSS на GPU: 250 000+ строк и ускорение в 5,1 раза
- HPSE учит языковые модели применять новые факты при редактировании, а не только запоминать их
- H2R-Bench выявил: видеомодели мира часто не справляются с переносом манипуляций человека на роботов
- Gambit ускоряет рассуждение ИИ-моделей лучевым поиском на уровне мыслей и экономит до 68,5% токенов
- Epoch AI: каждый пятый работник в США делегирует рабочие задачи ИИ вместо коллег
- Дообучение по инструкциям меняет уверенность моделей и снижает разнообразие их рассуждений
- Context-Matched Distillation (CMD) выравнивает обучение генератора видео