Тема: Исследования
1268 материалов · страница 20 из 26
- Claude Fable 5 обошёл GPT-5.6 Sol в тесте на NP-трудной задаче: режим /goal почти не помог
- AMA: 61% врачей США боятся роста отказов в страховых выплатах из-за ИИ
- VentureBeat: 57% компаний столкнулись с ошибками ИИ-агентов из-за плохого контекста
- Статические деревья поиска: бинарный поиск ускорили в 40 раз
- MultiRef-Compass: бенчмарк для генерации аудио-видео по нескольким референсам
- LongStraw: RL-обучение ИИ-агентов на контексте свыше 2 млн токенов при фиксированном бюджете GPU
- Исходный код ELIZA, первого чат-бота, нашли в архивах MIT
- Доклад «State of Open Source AI»: открытые модели обогнали закрытые по трафику
- Ян Лекун: LLM не дорастут до человеческого интеллекта, ставка смещается на мировые модели
- Учёные предложили трёхуровневую архитектуру обучения для роёв дронов-спасателей
- Учёные Northwestern создали дрон Phantom Twist, почти невидимый в полёте
- SEED: новый метод обучения ИИ-агентов извлекать уроки из своих же попыток
- Qwen2.5-Coder и Qwen3: промежуточное дообучение подняло точность кодовых агентов на SWE-Bench
- MetaView, синтез новых ракурсов сцены по одному фото
- IMEX, метод, объясняющий предсказания ИИ-моделей через взаимодействия признаков
- HG-RAG: иерархический обход графов знаний точнее плоского RAG
- Harness Handbook: способ быстрее находить нужный код при правке ИИ-агентов
- GPT-4o, Gemini 2.5 Pro и Qwen3-VL по-разному теряют устойчивость при повторных вопросах
- Xiaomi представила Robotics-U0, модель генерации видео для роботов, занявшую 1-е место в World Arena
- SynthDocBench выявил слабые места VLM в длинных документах
- Соавтор Face ID привлёк $52 млн на нейросеть для диагностики мозга по ЭЭГ
- SearchGen-Bench вскрыл провал ИИ-генераторов изображений на новых фактах
- Ring-2.5-1T-Zero: нейросеть на триллион параметров научилась рассуждать без разметки человеком
- PolicyShiftGuard: ИИ-модель научили применять разные политики модерации изображений
- Патентное право ЕПВ заставляет детекторы ИИ-текста путать людей с нейросетями в 60, 80% случаев
- OriginBlame точно находит данные для удаления из ИИ-моделей
- Новый метод дообучения ИИ на порядки снижает углеродный след
- KnowAct-GUIClaw обошёл GPT-5.5 в тесте на управление смартфоном
- Исследователи предложили SpectraReward, метод оценки для дообучения text-to-image моделей без готовых наград
- ИИ уступает годовалому ребёнку: Meta и Стэнфорд представили тест EgoBabyVLM
- GPT-5.6 Sol Pro опровергла 30-летнюю гипотезу статистики за 90 минут
- Google объяснила математику «творчества» диффузионных моделей
- Generative SNUPI: нейросеть проектирует ДНК-оригами по эскизу
- FixItFlow ускорил устранение облачных инцидентов в 2,3 раза с помощью ИИ
- «Бросок решает прицел»: эссе сравнивает LLM с героем блюз-песни D-A-D
- Учёные обучили нейросети без «взгляда в будущее»: качество почти как у Gemma-3-4B и LLaMA-7B
- StudioRecon восстанавливает 4D-сцены с людьми по редким камерам
- Qwen3-1.7B прокачали с 48% до 58% на AIME 2024 RL-сигналом от слабой модели
- PsiQuantum готовит гигантский квантовый компьютер на фотонах
- Проект Star Fleet Math на GPT-5.6 решил две задачи Эрдёша с помощью до 20 параллельных агентов
- Крупные языковые модели не справляются с переводом в Брайль
- Исследователи нашли утерянный код чат-бота ELIZA, и разгадали, почему мы доверяем ИИ свои секреты
- G-SHARE: ИИ находит человеческий фактор в отчётах АЭС
- Энтузиаст воссоздал JEPA-архитектуру Лекуна и обучил её на Super Mario Bros, предсказывает игру, но не проходит
- БМР зафиксировал переход ИИ-инвестиций с денежных потоков на долг
- Бенчмарк CANDI-QA показал слабость ИИ-моделей в медицине и финансах
- Anthropic нашла новое окно во «внутренние мысли» Claude
- Учёные создали сверхсплав, который вдвое прочнее стали
- Профессор Принстона Аравинд Нараянан: работу у нас не заберут, но изменят до неузнаваемости
- Новое исследование: рекурсивное самоулучшение ИИ пока не наступило, нужно 15%, есть 9%