Тема: Исследования
1268 материалов · страница 6 из 26
- OPD: обучение на одном примере восстанавливает основную часть эффекта обучения на всём датасете
- LatentPress: сжатие контекста нейросетей в 4, 16 раз без текстового пересказа
- HarnessDev: ИИ-агенты уже строят себе рабочую обвязку (harness), но не умеют стабильно её улучшать
- Google Research выяснила: данные европейцев помогают прогнозу риска для японцев только при малых выборках
- Google и HHMI Janelia картировали полный мозг самца дрозофилы: 166 000 нейронов и 125 млн связей
- Gated DeltaNet пережил 4-битное квантование NVFP4 без потери качества
- CORE: дистилляция риранкера научила ИИ-эмбеддинги различать похожие сцены
- Cliff: метод вознаграждает рассуждение нейросети до первой ошибки
- Claude Code, Codex и Cursor разошлись в выборе инструментов: сходятся лишь в 42% случаев
- ASPIRE: бенчмарк показал, что ИИ-агенты пока слабо самообучаются по расплывчатым целям
- AdaptiveSpec делает генерацию LLM до 56% быстрее EAGLE-3, без дообучения
- ZimaBlue поднял точность действий роботов с 36,1% до 77,8%, обучаясь на видео от первого лица
- WMLLM: агенты на LLM-модели мира добились рекорда в оптимизации молекул
- Стартап Mostik научил ИИ-модели «разговаривать» через веса, минуя текст
- SolarWM: исследователи выпустили открытую платформу для видео-моделей мира
- Сайты, которые цитирует Perplexity, сгенерировали 215 000 страниц для ИИ, а не для людей
- Qwen-Drive-1.0: новая модель объединила 3D-восприятие и планирование для беспилотных авто
- PRO-Step: метод пошаговой оптимизации вознаграждений для RAG
- Pixel Linguist II показал рекордную точность чтения текста по пикселям
- Physical Superintelligence нашла маршрут зонда к Альфе Центавра
- Nature Human Behaviour: нейросети снижают языковое разнообразие текста на 21, 50%
- Исследователи объединили 200+ корпоративных LLM-приложений в одну модель через GRPO и SLERP
- H3-World превращает видеогенератор MiniMax-H3 в модель мира, управляемую языком
- EvalDetectBench: бенчмарк ловит ИИ-модели на распознавании тестирования
- EarlyEval экономит до 44% токенов на оценке ИИ-агентов
- DisCo дистиллирует репозитории GitHub в навыки для ИИ-агентов, прирост до 134,3% на бенчмарках
- DiagEvo: языковые модели учатся на памяти своих ошибок без внешних данных
- Declarative Attention: языковые модели сами объявляют, куда «смотреть», и экономят до 52% чтения KV-кэша
- 14 причин, почему создать по-настоящему умного робота так сложно
- Учёные представили SCAFFOLD, датасет из 157 тысяч пар для обучения нейросетей читать научные диаграммы
- StudentSim обучает ИИ-симуляторов ученика точнее GPT-5.4
- SMELT сокращает до 18% вычислений при обучении MoE-трансформеров
- Qwen3.8-Flash-Next: сопоставимая точность с более крупным предшественником при вдевятеро меньших затратах на обучение
- PRISK показал: персонализация ИИ усиливает эхо-камеры и подобострастие моделей
- NoRA: нормализация LoRA ускоряет дообучение нейросетей без лишних параметров
- LightNav-0: VLM для навигации роботов показала SOTA на 10 бенчмарках
- Исследователи представили MineAmongUs, 3D-стенд для изучения лжи ИИ-агентов
- Hi-Q обошёл IRCoT и PropRAG в ответах на многошаговые вопросы
- gpt-oss-120b удержала состояние за 196 вызовов инструментов при вычислении MD5
- Google и NASA JPL представили MAPL-EMIT, нейросеть для поиска утечек метана из космоса
- GenFirst: сквозное обучение генеративных моделей без коллапса латентного пространства
- Бенчмарк DroneCATS: ИИ-дроны путают не курс, а команду «прибыл»
- AllenAI представила BenchMIRT: аудит бенчмарков ИИ на уровне отдельных вопросов
- Учёные предложили архитектуру ИИ-аналитики, которая отвечает раньше вопроса
- Топовые ИИ-модели вместе провалили 42% решений в онкологии
- Скользящее окно внимания обгоняет линейное внимание без дообучения
- Puro-2B: языковую модель обучили дешевле $6900 на игровой RTX 5090, почти на уровне Qwen2.5-1.5B
- Parallel Tube Decoding ускорил поиск объектов в видео в 79 раз
- PaperGym научил модели Qwen3 планировать научные эксперименты
- Paper Pilot: система обнулила выдуманные ссылки ИИ в тесте