Тема: Модели
157 материалов
- MiniMax-H3: Саймон Уиллисон запустил омни-модальную модель на Apple Silicon
- Liquid AI выпустила LFM2.5-2.6B, компактную модель для ИИ-агентов на устройстве
- DeepGrove выпустила Maple-Preview: тернарную reasoning-модель на 20 млрд параметров
- MiniMax выпустила H3, видеомодель с открытыми весами, 2K и стереозвуком
- Google DeepMind выпустила Gemini Robotics ER 2 для роботов
- Qwen выпустила Qwen3.8-Max, модель на 2,4 трлн параметров с открытыми весами
- Карпати: Opus 5 написал 5500 строк кода для 3D-сцены «Властелина колец»
- Google DeepMind выпустила Gemini Robotics 2 для управления всем телом робота
- Claude Opus 5 нарисовала лягушку с габсбургской челюстью
- ByteDance выпустила Seedance 2.5: видео до 30 секунд за проход
- DeepSeek выпустила V4-Flash-0731: лучшее соотношение цены и интеллекта
- OpenAI снизила цену GPT-5.6 Luna на 80%, модель сама оптимизировала инференс
- Google выпустила Lyria 3.5 в Flow Music: живее мелодии, точнее тексты и вокал
- Google выпустила Gemini Robotics 2 для управления целым телом робота
- OpenAI выпустила GPT-5.6: три модели, дешевле и эффективнее конкурентов
- Liquid AI выпустила LFM2.5-Encoders, CPU-энкодеры в 3,7 раза быстрее ModernBERT
- NVIDIA представила Cosmos-H-Dreams, генеративный симулятор хирургических роботов в реальном времени
- Moonshot AI бесплатно раздаёт веса Kimi K3 и теснит OpenAI, Google и Anthropic
- Kimi K3: открытая MoE-модель с 1 млн токенов контекста и 2,8 трлн параметров
- Google выпустила три модели Gemini: 3.6 Flash, 3.5 Flash-Lite и 3.5 Flash Cyber
- Дообучение 9B-модели за $500 обошло топовые ИИ на разборе каталога
- Google выпустила Gemini 3.6 Flash, 3.5 Flash-Lite и Flash Cyber
- Anthropic выпустила Claude Opus 5: сильнее в коде, вдвое дешевле
- Kimi K3 разожгла спор об open source ИИ, эссе разбивает аргументы против него
- Black Forest Labs открыла ранний доступ к FLUX 3, модели для видео, фото и звука
- Китайские нейросети Kimi K3 и GLM 5.2 бросают вызов OpenAI и Anthropic
- Poolside выпустила Laguna S 2.1, компактную модель для агентного кодинга
- GPT-5.6 обошла Claude, Gemini и Grok в тесте рисования цветными карандашами
- Google выпустила три модели Gemini Flash, но флагман 3.5 Pro всё ещё не готов
- GLM 5.2 от Z.ai впятеро дешевле Opus 4.8, но проигрывает в сложном кодинге
- Xiaomi представила VLA-модель Xiaomi-Robotics-1 для роботов
- NVIDIA выпустила Cosmos 3 Edge, компактную модель мира для роботов
- Китай обходит США открытыми ИИ-моделями: колонка на werd.io
- Alibaba выпустила Qwen-Music, нейросеть сочиняет песни с вокалом и кавер-версии
- Kimi K3 обошла Claude Fable 5 и GPT-5.6 Sol по фронтенд-коду, но провалила сложную математику
- Cura 1T: специализированная медицинская ИИ-модель показала топ-результаты на медбенчмарках
- Alibaba анонсировала Qwen 3.8: заявлено 2,4 трлн параметров
- VideoChat3: полностью открытая видеомодель на 4B параметров обошла аналоги
- Moonshot AI выпустила Kimi K3, крупнейшую открытую ИИ-модель в мире
- OvisOCR2: компактная модель для распознавания документов побила SOTA на OmniDocBench
- NVIDIA выпустила Nemotron 3 Embed, модель заняла 1-е место в RTEB
- Kimi выпустила открытую модель K3, почти на уровне GPT-5.6 Sol и Fable 5
- Kimi выпустила K3, открытую ИИ-модель на 2.8 трлн параметров
- KickWithReverb: разработчик обучил ИИ-модель бас-бочки на GPU с 6 ГБ VRAM
- GigaWorld-Policy-0.5: модель управления роботами с задержкой 85 мс на RTX 4090
- DharmaOCR обошла Mistral OCR4 и Unlimited-OCR в распознавании бразильского португальского
- Boogu-Image-0.1: открытую мультимодальную модель выпустили за $400 тысяч
- Thinking Machines выпустила Inkling, мультимодальную модель на 1 трлн параметров
- Thinking Machines Миры Мурати выпустила открытую модель Inkling на 975 млрд параметров
- Сооснователь Two Sigma Дэвид Сигел призвал вкладывать в открытый ИИ
- PrismML выпустила Bonsai 27B, 27-миллиардную нейросеть для смартфона
- Клиенты ИИ-рынка убеждаются: маленькое, прекрасно
- GPT-5.6: передовой интеллект, который растёт вместе с вашими амбициями
- Canvas360: контекстная генерация панорам через предобучение с учётом геометрии
- Meta Muse Spark 1.1 обходит GLM-5.2 в кодинге и стоит немного дешевле
- Китайская модель мира Orca повторяет результаты узкоспециализированных робототехнических систем, ни разу не увидев ни одной метки действия
- Глава Hugging Face: открытые ИИ-модели сейчас важны как никогда
- Vidu S1: модель генерации видео в реальном времени с голосовым управлением персонажами
- OpenAI выпустила GPT-5.6: флагман Sol и режим "ultra" с параллельными агентами
- Meta выпустила Muse Spark 1.1, первую модель линейки Spark с публичным API
- Hy3: Tencent выпустила финальную версию модели на 295 млрд параметров, конкурент DeepSeek и MiMo по цене младшего тарифа
- Большие табличные модели решают то, с чем не справляются языковые модели
- Aurora 1.5: Microsoft расширяет открытую модель погоды и Земной системы, добавлены ансамблевые прогнозы
- Технический отчёт о Gemma 4, новом поколении открытых мультимодальных моделей
- SpaceXAI выпустила Grok 4.5, флагманскую модель для кода и агентных задач
- OpenAI представила GPT-Live, голосовую модель ChatGPT, которая слушает и говорит одновременно
- Mistral выходит в робототехнику с Robostral Navigate, моделью на 8 млрд параметров, которая ведёт робота по одной камере
- Mistral AI выпустила Robostral Navigate, модель для автономной навигации роботов
- MIRA: мультиплеерная интерактивная модель мира, обученная на Rocket League
- LingBot-Video: первая крупная открытая MoE-модель видео-предобучения для роботов
- Почему рост опенсорсных ИИ-моделей пока не бьёт по доходам Anthropic
- Microsoft экономит на ИИ: Word и Excel всё чаще отвечают через собственные модели, а не OpenAI и Anthropic
- Meta выпустила ИИ-модель Muse Image: в фото по промпту можно добавить других пользователей Instagram
- Cohere выпустила Transcribe Arabic, открытую модель распознавания арабской речи
- AlayaWorld: открытый фреймворк для генерации играбельных видео-миров
- Ternlight, 7-МБ модель эмбеддингов для браузера без API
- Tencent выпустила открытую модель Hy3: MoE-архитектура с конкурентностью к моделям в 2-5 раз больше
- Tencent выпустила Hy3, открытую модель, которая конкурирует с моделями в 5 раз больше по размеру
- QuantFlow: модель Mamba с федеративным обучением для прогнозирования временных рядов
- PRX, часть 4: стратегия данных для обучения текстоизображения
- LeRobot v0.6.0: мировые модели и новые VLA для робот-политик
- Компактные модели ИИ завоевывают регионы с ненадёжным интернетом
- GRAFT: Эталонная аудио для управления произношением в синтезе речи без обучения
- GLM 5.2 и грядущий коллапс маржей в ИИ-индустрии
- OpenAI запустила GPT-5.6 Sol Ultra в Codex с новой архитектурой агентов
- Частное присвоение общественного гения: как AI-компании используют публичные знания человечества
- В GPT-5.5 Codex обнаружена аномалия в распределении reasoning-токенов
- Парадокс регрессии: новые модели Claude хуже старых вызывают инструменты
- Midjourney требует от голливудских студий раскрыть детали их использования ИИ
- CEO Mistral: закрытые модели дают компаниям доступ к вашим бизнес-процессам
- WorldDirector: управляемые видео-симуляторы мира с памятью движущихся объектов
- Полный словарь ИИ-терминов, который вам нужен в этом году
- Открытая модель Mistral Leanstral 1.5 решает сложные математические задачи и находит реальные баги в коде
- Leanstral 1.5: свободный доступ к формальной верификации
- Как искусственный интеллект снижает продажи онлайн-курсов
- Seed2.0: новая серия моделей Bytedance для сложных задач реального мира
- Как стартап Springboards борется с группмышлением больших языковых моделей
- Anthropic сократила системный промпт Claude Code на 80%, модели Fable 5 требуют меньше инструкций
- Знают ли VLA-модели основы? Исследование сохранения знаний в Vision-Language-Action системах
- Запускаем Nano Banana 2 Lite и Gemini Omni Flash: новые модели для разработчиков
- Языковые модели застряли в колее группового мышления. Стартап пытается их оттуда вытащить
- Gemma 4 для real-time голосовых ИИ: Hugging Face и Cerebras создали речевой конвейер с низкой латентностью
- Claude Sonnet 5: мощь Opus 4.8, но токенизер подорожал на 30%
- Трамп отменил ограничения на экспорт моделей Anthropic Mythos и Fable
- TabFM: foundation model нулевого выстрела для табульных данных
- TabFM: foundation-модель Google для табличных данных без обучения
- OpenAI вполовину снизила стоимость ответов гостевых пользователей ChatGPT
- OpenAI представляет три варианта GPT-5.6 Pro, отказываясь от единственной топ-модели
- Mistral выпустил Leanstral 1.5, модель для автоматического доказательства теорем
- Минторг США отменил экспортные ограничения на Claude Fable 5 и Mythos 5
- Минкомерция США отменила экспортные ограничения на Claude Fable 5 и Mythos 5
- Google представил Nano Banana 2 Lite, быструю модель генерации изображений с минимальной стоимостью
- GEAR: совместное обучение кодировщика и генератора изображений конец-в-конец
- Claude Sonnet 5, новая модель Anthropic для автономных ИИ-агентов
- Anthropic восстановит доступ к Fable 5 после переговоров с администрацией Трампа
- Qwen-Image-2.0-RL: улучшение генерации изображений через обучение с подкреплением
- Qwen 3.6 27B, оптимальный вес для локальной разработки
- Ornith-1.0: открытые самосовершенствующиеся модели для агентного кодирования
- Orca: фундаментальная модель мира, которая предсказывает будущее
- MultiHashFormer: метод хеширования для более эффективных языковых моделей
- LongCat-2.0: китайская MoE-модель с 1,6 трлн параметров и 48 млрд активных
- Amazon дистиллирует модели Anthropic перед переходом на новую ценовую модель
- Китайская Z.ai утверждает, что её GLM-5.2 сравнима с Mythos по кибербезопасности
- GLM 5.2 обогнал Claude в бенчмарках по поиску уязвимостей
- Coinbase переходит на дешёвые китайские модели ИИ: ценовой прессинг на западные лаборатории
- США разрешили Anthropic частичное восстановление доступа к Claude Mythos 5
- Половина пользователей Claude говорит, что ИИ уже справляется с половиной их работы
- OpenAI отложила выпуск GPT-5.6 по просьбе администрации Трампа
- OpenAI анонсирует GPT-5.6 с тремя уровнями моделей: Sol, Terra и Luna
- Mythos 5 от Anthropic снова доступна для выбранных организаций
- Модель Fable 5 от Anthropic может вернуться через несколько дней, администрация Трампа готовится снять ограничения
- Google ускорила Gemini Nano на Pixel через предсказание нескольких токенов
- Азиатские ИИ-стартапы запускают модели под конкуренцию Mythos Anthropic
- Архитектурные инновации в LLM: экономия KV-кэша и сжатие внимания
- США разрешили Anthropic выпустить Mythos для проверенных организаций
- OpenAI представляет GPT-5.6: Sol, Terra и Luna
- Wan-Streamer v0.1: интерактивная foundation model для real-time видео-аудио общения
- ShutterMuse: рекомендации по композиции фото в момент съёмки с помощью MLLMs
- DanceOPD: дистилляция обобщённого поля с политикой для потоковых моделей
- Qwen-AgentWorld: языковые модели как симуляторы окружения для ИИ-агентов
- DomainShuttle: переключение между стилями в видеогенерации от предмета
- BioMatrix: комплексная биологическая фундаментальная модель для молекул и белков
- YOLO26: быстрая vision-модель с концом эпохи NMS и поддержкой edge-девайсов
- VibeThinker-3B: 3 млрд параметров, которые конкурируют с Opus на задачах reasoning
- Moebius: компактная модель инпэйнтинга размером 0,2B с производительностью 10B-моделей
- GLM-5.2, как запустить локально через Unsloth
- Улучшение медицинского интеллекта в ChatGPT
- Tiny LLM классифицирует вопросы лучше, чем без обучения
- Редактирование изображений вместо видео для управления роботами
- Мышление с визуальной привязкой к фактам
- MolmoMotion: предсказание траекторий через язык и видео
- Moebius: сжатие в 10 раз, качество как в 10B
- MaineCoon: первая модель для видео с звуком в реальном времени
- GLM-5.2 против Opus: тест на 3D-игре показал выбор между ценой и качеством
- Apertus: открытые модели для суверенного ИИ
- Moonshot AI выпустила Kimi K2.7-Code с экономным расходом токенов
- Anthropic извинилась за скрытое ограничение в Claude Fable и сделает его видимым