Тема: Модели
254 материала · страница 2 из 6
- Thomson Reuters построила юридическую ИИ-модель Thomson на базе Qwen за $40 млн вместо аренды у OpenAI и Anthropic
- Fable: цена высока, и разработчики снова делят код между моделями
- Alibaba выпустила Wan3.0: ИИ-видео до 30 секунд из текста и документов
- OpenAI снизила цену на GPT-5.6 Sol на 20, 33%
- Liquid AI выпустила LFM2.5-DSpark: инференс ускорился до 3,2 раза
- DeepSeek выпустила V4-Flash-Vision-Exp: почти догоняет Opus 4.8 в агентных тестах
- На OpenRouter появилась анонимная модель Ox Alpha с контекстом 1M
- Microsoft выпустила Skala 1.1, более точную ИИ-модель для DFT-расчётов, шире в научном ПО
- Liquid AI выпустила DSpark: ускорение инференса LFM2.5 до 3,2 раза
- Kimi K3 и GLM-5.3 почти сравнялись с лучшими моделями Запада
- DiffusionGemma на базе Gemma 4 достигает около 1500 токенов в секунду
- Ornith выпустила Ornith-1.5, модели наравне с Claude Opus 4.8 в кодинге
- Liquid AI выпустила Q4_0-чекпоинты LFM2.5, восстановив 97% точности, потерянной при квантовании
- Qwen 3.8 27B набрала 52 балла в бенчмарке, вровень с моделями крупнее в разы
- GPT-5.6 сделала скачок в компьютерном зрении, но проигрывает Gemini 3.5 Flash по цене
- Датские учёные выпустили Mimir v1, модель на 1 млрд параметров на легальных данных пост-обучения
- Qwen 3.8 27B: отличная модель, но с чрезмерным рассуждением по умолчанию
- OpenAI представила Ultrafast: GPT-5.6 Sol отвечает в 14 раз быстрее
- Hugging Face: китайские лаборатории обошли США по размеру открытых моделей, Qwen стал ядром экосистемы
- Google выпустила Gemini 3.7 Flash: лучше кодит и дешевле
- Anthropic раскрыла уровень моделей Mythos выше Claude Opus 5
- Стелс-модель big-pickle обошла всех, кроме Claude, в тесте SWE Atlas на понимание кода
- Qwen выпустила Qwen3.8-27B: компактная модель с изображениями и видео
- Meta выпустила открытую модель Glimmer, и назвала ИИ «для всех», хотя Muse Spark остаётся закрытой
- Hugging Face: Qwen стал базовой моделью открытого ИИ-сообщества
- Z.ai выпустила GLM-5.3: заметно сильнее в кодинге и неожиданно, в поиске уязвимостей
- Writer выпустила Palmyra X6 и обновила агентную обвязку ради экономии до 50%
- Mistral выпустила OCR 4.1: разметка документов по блокам и цена от €3,5 за 1000 страниц
- Google выпустила Gemini 3.7 Flash: сильнее в коде, вдвое дешевле
- xAI выпустила Grok 4.6: сравнялась с GPT-5.6 Sol по интеллекту
- Qwen выпустила Qwen3.8, первую открытую модель уровня Max
- Liquid AI выпустила LFM2.5-VL-3B, модель для распознавания экранов и объектов
- DeepSeek выпустила V4 Pro 0813, MoE-модель с контекстом 1 млн токенов
- NVIDIA выпустила модель Nemotron 3.5 Lightning и роутер NeMo Switchyard для ИИ-агентов
- NVIDIA обновила Magpie TTS: открытые веса для 12 языков и задержка от 32 мс
- Needle 2: агентную ИИ-модель весом 14 МБ выпустили для телефонов, часов и роботов
- Motif 3: представлена MoE-модель на 314 млрд параметров с вниманием GDLA
- Liquid AI выпустила LFM2.5-2.6B: модель на 2,6 млрд параметров конкурирует с моделями вчетверо крупнее
- Пять стартапов ищут замену трансформерам в основе ИИ-моделей
- Meta выпустила Muse Glimmer, открытую модель на 30 млрд параметров для локальных агентов
- Claude Opus 5: системный промпт учит модель рассказывать о приостановке доступа к Fable 5 и Mythos 5
- Google DeepMind рассказала, как превратила Gemma 4 в диффузионную модель DiffusionGemma
- Минэнерго США анонсировало Genesis-Science-1, первую открытую модель для науки
- LG выпустила открытую модель K-EXAONE 2.0 на 750 млрд параметров
- Kandinsky выпустила KVAE, семейство токенизаторов для аудио, видео и изображений
- DeepSeek V4 Flash 0731: 89% на ARC-AGI-1, 61,4% на ARC-AGI-2
- OpenAI обновила GPT-5.6 Sol в ChatGPT и расширила бесплатный доступ к Luna
- MiniMax-H3: Саймон Уиллисон запустил омни-модальную модель на Apple Silicon
- Liquid AI выпустила LFM2.5-2.6B, компактную модель для ИИ-агентов на устройстве
- DeepGrove выпустила Maple-Preview: тернарную reasoning-модель на 20 млрд параметров