Perplexity выпустила локального ИИ-агента Portable Computer

Perplexity выпустила локального ИИ-агента Portable Computer

Perplexity, ранее известная сервисами поиска, рекламой, персональными ассистентами, браузерами и облачной агентной платформой Computer, представила локального агента Portable Computer. В отличие от облачного Computer, новый продукт включает агентскую обвязку (harness) и оркестратор, которые управляют open-weight моделями, работающими локально на рабочей станции Nvidia DGX Spark, с возможностью при необходимости переключаться на облачный инференс.

Perplexity объясняет ставку на локальный запуск контролем над расходами: пользователи в последние месяцы ищут способ снизить счета за облачные API, а локальный инференс избавляет от платы за токен. По словам компании, это также "естественным образом снимает вопросы приватности и интеллектуальной собственности: приватные токены не нужно передавать в удалённые кластеры, они остаются на устройстве". В своём посте Perplexity отмечает, что прогресс сейчас заметнее всего у компактных моделей, Nvidia Nemotron 3.5 Lightning (30 млрд параметров), Qwen 3.6 (35 млрд) и Qwen 3.8 (27 млрд); в собственных тестах на DGX Spark компания использовала именно Qwen 3.8 (27 млрд).

Portable Computer сравнивали с двумя другими агентскими обвязками, Pi и Hermes (в источнике не указано, кто их делает, известно лишь, что они бесплатны). По заявлению Perplexity, её агент на Qwen 3.8 сравнялся с ними или превзошёл их по точности, оказался быстрее на бенчмарках BrowseComp и ParseBench-100 и потратил меньше всего токенов на всех трёх тестах.

Издание The Register иронично отмечает, что в одном анонсе бренд Nvidia упомянут шесть раз, и связывает это со слухами о том, что Nvidia рассматривает возможность вложить $30 млрд в Perplexity, сделка пока лишь обсуждается, не подтверждена, и сроков нет. Дата выхода, цена и доступность Portable Computer в материале не названы.

Ключевые факты

  • Perplexity выпустила Portable Computer, локального ИИ-агента (агентская обвязка плюс оркестратор), который в отличие от облачного Computer запускает open-weight модели на рабочей станции Nvidia DGX Spark, с возможностью подключить облако при необходимости.
  • Компания называет локальный запуск способом сэкономить на API-платежах за токены и снять вопросы приватности: данные не покидают устройство.
  • В качестве эффективных локальных моделей Perplexity упоминает Nvidia Nemotron 3.5 Lightning (30 млрд параметров) и Qwen 3.6 (35 млрд), а в собственных тестах на DGX Spark использовала Qwen 3.8 (27 млрд).
  • По собственным бенчмаркам Portable Computer сравнялся или превзошёл конкурирующие бесплатные обвязки Pi и Hermes по точности, оказался быстрее на BrowseComp и ParseBench-100 и потратил меньше всего токенов на всех трёх тестах.
  • The Register иронично считает упоминания Nvidia (шесть раз в анонсе) на фоне слухов о рассматриваемых Nvidia $30 млрд инвестиций в Perplexity, сделка не подтверждена, сроков нет; дата выхода и цена Portable Computer не раскрыты.

Почему это важно

Perplexity, уже успевшая выйти на рынки поиска, рекламы, персональных ассистентов, браузеров и облачных агентов, теперь заходит и в локальный ИИ, сегмент, который растёт на фоне жалоб пользователей на счета за облачные API. Это ещё один сигнал, что компактные open-weight модели (десятки миллиардов параметров) уже достаточно сильны для сложных агентных сценариев на потребительском или рабочем железе, а не только в дата-центрах.

Кому это важно

Разработчикам и компаниям, которые ищут способ снизить расходы на инференс и не выводить чувствительные данные за пределы своей инфраструктуры. Также это важно для Nvidia, DGX Spark получает ещё одну витрину применения на фоне слухов о её возможных инвестициях в Perplexity, и для конкурирующих агентских платформ Pi и Hermes, с которыми Perplexity сравнивает себя напрямую.

Как это применить

Portable Computer, это агентская обвязка (harness) и оркестратор, которые запускают open-weight модели локально на рабочей станции Nvidia DGX Spark и могут при необходимости переключаться на облачный инференс. Компания указывает на модели уровня Nvidia Nemotron 3.5 Lightning (30 млрд параметров), Qwen 3.6 (35 млрд) и Qwen 3.8 (27 млрд) как достаточно эффективные для агентной работы. Дата выхода, цена и условия доступности продукта в материале не названы.

Можно ли доверять

Все цифры по производительности, это собственные бенчмарки Perplexity (BrowseComp, ParseBench-100 и ещё один неназванный тест), независимого подтверждения нет. The Register прямо указывает на потенциальный конфликт интересов: шесть упоминаний бренда Nvidia в одном анонсе совпадают по времени со слухами о рассматриваемых Nvidia $30 млрд инвестициях в Perplexity, при этом сама сделка ещё не заключена. В материале не названо ни одного конкретного человека из Perplexity или Nvidia, только компании.

Риски и подводные камни

Инвестиции Nvidia в $30 млрд остаются на стадии обсуждения, а не подтверждённой сделкой, и сроки не названы, весь контекст с DGX Spark и локальными моделями Nvidia стоит читать с этой оговоркой. Монетизация Portable Computer неясна: конкурирующие обвязки Pi и Hermes бесплатны, а Perplexity пока не раскрыла ни цену, ни дату выхода своего продукта. Заявления о приватности и экономии независимо не проверялись.

«Прогресс заметнее всего у очень маленьких и эффективных моделей, таких как Nvidia Nemotron 3.5 Lightning (30 млрд параметров), Qwen 3.6 (35 млрд) и Qwen 3.8 (27 млрд).»

— Perplexity, в блоге компании