Nvidia расширяет CUDA на RISC-V: жёсткие требования к серверным чипам

Nvidia расширяет CUDA на RISC-V: жёсткие требования к серверным чипам

На конференции Hot Chips 2026 Nvidia представила требования, которым должны соответствовать процессор и платформа на архитектуре RISC-V, чтобы на них заработала CUDA. Сейчас CUDA поддерживает только x86-64 и aarch64; расширение на RISC-V открывает этой архитектуре доступ к вычислениям на GPU Nvidia.

Список требований таков. Нужен процессор с профилем RVA23, а платформа должна соответствовать серверным спецификациям RISC-V, отдельно для SoC и отдельно для платформы в целом; эти спецификации уже включают функции надёжности, доступности и обслуживаемости (RAS) и выделенный процессор безопасности. Сверх этого Nvidia требует аппаратные векторные расширения: они нужны для предикации, которая заменяет ветвления в коде и не даёт терять производительность, без гарантии таких расширений на всём железе Nvidia пришлось бы писать код в расчёте на самый слабый чип. Ещё одно условие, поддержка ACPI: когда в Nvidia начинали портировать CUDA, у RISC-V-железа её не было, но в 2025 году форум UEFI добавил поддержку ACPI для RISC-V, а недавно ратифицированная спецификация загрузки и рантайма RISC-V BRS уже включает ACPI. Дальше, когерентность PCIe: без неё при обмене данными между CPU и GPU через DMA можно прочитать или записать устаревшие данные, потому что часть только что изменённых данных ещё остаётся в кэше процессора, а закрывать это программными сбросами кэша в стеке CUDA в Nvidia считают неприемлемым; спецификация серверных SoC RISC-V когерентность лишь рекомендует, а Nvidia требует её гарантированно. Последнее требование, прямой обмен между устройствами по PCIe (peer-to-peer): без него данные между двумя устройствами пришлось бы гонять через память CPU, что снижает производительность и усложняет систему. По словам Nvidia, весь список требований умещается на двух страницах, но подробно все пункты компания не раскрыла.

Отдельно на докладе разобрали требования к программе NVLink Fusion, она позволяет другим компаниям встраивать в свои чипы IP-блок NVLink Nvidia и подключать через NVLink C2C собственный процессор, в том числе на RISC-V, к GPU Nvidia. Похожий принцип уже работает в продукте Nvidia GB10, где через NVLink C2C связаны кристалл процессора MediaTek и GPU Nvidia. Для NVLink Fusion действуют все требования CUDA, а также поддержка программных платформ DOCA и NCCL и тесное партнёрство с Nvidia.

Автор материала Честер Лэм отмечает, что программная экосистема RISC-V пока заметно отстаёт от x86-64 и aarch64, и абсолютное большинство существующего RISC-V-железа этим требованиям не соответствует, он не удивится, если ни одно потребительское RISC-V-устройство не будет отвечать им и в обозримом будущем. Особенно сложный пункт, ACPI: даже в мире aarch64 её поддержка много лет остаётся неполной, хотя стандарт существует давно, а ратифицированный в 2025 году стандарт RISC-V, по прогнозу автора, будет распространяться ещё несколько лет, если не дольше. Когда (и если) появятся RISC-V-системы с поддержкой CUDA, речь пойдёт скорее о серверных системах, чем о платах для энтузиастов. Nvidia партнёрится с SiFive, которая планирует показать на Hot Chips систему с работающей CUDA; Nvidia дала понять, что характеристики процессора, приведённые на слайде как пример, соответствуют именно этой системе, а они указывают на серверный чип с большим числом ядер. Честер Лэм надеется, что со временем Nvidia смягчит требования: по его мнению, отсутствие векторных расширений или когерентности PCIe само по себе не обязательно ведёт к серьёзным потерям производительности, программные обходы (ветвления вместо предикации, сброс кэша вместо аппаратной когерентности) могут обойтись приемлемой ценой, особенно для задач с большим объёмом вычислений относительно объёма передаваемых данных. Он предполагает, что нынешний жёсткий список, способ Nvidia быстро и с низким риском выпустить первую версию порта, а не постоянная планка.

Ключевые факты

  • Nvidia на Hot Chips 2026 назвала условия, при которых RISC-V-процессор сможет работать с CUDA: профиль RVA23 и соответствие серверным спецификациям RISC-V, которые включают функции надёжности, доступности и обслуживаемости (RAS) и выделенный процессор безопасности.
  • Дополнительно обязательны аппаратные векторные расширения (нужны для предикации вместо ветвлений в коде), поддержка ACPI (для RISC-V её добавили только в 2025 году) и гарантированная когерентность PCIe с поддержкой прямого обмена между устройствами (peer-to-peer).
  • По словам Nvidia, весь список требований умещается на двух страницах, но подробностей компания не раскрыла.
  • Те же требования плюс поддержка программных платформ DOCA и NCCL действуют для программы NVLink Fusion, она позволяет сторонним компаниям подключать собственный процессор, в том числе на RISC-V, к GPU Nvidia через NVLink C2C, как уже сделано с чипом MediaTek в продукте GB10.
  • Nvidia партнёрится с SiFive, которая планирует показать на Hot Chips систему с работающей CUDA на RISC-V; автор материала считает, что в обозримом будущем этим требованиям будут отвечать только серверные чипы, а не платы для энтузиастов.

Почему это важно

CUDA долго была привязана только к x86-64 и aarch64, то есть к процессорам Intel/AMD и ARM. Nvidia впервые публично раскрывает условия, при которых допустит к этой экосистеме открытую архитектуру RISC-V, и параллельно, условия лицензирования NVLink Fusion, то есть подключения к своей шине сторонних процессоров, включая RISC-V. Для рынка серверных чипов это первый официальный технический ориентир: какую платформу Nvidia готова считать достаточно зрелой для своих GPU.

Кому это важно

В первую очередь, производителям серверных RISC-V-чипов вроде SiFive, которые получили чёткий список условий вместо догадок. Также, облачным провайдерам и дата-центрам, которые ищут альтернативу x86-64 и aarch64 для связки с GPU Nvidia, и компаниям, которые рассматривают NVLink Fusion для собственных чипов, по образцу MediaTek в продукте Nvidia GB10. Энтузиастам и владельцам недорогих RISC-V-плат новость интересна скорее как ориентир на будущее: под нынешние требования их железо не подходит.

Как это применить

Сегодня подключить GPU Nvidia к обычной RISC-V-плате и запустить на ней CUDA нельзя, список требований исключает почти всё существующее RISC-V-железо. Практический ориентир один: следить за демонстрацией SiFive на Hot Chips, это первая система, о которой Nvidia прямо говорит, что она рассчитана под эти требования. Для тех, кто планирует серверную инфраструктуру на RISC-V, чек-лист уже есть: профиль RVA23, серверные спецификации RISC-V, аппаратные векторные расширения, ACPI, гарантированная когерентность PCIe и поддержка прямого обмена между устройствами по PCIe.

Можно ли доверять

Материал опубликован на chipsandcheese.com автором по имени Честер Лэм и пересказывает доклад, который Nvidia прочитала на Hot Chips 2026: источник, собственная презентация компании, а не утечка или домысел. Слабое место: сама Nvidia не раскрыла все пункты списка требований подробно, поэтому часть деталей, например, точный целевой уровень производительности, в статье отсутствует, а не скрыта журналистом; независимых бенчмарков или комментариев других RISC-V-вендоров, кроме SiFive, в материале тоже нет.

Риски и подводные камни

Главный риск для RISC-V-экосистемы, именно ACPI: даже в куда более зрелом мире aarch64 её поддержка годами остаётся неполной, а нужный стандарт для RISC-V ратифицирован только в 2025 году. Дата выхода серверов, реально соответствующих требованиям Nvidia, в материале не названа, есть только план SiFive показать демо на Hot Chips, без сроков поставок. Коммерческие условия NVLink Fusion, лицензионные платежи, конкретные партнёры кроме SiFive, тоже не раскрыты.