Продукт

NVIDIA Triton Inference Server

Все материалы по теме в хронологическом порядке.

Вчера

Магнит рассказал, как задеплоил векторный поиск на Triton без GPU

Ведущий ML-разработчик Магнита Стас Чернышев описал, как команда поиска MAGNIT OMNI задеплоила векторный поиск на NVIDIA Triton Inference Server без GPU. Python оставили только для токенизации, а тело модели вынесли в ONNX.

3 минДля профи