Продукт

ONNX

Все материалы по теме в хронологическом порядке.

Сегодня

Магнит рассказал, как задеплоил векторный поиск на Triton без GPU

Ведущий ML-разработчик Магнита Стас Чернышев описал, как команда поиска MAGNIT OMNI задеплоила векторный поиск на NVIDIA Triton Inference Server без GPU. Python оставили только для токенизации, а тело модели вынесли в ONNX.

3 минДля профи

LLM Guard заархивировали: разработчик продолжил проект под именем Gorget

Библиотеку LLM Guard от Protect AI заархивировали 8 июля 2026 года, но её скачивания не прекратились. Разработчик продолжил проект под именем Gorget — с совместимостью с прежним API, работой без PyTorch и распознаванием российских документов.

2 минДля профи