Модель

FRIDA

Все материалы по теме в хронологическом порядке.

Сегодня

Магнит рассказал, как задеплоил векторный поиск на Triton без GPU

Ведущий ML-разработчик Магнита Стас Чернышев описал, как команда поиска MAGNIT OMNI задеплоила векторный поиск на NVIDIA Triton Inference Server без GPU. Python оставили только для токенизации, а тело модели вынесли в ONNX.

3 минДля профи

Альфа-Банк протестировал LLM как энкодер для классификации на 300+ классов

Альфа-Банк рассказал, как использует LLM не как генератор, а как энкодер для классификации текстов. На четырёх внутренних доменах банка сравнили LLM-бэкбоны с классическими BERT-моделями.

1 минДля профи