Yandex Research предложила управлять поведением LLM через KV-кеш
Yandex Research исследует, как сделать LLM-агента интерактивным без переобучения модели — за счёт манипуляций с KV-кешем. Подход описан в работах Hogwild Inference и AsyncReasoning.
Все материалы по теме в хронологическом порядке.
Yandex Research исследует, как сделать LLM-агента интерактивным без переобучения модели — за счёт манипуляций с KV-кешем. Подход описан в работах Hogwild Inference и AsyncReasoning.