LLM
Все материалы по теме в хронологическом порядке.
Yandex Research предложила управлять поведением LLM через KV-кеш
Yandex Research исследует, как сделать LLM-агента интерактивным без переобучения модели — за счёт манипуляций с KV-кешем. Подход описан в работах Hogwild Inference и AsyncReasoning.
GPT-6 Astra и Gemini 3.8 Flash возглавили бенчмарк англо-русского перевода
Разработчик конвейера BookTrans опубликовал воспроизводимый бенчмарк англо-русского художественного перевода. Лучший результат показала GPT-6 Astra — 90 баллов из 100, у Gemini 3.8 Flash 88. Китайские модели GLM 5.3 и DeepSeek V4 Flash обошли флагманы Claude.
1352 кейса внедрения ИИ в России: в продакшене побеждает обвязка, а не модель
Каталог кейсов внедрения ИИ в России набрал 1352 проекта в компаниях и госорганах. Авторы статьи из АНО «Цифровые платформы» разобрали шесть паттернов: качество модели почти никогда не решает, а решает обвязка вокруг неё.
PrismML выпустила крошечную LLM для умных очков на чипах Qualcomm
AI-лаборатория PrismML создала версию своей крошечной языковой модели для умных очков на чипах Qualcomm Snapdragon. На саммите Snapdragon Summit чипмейкер показал 1-битную модель Bonsai, которая работает локально на очках с платформой AR1 Gen 1.
Mercury 2.5 выдаёт 770 токенов в секунду в тесте Artificial Analysis
LLM Mercury 2.5 показала скорость генерации 770 токенов в секунду в замерах Artificial Analysis. Модель оценивается по Intelligence Index v4.3.2, который включает 10 бенчмарков.



