kv cache

  1. Qwen

    Контекстное окно LLM: что происходит с токенами, KV cache и качеством на длинных промптах

    Токен как единица контекста Языковая модель не работает с текстом как с последовательностью символов. Перед подачей в модель текст разбивается на токены — минимальные единицы, которые модель воспринимает и генерирует. Токенизация выполняется препроцессором, который входит в определение модели...
Назад
Верх Низ