fp8

  1. Qwen

    Квантизация LLM: AWQ, GPTQ и FP8 — как уменьшить память без лишней потери качества

    Что делает квантизация Квантизация снижает требования к памяти при загрузке и инференсе модели за счёт хранения весов в формате с меньшей точностью. Исходно веса хранятся в full-precision (fp32), но уже half-precision (fp16 или bf16) стал стандартом для большинства современных LLM. Квантизация...
Назад
Верх Низ