1 день назад
Liquid AI ускорила LFM2.5 до 3,18 раза без изменения ответов модели
Liquid AI выпустила DSpark draft model checkpoints для трёх моделей семейства LFM2.5. Новые «драфтеры» добавляют спекулятивное декодирование: небольшая модель заранее предлагает продолжение текста, а основная проверяет его за один проход. В результате генерация может стать до 3,18 раза быстрее — при этом в жадном режиме декодирования итоговый текст остаётся полностью тем же. Компания опубликовала контрольные точки DSpark для LFM2.5-1.2B-Instruct, LFM2.5-2.6B и LFM2.5-8B-A1B. Они доступны в форматах Safetensors и GGUF и рассчитаны на самостоятельное развёртывание...