На Hugging Face появились новые GGUF-кванты MiniMax-H3, включая варианты FL2VA и Ref2VA, а также квант текстового энкодера Qwen3-VL-32B. Это позволяет собрать более компактный набор компонентов.

Пользователь Abiray опубликовал на Hugging Face новые GGUF-кванты для MiniMax-H3. Доступны варианты FL2VA для T2V, I2V, первого и последнего кадра, а также Ref2VA для использования изображений, видео и аудио в качестве референсов. В репозитории представлены кванты Q3_K_S / Q3_K_M, Q4_0, Q4_K_S / Q4_K_M, Q5_0 и Q5_K_S / Q5_K_M. Отдельно добавлен Q4_K_M-квант текстового энкодера Qwen3-VL-32B размером 14.6 ГБ. По данным репозитория, минимальный комплект «трансформер + энкодер + VAE» теперь можно собрать компактнее, чем прежний вариант с NVFP4-энкодером на 27.1 ГБ. Также доступны готовые workflow для FL2VA и Ref2VA. Отмечается, что это самодельные кванты, а не официальный релиз Comfy.

Источники 1
  • Abiray опубликовал новые GGUF-кванты MiniMax-H3 Метаверсище и ИИще
    Обновы для Минимакса H3 
    
    Новые GGUF-кванты
    - FL2VA - T2V, I2V, первый и последний кадр
    - Ref2VA - изображения, видео и аудио как референсы
    - Q3_K_S / Q3_K_M - 15.6 ГБ
    - Q4_0 - 18.6 ГБ
    - Q4_K_S / Q4_K_M - 19.9 ГБ
    - Q5_0 - 22.8 ГБ
    - Q5_K_S / Q5_K_M - 23.9 ГБ
    Там же появился Q4_K_M-квант Qwen3-VL-32B text encoder размером 14.6 ГБ.
    То есть минимальный комплект «трансформер + энкодер + VAE» теперь можно собрать как бы компактнее прежнего варианта с NVFP4-энкодером на 27.1 ГБ. Там же есть готовые workflow для FL2VA и Ref2VA.
    Пока это самопальные кванты, а не официальный релиз Comfy
    https://huggingface.co/Abiray/MiniMax-H3-GGUF
    
    
    Новые официальные варианты от Comfy-Org и Kijai
    В официальном репозитории Comfy-Org появились:
    - minimax_h3_fl2va_pruned_bf16.safetensors
    - minimax_h3_ref2va_pruned_bf16.safetensors
    - minimax_h3_fl2va_pruned_fp8_scaled.safetensors
    - minimax_h3_ref2va_pruned_fp8_scaled.safetensors
    Pruned BF16 были загружены Kijai около 16 часов назад. Типа качество BF16  полного  66-гигабайтного трансформера. FP8 scaled появились немного раньше и должны стать промежуточным вариантом между BF16 и pruned INT8 по памяти и точности.
    https://huggingface.co/Comfy-Org/MiniMax-H3/commits/main
    
    Минимаксенко обрастает мясом. Новый ЛТХ. Ждем Ответа Флюксовицкого.
    
    На видео сравнение Flux.3 API и MinimaxH3
    Подписать не могу, гадайте сами.. Смышленые посмотрят длительность.
    
    @cgevent