Топ трендов HuggingFace за неделю — что приехало в опенсорс TL;DR Новое: Solar Open 2 от Upstage — MoE на 250B с 15B активных и контекстом 1M на гибридном внимании. Motif-3-Beta — бета корейской MoE на 314B со своей архитектурой. Nanbeige4.2-3B обходит модели втрое крупнее на агентных задачах. Laguna S 2.1 от Poolside приехала с квантами, разбирал отдельным постом. KAT-Coder-V2.5-Dev — открытые веса кодинг-модели Kwaipilot на 35B. Mage-Flow от Microsoft рисует и редактирует картинки на 4B параметрах. Inflect-Micro-v2 синтезирует речь на 9 миллионах параметров. antares-1b от Cisco ищет уязвим

Топ трендов HuggingFace за неделю — что приехало в опенсорс TL;DR Новое: Solar Open 2 от Upstage — MoE на 250B с 15B активных и контекстом 1M на гибридном внимании. Motif-3-Beta — бета корейской MoE на 314B со своей архитектурой. Nanbeige4.2-3B обходит модели втрое крупнее на агентных задачах. Laguna S 2.1 от Poolside приехала с квантами, разбирал отдельным постом. KAT-Coder-V2.5-Dev — открытые веса кодинг-модели Kwaipilot на 35B. Mage-Flow от Microsoft рисует и редактирует картинки на 4B параметрах. Inflect-Micro-v2 синтезирует речь на 9 миллионах параметров. antares-1b от Cisco ищет уязвимости в репозитории через терминал. MiniCPM-RobotManip управляет роботом на 1,5B, Cosmos3-Edge от NVIDIA моделирует физический мир. Держится: Unlimited-OCR, GLM-5.2, Inkling, Bonsai и Ternary Bonsai, Qwen3.6 Fable Fusion, Qwen3.6 Uncensored. LLM и агенты Solar Open 2 — корейская Upstage выложила MoE на 250 млрд параметров с 15 млрд активных. Внутри гибридное внимание: три линейных слоя на каждый softmax, позиционные кодировки убраны совсем, KV-кеш держат только 12 слоёв из 48, поэтому миллион токенов контекста обходится примерно в четверть памяти обычной модели такой же формы. MMLU-Pro 86,2, LiveCodeBench v6 92,4, SWE-bench Verified 70,4. Английский, корейский, японский. Motif-3-Beta — ещё одна корейская лаборатория, MoE на 314 млрд с 13 млрд активных и контекстом 256K. Архитектуру собрали с нуля: своё Grouped Differential Latent Attention, PolyNorm по экспертам, 384 эксперта с выбором восьми. Это промежуточный чекпоинт, финальный обещают позже. Коммерческое использование запрещено. Nanbeige4.2-3B — компактный агент на 3 млрд параметров. Архитектура Looped Transformer гоняет одни и те же слои по кругу, наращивая ёмкость без роста числа параметров. Авторы показывают отрыв от Qwen3.5-9B и Gemma4-12B: GDPval 74,3 против 61,9 и 68,5, SWE-bench Verified 63,6. Apache 2.0. Код Laguna S 2.1 — MoE Poolside на 118 млрд с 8 млрд активных и контекстом 1M, разбирал отдельным постом. Заодно в топ въехали её кванты: GGUF от Unsloth, GGUF и NVFP4 от самой лаборатории. KAT-Coder-V2.5-Dev — Kwaipilot открыла веса июльской кодинг-модели: MoE на 35 млрд с 3 млрд активных поверх Qwen3.6-35B-A3B, SWE-bench Verified 69,4. В открытую версию попала только языковая часть, зрение вырезали. Apache 2.0. Картинки и речь Mage-Flow — стек Microsoft на 4 млрд параметров, который и рисует по тексту, и правит картинку по инструкции. Ставка на совместное проектирование токенизатора и бэкбона: свой VAE плюс диффузионный трансформер в родном разрешении. Turbo-вариант выдаёт картинку 1024 на 1024 за 0,59 секунды на A100 в 18–20 ГБ памяти, авторы заявляют паритет с Qwen-Image на 20B и FLUX.2 на 32B. Лицензия MIT. Inflect-Micro-v2 — полный локальный синтез речи в 9,36 млн параметров и 37,53 МБ весов, английский, один фиксированный голос. На четырёх потоках процессора работает в 6,28 раза быстрее реального времени. Apache 2.0. Безопасность и роботы antares-1b — модель Cisco на 1 млрд параметров поверх Granite 4.0, которая ищет уязвимости в репозитории как терминальный агент: сама дёргает grep, find и cat, читает вывод и сужает круг подозрительных файлов. На VLoc Bench File F1 0,209, выше чем у GLM-5.2 и Gemini 3 Pro, прогон 500 задач занимает около 13 минут на H100. Apache 2.0, доступ к весам по форме. MiniCPM-RobotManip — vision-language-action на 1,5 млрд: одни веса на все задачи манипуляции. Наблюдения подаются потоком, поэтому модель держит до минуты видео, а счёт на шаг падает со 125 до 3,3 TFLOPs. Apache 2.0. Cosmos3-Edge — младшая модель мира линейки NVIDIA Cosmos 3 на 3,9 млрд параметров. По тексту, картинкам, видео и траекториям достраивает будущее сцены и выдаёт команды управления, отдельно идёт вариант политики для роботов DROID. Коммерческое использование разрешено. Держится в топе Unlimited-OCR от Baidu по-прежнему первый, уже 2,6 млн загрузок. Видимо прям очень хорошая OCR, не помню чтобы кто-то так долго первое место занимал кроме квена. Рядом GLM-5.2, мультимодальная Inkling и обе сборки Bonsai на базе Qwen3.6-27B: тернарная и однобитная. Из сообщества остались Qwen3.6 Fable Fusion и Qwen3.6 Uncensored. Хорошей недели! 👾 @neuro_channel

Источники 1
  • Топ трендов HuggingFace за неделю — что приехало в опенсорс Нейроканал
    Топ трендов HuggingFace за неделю — что приехало в опенсорс
    
    TL;DR
    
    Новое: Solar Open 2 от Upstage — MoE на 250B с 15B активных и контекстом 1M на гибридном внимании. Motif-3-Beta — бета корейской MoE на 314B со своей архитектурой. Nanbeige4.2-3B обходит модели втрое крупнее на агентных задачах. Laguna S 2.1 от Poolside приехала с квантами, разбирал отдельным постом. KAT-Coder-V2.5-Dev — открытые веса кодинг-модели Kwaipilot на 35B. Mage-Flow от Microsoft рисует и редактирует картинки на 4B параметрах. Inflect-Micro-v2 синтезирует речь на 9 миллионах параметров. antares-1b от Cisco ищет уязвимости в репозитории через терминал. MiniCPM-RobotManip управляет роботом на 1,5B, Cosmos3-Edge от NVIDIA моделирует физический мир.
    
    Держится: Unlimited-OCR, GLM-5.2, Inkling, Bonsai и Ternary Bonsai, Qwen3.6 Fable Fusion, Qwen3.6 Uncensored.
    
    LLM и агенты
    
    Solar Open 2 — корейская Upstage выложила MoE на 250 млрд параметров с 15 млрд активных. Внутри гибридное внимание: три линейных слоя на каждый softmax, позиционные кодировки убраны совсем, KV-кеш держат только 12 слоёв из 48, поэтому миллион токенов контекста обходится примерно в четверть памяти обычной модели такой же формы. MMLU-Pro 86,2, LiveCodeBench v6 92,4, SWE-bench Verified 70,4. Английский, корейский, японский.
    
    Motif-3-Beta — ещё одна корейская лаборатория, MoE на 314 млрд с 13 млрд активных и контекстом 256K. Архитектуру собрали с нуля: своё Grouped Differential Latent Attention, PolyNorm по экспертам, 384 эксперта с выбором восьми. Это промежуточный чекпоинт, финальный обещают позже. Коммерческое использование запрещено.
    
    Nanbeige4.2-3B — компактный агент на 3 млрд параметров. Архитектура Looped Transformer гоняет одни и те же слои по кругу, наращивая ёмкость без роста числа параметров. Авторы показывают отрыв от Qwen3.5-9B и Gemma4-12B: GDPval 74,3 против 61,9 и 68,5, SWE-bench Verified 63,6. Apache 2.0.
    
    Код
    
    Laguna S 2.1 — MoE Poolside на 118 млрд с 8 млрд активных и контекстом 1M, разбирал отдельным постом. Заодно в топ въехали её кванты: GGUF от Unsloth, GGUF и NVFP4 от самой лаборатории.
    
    KAT-Coder-V2.5-Dev — Kwaipilot открыла веса июльской кодинг-модели: MoE на 35 млрд с 3 млрд активных поверх Qwen3.6-35B-A3B, SWE-bench Verified 69,4. В открытую версию попала только языковая часть, зрение вырезали. Apache 2.0.
    
    Картинки и речь
    
    Mage-Flow — стек Microsoft на 4 млрд параметров, который и рисует по тексту, и правит картинку по инструкции. Ставка на совместное проектирование токенизатора и бэкбона: свой VAE плюс диффузионный трансформер в родном разрешении. Turbo-вариант выдаёт картинку 1024 на 1024 за 0,59 секунды на A100 в 18–20 ГБ памяти, авторы заявляют паритет с Qwen-Image на 20B и FLUX.2 на 32B. Лицензия MIT.
    
    Inflect-Micro-v2 — полный локальный синтез речи в 9,36 млн параметров и 37,53 МБ весов, английский, один фиксированный голос. На четырёх потоках процессора работает в 6,28 раза быстрее реального времени. Apache 2.0.
    
    Безопасность и роботы
    
    antares-1b — модель Cisco на 1 млрд параметров поверх Granite 4.0, которая ищет уязвимости в репозитории как терминальный агент: сама дёргает grep, find и cat, читает вывод и сужает круг подозрительных файлов. На VLoc Bench File F1 0,209, выше чем у GLM-5.2 и Gemini 3 Pro, прогон 500 задач занимает около 13 минут на H100. Apache 2.0, доступ к весам по форме.
    
    MiniCPM-RobotManip — vision-language-action на 1,5 млрд: одни веса на все задачи манипуляции. Наблюдения подаются потоком, поэтому модель держит до минуты видео, а счёт на шаг падает со 125 до 3,3 TFLOPs. Apache 2.0.
    
    Cosmos3-Edge — младшая модель мира линейки NVIDIA Cosmos 3 на 3,9 млрд параметров. По тексту, картинкам, видео и траекториям достраивает будущее сцены и выдаёт команды управления, отдельно идёт вариант политики для роботов DROID. Коммерческое использование разрешено.
    
    Держится в топе
    
    Unlimited-OCR от Baidu по-прежнему первый, уже 2,6 млн загрузок. Видимо прям очень хорошая OCR, не помню чтобы кто-то так долго первое место занимал кроме квена. Рядом GLM-5.2, мультимодальная Inkling и обе сборки Bonsai на базе Qwen3.6-27B: тернарная и однобитная. Из сообщества остались Qwen3.6 Fable Fusion и Qwen3.6 Uncensored.
    
    Хорошей недели! 👾
    
    @neuro_channel