Moonshot AI выложила в открытый доступ веса модели Kimi K3. У модели 2,8 трлн параметров, из них 104 млрд активных, а за неделю она набрала почти миллион загрузок.

Moonshot AI опубликовала веса модели Kimi K3. У модели 2,8 трлн параметров, из них 104 млрд активных. За неделю она набрала почти миллион загрузок.

Источники 1
  • Moonshot AI открыла веса модели Kimi K3 с 2,8 трлн параметров Нейроканал
    Топ трендов HuggingFace за неделю — что приехало в опенсорс
    
    TL;DR
    
    Новое: Kimi K3 — Moonshot открыла веса модели на 2,8 трлн параметров. DeepSeek V4-Flash-0731 прибавила в кодинге. MiniMax-H3 генерирует видео сразу со звуком. Inkling-Small на 276 млрд местами обходит старшую Inkling на 975 млрд. XYZ-Aquila mini и pro заточены под агентный веб-поиск. Fara1.5-27B от Microsoft кликает в браузере вместо человека. Mage-VL понимает видео на 4 млрд параметров. Audio8-TTS клонирует голос на 11 языках. Kroma дообучает генератор картинок Krea 2.
    
    Держится: Unlimited-OCR, GLM-5.2, KAT-Coder-V2.5-Dev, Laguna S 2.1, Nanbeige4.2-3B, Inflect-Micro-v2, Qwen3.6 Fable Fusion.
    
    LLM и агенты
    
    Kimi K3 — Moonshot выложила веса, 2,8 трлн параметров при 104 млрд активных, разбирал отдельным постом. Почти миллион загрузок за неделю.
    
    DeepSeek V4-Flash-0731 — MoE на 284 млрд параметров с 13 млрд активных, сильно прибавила в кодинге, писал о ней.
    
    Inkling-Small — вторая модель Thinking Machines: 276 млрд параметров, 12 млрд активных, на входе текст, картинки и аудио. SWE-bench Verified 80,2 против 77,6 у старшей Inkling на 975 млрд, GPQA Diamond 89,5, AIME 2026 95,5. Apache 2.0.
    
    XYZ-Aquila-mini и pro — модели XYZ AI Lab под агентный веб-поиск, дообучены поверх Qwen3.6-35B-A3B и Qwen3.5-397B-A17B. На BrowseComp у mini 78,8, у pro 84,8, контекст 256K. Apache 2.0.
    
    Fara1.5-27B — агент Microsoft для управления браузером: смотрит на скриншот, кликает, печатает, заполняет формы. Доля успешно выполненных задач на WebVoyager 89,3, на Online-Mind2Web 72,3. Перед оплатой и отправкой личных данных останавливается и ждёт подтверждения. MIT.
    
    Видео и картинки
    
    MiniMax-H3 — видео со встроенным стереозвуком, 33 млрд параметров, ролики от 4 до 15 секунд при 24 кадрах в секунду. В открытый доступ отдали вариант на 768p, вывод в 2K остался в API. Реплики на 11 языках, включая русский.
    
    Mage-VL — понимание картинок и видео на 4 млрд параметров поверх Qwen3-4B. Своя подача кадров срезает больше 75% визуальных токенов и ускоряет инференс до 3,5 раза. Apache 2.0.
    
    Kroma — LoRA к генератору картинок Krea 2, файл на 1,88 ГБ под ComfyUI, работает и с версией Turbo на восьми шагах. MIT.
    
    Синтез речи
    
    Audio8-TTS-Preview-0.6b — 601 млн параметров, клонирование голоса по короткой записи, 11 языков без русского. На Seed-TTS английский WER 1,506, то есть доля неверно распознанных слов при обратной расшифровке, китайский CER 0,950. Есть сборка INT4 под процессор. Русский не поддерживает. Apache 2.0.
    
    Кванты и сообщество
    
    GGUF от Unsloth для Kimi K3 и DeepSeek V4-Flash-0731, рядом зеркало исходных весов Kimi K3 и сборка MiniMax-H3 от Comfy-Org для ComfyUI.
    
    Держится в топе
    
    Unlimited-OCR от Baidu снова первый по загрузкам, уже 2,6 млн. GLM-5.2 идёт следом с 2,2 млн. С прошлого выпуска остались KAT-Coder-V2.5-Dev от Kwaipilot, Laguna S 2.1 от Poolside, компактный агент Nanbeige4.2-3B, синтез речи Inflect-Micro-v2 на 9 млн параметров и GGUF-файнтюн Qwen3.6 Fable Fusion.
    
    Хорошей недели! 👾
    
    @neuro_channel