Стоимость DeepSeek V4-Flash составляет около $0,03 за задачу. На фоне конкурентов это делает модель привлекательной для сценариев с большим числом запросов.

DeepSeek V4-Flash названа одной из самых выгодных моделей по цене задачи — около $0,03. В драфте указано, что по стоимости она заметно дешевле конкурентов, что делает её привлекательной для массовых сценариев, где нужно обрабатывать большое число запросов и считать каждый цент.

Источники 1
  • DeepSeek V4-Flash названа одной из самых выгодных моделей по цене задачи AI Updates Digest
    Искусственный интеллект – сводка за 3 августа
    
    Alibaba показала Qwen3.8-Max — монстра на 2,4 трлн параметров, который может работать автономно больше 10 дней подряд.
    🤖 “Complete Ai” и другие техканалы рассказывают, что новая мультимодальная MoE-модель заточена под агентские сценарии: она сама планирует, пишет код, анализирует картинки и не требует человека «над душой». Доступ будет через API, а уже на следующей неделе Alibaba обещает выложить веса — это может сильно встряхнуть рынок open-source ИИ.
    
    ChatGPT и Claude учатся «разговаривать» по‑настоящему и управлять агентами голосом.
    🗣 “Chad Gpt | Нейросети” пишет, что ChatGPT теперь голосом запускает и контролирует задачи в Work и Codex, а Anthropic прокачала голосовые модели Opus и Sonnet: они тянут сложные запросы и живое общение. Голос превращается из игрушки в полноценный интерфейс к агентам и рабочим процессам.
    
    Qwythos-27B-v1: ещё один «заточенный под агента» ИИ на базе Qwen3.5.
    🛠 По данным “Нейронавт | Нейросети В Творчестве”, Empero дообучили Qwen3.5-27B под работу с инструментами, CLI-агентами и function calling, сохранив vision и MTP-головку для быстрой генерации. Модель ориентирована на сценарии, где ИИ не просто отвечает, а активно пользуется утилитами и API.
    
    DeepSeek V4-Flash признали самым выгодным ИИ по цене задачи — около $0,03.
    💸 “Неискусственный Интеллект” отмечает, что модель многословна, но по стоимости в разы дешевле конкурентов вроде Kimi K3, GPT-5.6 Sol и Claude Fable 5. Это делает V4-Flash привлекательным там, где нужно гнать миллионы запросов и считать каждый цент.
    
    Google выводит Gemini Robotics 2: язык наконец напрямую управляет роботами.
    🤖 Канал “Omg Gpt” рассказывает, что новая система учит роботов-помощников понимать естественные команды, двигаться по комнате, брать и перекладывать вещи, подстраиваться под изменения. Модель умеет работать офлайн и тянет задачи с тонкой моторикой — шаг к более полезным бытовым и сервисным роботам.
    
    МТС запустила ИИ-агента для анализа посещаемости мест — от ТЦ до кафе.
    📊 “База Знаний Ai” пишет, что в сервисе «Посещаемость объектов» платформы «Геоэффект» агент по обезличенным данным строит портреты гостей, пики трафика и влияние погоды или событий. Он также группирует аудиторию по интересам, превращая сырые логи визитов в понятные бизнесу инсайты.
    
    Трафик из Google Search падает, а переходы из ChatGPT растут на 200% — медиа срочно ищут план Б.
    📉 “Ppprompt” ссылается на Axios: за год поисковый трафик из Google Search просел на 34%, Discover — на 15%, зато клики с ChatGPT взлетели. Вывод для изданий прямой: меньше надежд на алгоритмы Google, больше фокуса на собственный бренд, подписки и прямые каналы с аудиторией.
    
    PrunaVAED ускоряет LTX‑2.3 почти вдвое и режет потребление VRAM наполовину.
    ⚡ “Нейронавт | Нейросети В Творчестве” пишет, что этот альтернативный VAE-декодер даёт ~1,7х ускорение и около −50% к пику VRAM при сопоставимом качестве картинки. Он уже работает с diffusers/LTX-2.3-Diffusers и протестирован на NVIDIA H100 80GB — хороший апгрейд для тяжёлых генеративных пайплайнов.
    
    Источник
    ➖➖➖
    Подписаться на канал
    ➖➖➖
    ⬛️Borghese Club - все чаты и каналы
    ➖➖➖
    💻Бот для создания изображений, аудио и видео
    ➖➖➖
    #borgheseclub #vikborghese #дайджест