Новость
✔️ OpenAI создала модель для поиска уязвимостей в своих LLM
✔️ OpenAI создала модель для поиска уязвимостей в своих LLM Внутренняя разработка под названием GPT-Red автоматизирует редтиминг собственной продукции компании. Инструмент симулирует промпт-инъекции и скрытые атаки через письма, файлы и веб-страницы. Система обучалась с помощью RL и self-play - непрерывное соревнование атакующей и защитной моделей довело успешность поиска уязвимостей до 84% в тестовых сценариях (против 13% у людей-специалистов). По словам OpenAI, благодаря GPT-Red уязвимость GPT-5.6 Sol к прямым промпт-инъекциям снизилась в 6 раз по сравнению с моделями четырехмесячной давн
✔️ OpenAI создала модель для поиска уязвимостей в своих LLM Внутренняя разработка под названием GPT-Red автоматизирует редтиминг собственной продукции компании. Инструмент симулирует промпт-инъекции и скрытые атаки через письма, файлы и веб-страницы. Система обучалась с помощью RL и self-play - непрерывное соревнование атакующей и защитной моделей довело успешность поиска уязвимостей до 84% в тестовых сценариях (против 13% у людей-специалистов). По словам OpenAI, благодаря GPT-Red уязвимость GPT-5.6 Sol к прямым промпт-инъекциям снизилась в 6 раз по сравнению с моделями четырехмесячной давности, но около 3,8% сложных атак по-прежнему достигают цели (сопоставимо с показателями Claude Opus 4.5). Инструмент остается внутренним, OpenAI планирует выпустить статью с описанием архитектуры и процесса обучения в ближайшее время. openai.com ✔️ SpaceXAI открыла исходный код Grok Build В репозиторий вошли цикл управления агентом, механизмы сборки контекста, парсинг ответов модели, консольный интерфейс с просмотром diff-изменений и инструменты выполнения команд. Код демонстрирует механизмы интеграции фреймворка с серверами MCP, субагентами и кастомными плагинами. Grok Build поддерживает локальное развертывание и позволяет перенаправить запросы на любые локальные LLM, полностью исключив передачу данных на сторонние серверы. x.ai ✔️ Apple Intelligence официально выходит на китайский рынок Сервис будет работать в Китае на базе локальных ИИ-моделей после получения официального одобрения от профильного ведомства КНР. Из-за жестких региональных требований к регистрации генеративных сервисов компания отказалась от адаптации собственных алгоритмов. Базовой LLM для китайских версий iOS и macOS выбрана Qwen от Alibaba. Модель будет отвечать за анализ контекста, генерацию текста и изображений. Параллельно Apple сотрудничает с Baidu для разработки дополнительных функций под региональный рынок. На ранних этапах компания также рассматривала решения от DeepSeek и ByteDance, но выбрала Alibaba и Baidu. reuters.com ✔️ Spotify запустил бету диалогового ИИ-ассистента Музыкальный сервис добавил ассистента на основе ИИ в управление воспроизведением через текстовые и голосовые команды. Функция запущена в режиме беты для Premium-пользователей старше 18 лет в США, Ирландии и Швеции. Модель обрабатывает контекстные запросы, а в интерфейсе плеера можно запрашивать информацию об артистах, песнях и подкастах, узнавать историю собственных прослушиваний и задавать вопросы на общую эрудицию. Запуск ассистента дополняет предыдущие ИИ-функции платформы - генерацию плейлистов по промптам и интеграцию технологий ElevenLabs для озвучки аудиокниг. spotify.com ✔️ На Meta* подали в суд за использование алгоритмов при сокращении персонала Бывшие сотрудники подали иск в федеральный суд Калифорнии, обвинив компанию в использовании ИИ в ходе майского сокращения 8000 человек. По версии истцов, внутренние системы генерировали списки на увольнение с системной предвзятостью. Под сокращение непропорционально часто попадали сотрудники с инвалидностью, а также находящиеся в медицинском или декретном отпуске. В иске указано, что алгоритм формировал списки на основе оценок эффективности, объемов выполненной работы и метрик использования корпоративных ИИ-инструментов. Meta отвергает обвинения и настаивает, что финальные кадровые решения принимают люди. Сейчас истцы добиваются судебного запрета, чтобы сохранить рабочие места до окончания разбирательства. wsj.com *организация признана экстремистской, её деятельность на территории РФ запрещена. @ai_machinelearning_big_data #news #ai #ml
-
✔️ OpenAI создала модель для поиска уязвимостей в своих LLM
Machinelearning
✔️ OpenAI создала модель для поиска уязвимостей в своих LLM Внутренняя разработка под названием GPT-Red автоматизирует редтиминг собственной продукции компании. Инструмент симулирует промпт-инъекции и скрытые атаки через письма, файлы и веб-страницы. Система обучалась с помощью RL и self-play - непрерывное соревнование атакующей и защитной моделей довело успешность поиска уязвимостей до 84% в тестовых сценариях (против 13% у людей-специалистов). По словам OpenAI, благодаря GPT-Red уязвимость GPT-5.6 Sol к прямым промпт-инъекциям снизилась в 6 раз по сравнению с моделями четырехмесячной давности, но около 3,8% сложных атак по-прежнему достигают цели (сопоставимо с показателями Claude Opus 4.5). Инструмент остается внутренним, OpenAI планирует выпустить статью с описанием архитектуры и процесса обучения в ближайшее время. openai.com ✔️ SpaceXAI открыла исходный код Grok Build В репозиторий вошли цикл управления агентом, механизмы сборки контекста, парсинг ответов модели, консольный интерфейс с просмотром diff-изменений и инструменты выполнения команд. Код демонстрирует механизмы интеграции фреймворка с серверами MCP, субагентами и кастомными плагинами. Grok Build поддерживает локальное развертывание и позволяет перенаправить запросы на любые локальные LLM, полностью исключив передачу данных на сторонние серверы. x.ai ✔️ Apple Intelligence официально выходит на китайский рынок Сервис будет работать в Китае на базе локальных ИИ-моделей после получения официального одобрения от профильного ведомства КНР. Из-за жестких региональных требований к регистрации генеративных сервисов компания отказалась от адаптации собственных алгоритмов. Базовой LLM для китайских версий iOS и macOS выбрана Qwen от Alibaba. Модель будет отвечать за анализ контекста, генерацию текста и изображений. Параллельно Apple сотрудничает с Baidu для разработки дополнительных функций под региональный рынок. На ранних этапах компания также рассматривала решения от DeepSeek и ByteDance, но выбрала Alibaba и Baidu. reuters.com ✔️ Spotify запустил бету диалогового ИИ-ассистента Музыкальный сервис добавил ассистента на основе ИИ в управление воспроизведением через текстовые и голосовые команды. Функция запущена в режиме беты для Premium-пользователей старше 18 лет в США, Ирландии и Швеции. Модель обрабатывает контекстные запросы, а в интерфейсе плеера можно запрашивать информацию об артистах, песнях и подкастах, узнавать историю собственных прослушиваний и задавать вопросы на общую эрудицию. Запуск ассистента дополняет предыдущие ИИ-функции платформы - генерацию плейлистов по промптам и интеграцию технологий ElevenLabs для озвучки аудиокниг. spotify.com ✔️ На Meta* подали в суд за использование алгоритмов при сокращении персонала Бывшие сотрудники подали иск в федеральный суд Калифорнии, обвинив компанию в использовании ИИ в ходе майского сокращения 8000 человек. По версии истцов, внутренние системы генерировали списки на увольнение с системной предвзятостью. Под сокращение непропорционально часто попадали сотрудники с инвалидностью, а также находящиеся в медицинском или декретном отпуске. В иске указано, что алгоритм формировал списки на основе оценок эффективности, объемов выполненной работы и метрик использования корпоративных ИИ-инструментов. Meta отвергает обвинения и настаивает, что финальные кадровые решения принимают люди. Сейчас истцы добиваются судебного запрета, чтобы сохранить рабочие места до окончания разбирательства. wsj.com *организация признана экстремистской, её деятельность на территории РФ запрещена. @ai_machinelearning_big_data #news #ai #ml