Cloud.ru выложила в опенсорс Guardrails Filter — инструмент для маскировки персональных данных, API-ключей и другой конфиденциальной информации при работе с LLM. После ответа модели оригинальные значения восстанавливаются.

Cloud.ru опубликовала в открытом доступе Guardrails Filter — инструмент для защиты данных при работе с LLM. Он работает как слой между приложением и моделью: перед отправкой запроса маскирует персональные данные, API-ключи, пароли и другую конфиденциальную информацию синтетическими значениями, а после ответа модели восстанавливает оригиналы. Решение можно развернуть внутри своей инфраструктуры и управлять через личный кабинет. В функционал входят стандартные и кастомные правила детекции, например для внутренних ID или номеров договоров, логирование событий безопасности и тестовый режим Ghost Mode, который позволяет проверить работу сервиса до включения защиты. На публичном бенчмарке pii-bench инструмент показал F1 93.1 и точность 99.9%.

Источники 1
  • Cloud.ru выпустила open-source инструмент Guardrails Filter для защиты данных при работе с LLM Machinelearning
    Cloud ru выложил в опенсорс Guardrails Filter — инструмент для защиты данных при работе с LLM
    
    Работает как слой между приложением и моделью: перед отправкой запроса маскирует персональные данные, API-ключи, пароли и другую конфиденциальную информацию синтетическими значениями, а после ответа модели восстанавливает оригиналы. 
    
    Вы можете развернуть Guardrails Filter внутри своей инфраструктуры и самостоятельно управлять сервисом через личный кабинет.
    
    Что внутри: 
    — стандартные и кастомные правила детекции (например, под внутренние ID, номера договоров) 
    — логирование событий безопасности 
    — тестовый режим Ghost Mode, который позволяет проверить работу сервиса до включения защиты
    
    На публичном бенчмарке pii-bench инструмент показал 93,1 по F1 и 99,9% точности срабатываний.
    
    GitVerse | GitHub