Cloud.ru выложил в open source Guardrails Filteri — инструмент, который защищает конфиденциальные данные при обращении к LLM. Он работает как промежуточный слой между приложением и моделью: перед отправкой запроса маскирует пароли, персональные данные, API-ключи и другую чувствительную информацию, заменяя её синтетическими значениями, а после получения ответа от модели восстанавливает оригинальные данные.
Инструмент можно развернуть внутри собственной инфраструктуры компании и управлять им через личный кабинет, что снимает необходимость передавать реальные секреты во внешние ИИ-модели.
93,1F1-метрика на бенчмарке pii-bench
99,9%точность срабатываний детекции
- Внутри инструмента — стандартные и кастомные правила детекции, позволяющие настраивать распознавание, например, внутренних ID или номеров договоров
- Реализовано логирование событий безопасности
- Есть тестовый режим Ghost Modei, позволяющий проверить работу сервиса до включения полноценной защиты
- На публичном бенчмарке pii-benchi инструмент показал F1-метрику 93,1 и точность срабатываний 99,9%
- Исходный код опубликован на GitVerse и GitHub
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖