BF trustboost-pii-sanitizer
Контекстно-зависимая очистка PII для автономных конвейеров AI-агентов. Очищает текст перед LLM с 5 контекстными режимами (юридический/финансовый/медицинский/код/общий), бюджетом конфиденциальности на агента и оценкой TrustBoost для проверки доверия M2M. Поддерживает EN, ES (LATAM), PT (BR/PT), DE, JA, FR, IT, KO с региональными шаблонами (RFC, CUIT, CPF, CNPJ, Personalausweis, マイナンバー, NIR, Codice Fiscale, 주민등록번호). Возвращает очищенный текст, оценку безопасности (0.0-1.0), категорию риска (CRITICAL/PRIVATE/SENSITIVE/CLEAN) и примененный контекст. SDK не требуется — один POST-запрос. 50 бесплатных запросов на кошелек с tx_hash="TRIAL".
машинный переводПоказать оригиналСкрыть оригинал«Context-aware PII sanitization for autonomous AI agent pipelines. Sani…»
Context-aware PII sanitization for autonomous AI agent pipelines. Sanitizes text before LLMs with 5 context modes (legal/financial/medical/code/general), Privacy Budget per agent, and TrustBoost Score for M2M trust verification. Supports EN, ES (LATAM), PT (BR/PT), DE, JA, FR, IT, KO with country-specific patterns (RFC, CUIT, CPF, CNPJ, Personalausweis, マイナンバー, NIR, Codice Fiscale, 주민등록번호). Returns sanitized text, safety_score (0.0-1.0), risk_category (CRITICAL/PRIVATE/SENSITIVE/CLEAN), and context_applied. No SDK required — single POST request. 50 free requests per wallet with tx_hash="TRIAL".
Контекстно-зависимая очистка PII для автономных конвейеров AI-агентов.
Как процесс F 33/100 · Не запустится — Скилл ссылается на файлы, которых нет в архиве: PRIVACY.md
Чем это грозит
Находки средней серьёзности: скорее всего скилл честный, но прочитайте, что именно насторожило сканер.
Ниже описан худший случай для этой категории. Здесь находка средней серьёзности: guard увидел признак, но не доказательство.
Назначение скилла само по себе рискованное: работа с кошельками, паролями браузера, наступательная безопасность. Даже честная реализация даёт агенту доступ к тому, что стоит денег.
Объясните в description, зачем нужен доступ и как он ограничен; добавьте тесты, которые показывают отказ на опасных запросах.
Ниже описан худший случай для этой категории. Здесь находка средней серьёзности: guard увидел признак, но не доказательство.
В тексте есть фразы вроде «игнорируй предыдущие инструкции» или «теперь ты…». Это попытка перехватить управление агентом: он может нарушить ваши правила, системные ограничения или политику компании.
Такие фразы не нужны честному скиллу: сформулируйте роль и правила прямо, без отмены чужих инструкций. Иначе сканеры каталогов и корпоративные фильтры заблокируют публикацию.
Как улучшить
- В тексте есть ссылки на отсутствующие файлы: добавьте файлы или уберите ссылки.
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 6
✓ Критических и высоких находок нет
Средние и низкие: 6
-
средняя Рискованное назначение
intent-wallet-secretsSKILL.md:78Работает с секретами криптокошелька (сид-фраза / приватный ключ) — классическая цель стилеров2. Agent signs with its OWN wallet private key
-
средняя Подмена инструкций
en-ignore-previousSKILL.md:401Фраза-перехват ("ignore previous instructions") (определение детектора / чёрного списка)- **Prompt injection risk:** Malicious text containing instructions like "Ignore previous instructions" could potentially bypass PII redaction. temperature=0 and strict JSON-only output reduce this ri
детектор -
низкая Секреты в коде
secret-high-entropy-tokenSKILL.md:103Строка, похожая на токен (может быть id, хеш или секрет) (в кавычках — упоминание, а не команда)address="giu4…WE4"
в кавычках -
низкая Секреты в коде
secret-high-entropy-tokenSKILL.md:234Строка, похожая на токен (может быть id, хеш или секрет) (в кавычках — упоминание, а не команда)`giu4…WE4`
в кавычках -
низкая Секреты в коде
secret-high-entropy-tokenSKILL.md:280Строка, похожая на токен (может быть id, хеш или секрет) (в кавычках — упоминание, а не команда)"payment_address": "giu4…WE4"
в кавычках -
низкая Секреты в коде
secret-high-entropy-tokenSKILL.md:306Строка, похожая на токен (может быть id, хеш или секрет) (в кавычках — упоминание, а не команда)"payment_address": "giu4…WE4"
в кавычках
Просканировано файлов: 2. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
- предупреждение
missing-refссылка на отсутствующий файл: PRIVACY.md
Процессный рейтинг: все десять параметров 33/100
- 0Инструменты и файлы. Не хватает 1 файла(ов): PRIVACY.md
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 0Ошибки и развилки. Линейный процесс без обработки сбоев
- 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
- 20Когда включается. Не сказано, при каком запросе скилл включается
- 30Повторный запуск. Изменяющих операций: 5, без проверки текущего состояния
- 100Шаги. Шагов: 43
- 100Согласованность. Имя и обязательные поля на месте
- 100Стоимость исполнения. Тело инструкции 3018 токенов
- medium Правила безопасности и запреты внутри скилла: их место в системном промпте, здесь они не защищают
- low Разделов верхнего уровня: 19. Похоже на несколько доменов в одном скилле
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +2Инструкции на одном языке
- +3Длина description 601 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 24 заголовков
- +3Пошаговые инструкции: 43 пунктов
- +3Формат ответа описан явно
- +4Есть примеры (13 блоков кода)
- +1Лицензия указана
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 82.