Примитивы Sentinel Lattice
Sentinel Lattice - это набор runtime safety heuristics для агентных LLM-систем. В production path эти проверки работают как мониторинг, pattern/sequence analysis и policy signals, а не как формальное доказательство всех свойств системы.
Важная граница claims
- TSA мониторит небезопасные временные последовательности действий и tool calls.
- GPS оценивает риск goal drift по наблюдаемым сигналам.
- MIRE дает containment/policy signals, но не является математической гарантией изоляции модели.
- Проценты вклада каскада detection из старых черновиков не являются воспроизводимым benchmark и не должны цитироваться как эффективность продукта.
- Формальная LTL-верификация не заявляется как production поведение gateway.
Зачем это нужно
Обычные сигнатуры хорошо ловят известные классы атак, но агентные системы ломаются не только отдельной строкой prompt injection. Риск часто возникает из последовательности: запрос к памяти, tool call, внешняя отправка, повторная попытка, изменение цели. Lattice-примитивы дают gateway и SOC дополнительный слой сигналов для таких цепочек.
Основные примитивы
| Примитив | Назначение |
|---|---|
| TSA | Мониторинг временных последовательностей действий и tool calls |
| CAFL | Анализ накопления capabilities и возможного privilege escalation |
| GPS | Оценка goal drift и ухода агента от исходной задачи |
| AAS | Поиск манипулятивной аргументации и опасных reasoning patterns |
| IRM | Сигналы скрытого намерения за нейтральной формулировкой |
| MIRE | Containment/policy context для потенциально опасного поведения |
| PASR | Проверка provenance/attestation claims |
Production usage
В gateway эти сигналы должны применяться вместе с tenant policy, scan mode, memory re-scan and output scan. Если нужен строгий compliance claim или SLA, он должен ссылаться на конкретный deployment benchmark и release evidence.