Агент может самостоятельно:
- читать документы;
- анализировать;
- создавать draft;
- создавать issue.
Но должен запросить подтверждение перед:
- отправкой письма;
- оплатой;
- удалением;
- публикацией;
- изменением production;
- заключением обязательства.
Так появляется human-in-the-loop.
Но его следует преподавать не как «паттерн AI safety», а как структуру распределения полномочий.
Практика
Составить Authority Matrix:
| Действие | Агент может подготовить | Агент может выполнить | Требуется approval |
|---|---|---|---|
| Чтение документов | Да | Да | Нет |
| Draft письма | Да | Нет | Перед отправкой |
| Изменение production | Да | Нет | Всегда |
| Удаление данных | Да | Нет | Отдельное подтверждение |
Результат модуля
Студент умеет проводить границу между предложением действия, его выполнением и ответственностью за последствия.