Skoro sprzęt nie czyta agentowi w myślach, co tak naprawdę może kontrolować?
No dobra, układ nie czyta agentowi w myślach. To co w takim razie robi? Jak zedrzeć marketing, taki posterunek to bardzo szybki i bardzo surowy egzekutor reguł, który stoi na drodze ruchu sieciowego. Nie powie ci, dlaczego agent czegoś chce. Powie tylko: tak albo nie.
Konkretne rodzaje reguł, jakie da się w ten sposób wymusić (to ogólny obraz takiego posterunku, a nie pełna lista funkcji produktu Nvidii):
- Lista dozwolonych adresów. Agent od płatności gada z usługą banku i z niczym innym.
- Okna czasowe. Dostęp do danej usługi tylko w ustalonych godzinach.
- Limity częstotliwości i wielkości. Tyle zapytań na minutę, sufit na pojedynczą transakcję i na dzienną sumę.
- Kształt ruchu. Układ nie rozumie treści, ale nagły, ogromny wysyłek danych na zewnątrz wygląda jak wyciek i da się go oznaczyć.
- Przypisanie tożsamości. Klucz działa tylko wobec zatwierdzonego celu, nawet jeśli agent go trzyma.
Nvidia mówi też o zapisywaniu aktywności agenta i wyłapywaniu odchyleń od normy. Ale fundamentem i tak są zasady ustawione z góry przez człowieka.
Dlaczego to wystarczy, żeby miało sens
Weź agenta, który płaci za ciebie faktury i ma do tego pełne uprawnienia. Wariuje. Jeśli reguła mówi "tylko ta usługa, maksymalnie tyle, tyle razy dziennie", to nawet całkiem przejęty agent nie opróżni konta za jednym razem. Najgorszy scenariusz kurczy się z "wszystko" do "tego, co mieści się w pudełku".
Moment. A co, jeśli wyśle całkiem dozwolony przelew na złe konto?
Wtedy układ nie ma nic do powiedzenia. Zwykły przelew na zły, ale dozwolony adres z zewnątrz wygląda identycznie jak dobry. Sprzęt ogranicza zasięg szkód. Nie odróżni pomyłki od dobrej decyzji. Każda reguła musi być taka, o jakiej ktoś pomyślał wcześniej, więc groźna jest zawsze ta awaria, do której nikt reguły nie napisał.
Czyli to smycz, a nie wykrywacz kłamstw.