Anthropic je objavio detalje o arhitekturi za ograničavanje Claudea u svojim web, razvojnim i desktop proizvodima. Tvrtka tvrdi da sigurnost agenata ovisi o postavljanju determinističkih granica na datotečni sustav, mrežu i okruženje izvršavanja, a ne samo na upite za dozvole ili zaštitu na razini modela. U kodnom okruženju „claude.ai“ se izvršavanje odvija u privremenom gVisor kontejneru na izoliranoj infrastrukturi bez pristupa lokalnom datotečnom sustavu. Claude Code, koji radi na računalima programera, najprije je koristio odobrenja po akciji za pisanje, naredbe ljuske i mrežni pristup, pri čemu su korisnici odobrili otprilike 93 % takvih upita. Nakon uvođenja OS‑razine sandboxa – Seatbelt na macOS‑u i bubblewrap na Linuxu – broj upita za dozvole smanjen je za 84 % i mrežni pristup je po zadanom onemogućen.