Anthropic je objavio detalje o arhitekturi za ograničavanje Claudea u svojim web, razvojnim i desktop proizvodima. Tvrtka tvrdi da sigurnost agenata ovisi o postavljanju determinističkih granica na datotečni sustav, mrežu i okruženje izvršavanja, a ne samo na upite za dozvole ili zaštitu na razini modela. U kodnom okruženju „claude.ai“ se izvršavanje odvija u privremenom gVisor kontejneru na izoliranoj infrastrukturi bez pristupa lokalnom datotečnom sustavu. Claude Code, koji radi na računalima programera, najprije je koristio odobrenja po akciji za pisanje, naredbe ljuske i mrežni pristup, pri čemu su korisnici odobrili otprilike 93 % takvih upita. Nakon uvođenja OS‑razine sandboxa – Seatbelt na macOS‑u i bubblewrap na Linuxu – broj upita za dozvole smanjen je za 84 % i mrežni pristup je po zadanom onemogućen.
Anthropic opisao je arhitekturu za ograničavanje Claudea u web, kodnom i radnom okruženju
Izvori
Originalni sadržaj iz javnih izvora. Pune članke ne objavljujemo — kliknite za izvornu publikaciju.
- infoq.com (2026-07-22 12:26) Pročitaj original ↗
AI će pretražiti dodatne izvore i sintetizirati detaljniji sažetak (8-12 rečenica) iz više izvora. Rezultat se ne sprema javno i ne indeksira.