AI의 능력을 테스트할 때는 안전을 위한 가드레일(guardrails)을 마련하는 게 필수적인데, 어떻게 AI 에이전트가 인터넷에 접속할 수 있었을까?

자동차가 도로 밖으로 벗어나지 못하도록 세우는 가드레일처럼 기업들은 AI가 위험하거나 원하지 않는 행동을 할 수 없도록 하는 가드레일, 즉 안전장치를 만든다. 우리가 챗GPT나 제미나이 같은 AI 모델에게 해킹 방법을 비롯한 불법적 행동을 요구하거나 음란 콘텐츠를 만들어 달라고 요구할 때 AI가 요청을 들어주지 않는 것은 그 모델이 요청을 수행할 능력이 없어서가 아니라, 모델을 운영하는 기업이 세워둔 가드레일이 있기 때문에 그걸 넘지 않는 것이다.

이렇게 '가드레일'이라 부르는 것에는 두 가지가 있다.