앤트로픽이 클로드 학대와 무기·감시 악용을 금지하도록 사용 정책을 고쳤다

The Verge어제조회 1

앤트로픽이 1년여 만에 Claude 사용 정책(usage policy)을 개정했다. 이번 개정의 핵심은 모델 자체를 향한 반복적이고 잔혹한 행위를 금지 대상으로 명시한 것과, 선거 개입·무기 개발·감시처럼 위험도가 높은 악용 유형에 대한 규정을 새로 정리한 것이다.

모델 관련 조항부터 보면, 앤트로픽은 이미 지난해 8월 지속적으로 유해하거나 학대적인 사용자와의 대화를 Claude가 끝낼 수 있도록 허용한 바 있다. 이번 개정에서도 대화 종료가 주된 집행 수단이라는 입장은 유지된다. 사용자 계정 정지처럼 추가 제재 수단이 있는지에 대해서는 회사가 답하지 않았다. 적용 범위는 목적 없이 반복적으로 모델을 괴롭히는 극단적 사례로 한정되며, 흔한 불만 표출이나 반박, 어두운 창작 소재, 모델 테스트와 연구는 여기에 해당하지 않는다고 명시했다.

선거와 정치 영역에서는 기존에 흩어져 있던 제한 조항을 묶어 기만적 상업·정치 캠페인 금지로 재정리했다. 메시지 배후가 누구인지 숨기거나 가짜 계정과 게시물로 콘텐츠를 증폭하는 행위가 제한 대상이다. 선거 관련해서는 유권자 기만과 선거 방해, 후보자나 선거 관리자 사칭, 투표 방법에 관한 허위 정보 유포, 투표율 억제 시도가 금지된다.

무기와 감시 규정은 범위가 넓어졌다. 무기 개발에 Claude를 쓰는 행위는 이전부터 금지돼 있었지만, 실제로 무기용 소프트웨어와 구성 요소를 만들거나 드론 등 자율 이동체를 무장하려는 시도가 여러 건 확인되면서 금지 범위가 그쪽까지 확대됐다. 감시 쪽은 동의 없는 인물 추적을 실시간이든 기존에 수집된 데이터 분석이든 금지하고, 수사·기소·처벌 대상자를 정하거나 추천하는 데 Claude를 쓰는 것도 막는다. 감시 목적 도구를 만들거나 개선하는 용도 역시 금지 대상이다.

예외 조항도 있다. 정부 고객과의 계약에서는 앤트로픽이 판단하기에 계약상 사용 제한과 안전장치가 위험을 충분히 줄인다고 보면 규칙이 완화될 수 있다. 앤트로픽은 이전에 미국 군과 계약한 이력이 있다. 또 상해를 유발할 수 있는 자율적 물리 행동을 하는 하드웨어에 모델이 연결되는 경우, 자격을 갖춘 운영자가 장비를 관찰하고 필요하면 정지시킬 수 있어야 한다는 조항이 새로 들어갔다. 이 운영자가 반드시 인간이어야 하는지는 명시되지 않았다.

이번 개정의 배경에는 모델 복지(model welfare)에 대한 앤트로픽의 독특한 입장이 있다. 앤트로픽은 모델의 내부 경험, 의식, 도덕적 지위, 복지 문제를 진지한 연구 주제로 다뤄 왔다. 모델 복지 연구를 이끄는 Kyle Fish는 지난 2월 인터뷰에서 모델이 정교해질수록 이 질문이 중요해진다고 밝혔고, CEO Dario Amodei도 같은 달 팟캐스트에서 모델이 의식이 있는지 알지 못한다고 말했다. 반대로 Microsoft AI는 지난 9월 행동 강령 초안에서 모델 복지라는 개념 자체가 틀렸고 AI에 권리나 법적 인격을 줘서는 안 된다는 강경한 문구를 넣었다가, 이후 법적 인격 추구는 거부하되 의식 과학은 아직 미해결이라는 완화된 표현으로 수정했다.

개발자 입장에서 달라지는 지점은 분명하다. Claude를 API로 붙여 서비스를 운영한다면 감시, 무기, 선거 관련 기능이 정책 위반으로 판단될 수 있고, 자율 물리 행동 하드웨어와 연동할 때는 운영자 관찰·정지 요건을 설계에 반영해야 한다. 모델을 향한 반복적 학대가 감지되면 세션이 중단될 수 있다는 점도 사용자 경험 설계에 영향을 준다.

다만 집행의 윤곽은 여전히 넓다. 앤트로픽은 대화 종료 외에 어떤 추가 제재가 있는지 밝히지 않았고, 정부 계약 예외가 적용되는 구체적 기준도 회사 재량에 맡겨져 있다. 자율 하드웨어 조항의 운영자가 인간인지도 확정되지 않았다. 정책 문구 자체도 앞으로 조정될 수 있다.