OpenAI, Anthropic, 그리고 Google DeepMind는 수주간의 안전 협의를 진행했음을 확인했습니다.

- OpenAI , Anthropic , 그리고 Google DeepMind는 수주 동안 AI 안전 조치에 대해 협력해 왔다고 확인했습니다.
- 세 연구소는 사이버 보안에 초점을 맞춘 AI 모델, 보호 조치 및 접근 프로그램을 공동으로 공개했습니다.
- 이번 협력은 연구소들이 수년간 공개적으로 협력하기보다는 경쟁해 온 끝에 이루어졌습니다.
오픈AI , 앤스로픽 , 그리고 구글 딥마인드는 이번 주, AI 안전 대책 마련을 위해 수주간 협력해 왔다고 발표하며, 세 기관이 공동으로 개발한 사이버 보안 중심의 AI 모델, 보호 장치, 접근 관리 프로그램을 공개했습니다. 이번 발표는 기업 고객, 연구 인재, 컴퓨팅 인프라 확보를 놓고 세 기관이 직접 경쟁하는 상황에서, 그동안 공동 이니셔티브보다는 경쟁 우위를 강조해 온 기존 공개 행보와는
확연히 다른 행보입니다.
사이버 보안에 대한 구체적인 초점은 의도적인 것으로 보입니다. AI 모델이 코드 작성 및 분석 능력을 향상시키면서 사이버 공격 방어에 유용하게 사용될 수 있는 동시에, 악용될 경우 공격을 실행하는 데에도 사용될 수 있게 되었는데, 이러한 이중 용도 문제는 보안 연구원과 정책 입안자 모두의
관심을 점점 더 끌고 있습니다. 이러한 특정 기능에 대한 공동 보호 조치를 마련함으로써 세 연구소는 모델 아키텍처나 훈련 방법 등 경쟁 관계에 더 직접적으로 영향을 미칠 수 있는 광범위한 협력
없이도 모두에게 거의 동일하게 영향을 미치는 위험에 대응할 수 있습니다.
이번 발표는 두 가지 관련 사건이 발생한 주에 나왔습니다. 하나는 스코틀랜드에서 왕실 주최로
열린 AI 안전 정상 회담으로, 이 연구소들과 엔비디아의 임원들이 한자리에 모였습니다. 다른 하나는 연구원들이 승인된 보안 훈련의 일환으로 앤트로픽의 클로드 모델을 사용하여 오픈AI의 내부 시스템을 침해한 사건이 보도된 것입니다. 이 세 가지 사건을 종합해 보면, 업계가 특정 안전 및 보안
위험을 공동 대응이 필요한 공동 문제로 점점 더 인식하고 있음을 알 수 있습니다. 동시에 이들 기업들은 모델 성능, 가격, 기업 파트너십 등 거의 모든 분야에서 치열한 경쟁을 벌이고 있습니다.
향후 공동 안전 조치가 구체적으로 어떻게 유지될지, 특히 세 연구소가 향후 안전 정보 공개에 대해 지속적으로 협력할 계획인지 아니면 사이버 보안 문제에 특화된 일회성 협력인지에 대한 세부 사항은 아직 완전히 공개되지 않았습니다. 업계 관계자들은 이러한 협력이 반복적인 패턴이 될지, 아니면 AI 기반 사이버 공격에 대한 특정 공동의 우려에 대한 일회성 대응으로 끝날지 주목할 것으로
보입니다.
세 연구소가 모델 편향이나 허위 정보 생성에 악용되는 등의 광범위한 안전 문제보다는 사이버 보안에 구체적으로 초점을 맞춘 것은, 기업들이 사이버 위험을 시급한 협력 조치가 필요한 영역으로 인식하고 있으며, 동시에 자사 모델 아키텍처에 대한 경쟁적으로 민감한 세부 정보를 공개할 필요가 적다고 판단했음을 시사합니다. 사이버 보안 역량에 대한 공동 보호 조치를 공개함으로써 각 연구소는 독점적인 훈련 기법을 공개하지 않고도 규제 기관과 대중에게 책임감 있는 행동을 보여줄 수 있습니다. 이러한 차이점 때문에 핵심 모델 개발에 대한 심층적인 협력보다 이러한 형태의 협력이 더 수월하게 합의되었을 가능성이 높습니다.




댓글 0
첫 댓글을 남겨보세요.