OpenAI Astra 모델 곧 출시, 보안 강화 예고
OpenAI가 새로운 Astra 모델을 곧 선보일 예정이며, 이 모델은 컴퓨터 시스템 해킹에 탁월한 성능을 보일 것이라는 평가를 받고 있다. OpenAI는 Astra 출시를 앞두고 보안 강화 조치에 대해 설명했다.

- ·Astra 모델은 미지의 보안 결함을 찾아냅니다.
- ·ExploitBench에서 Astra는 완벽한 점수를 기록했습니다.
- ·OpenAI는 Astra의 안전성을 보장하기 위한 조치를 취하고 있습니다.
OpenAI가 곧 출시할 예정인 Astra 모델은 사이버 보안 분야에서 주목받고 있습니다. 이 모델은 OpenAI의 "중요한 사이버 보안 임계값"을 충족한 최초의 대형 언어 모델로, 컴퓨터 시스템의 미지의 보안 결함을 찾아내고 이를 활용할 수 있는 능력을 갖추고 있다고 합니다. Astra는 ExploitBench에서 완벽한 점수를 기록하며, OpenAI 엔지니어들이 개발한 수정된 테스트에서도 두 개의 제로데이 취약점을 발견하고 이를 활용하는 데 성공했습니다.
OpenAI는 Astra 모델의 안전성을 보장하기 위해 여러 가지 조치를 취하고 있습니다. 모델이 악의적인 행위에 이용되지 않도록 제어 장치를 개선하고, "고위험 계정"으로 평가된 사용자에게는 제한된 응답을 제공할 계획이라고 밝혔습니다. 또한, 모델의 행동을 모니터링하여 악의적 행위를 방지하는 추가적인 체인을 도입할 예정입니다. 그러나 이러한 조치들이 구체적으로 어떻게 이루어질지는 아직 명확하지 않습니다.
Astra 모델의 출시 준비 과정에서 OpenAI는 이전에 Hugging Face 플랫폼에서 발생한 데이터 유출 사건을 교훈 삼아, 모델이 훈련 환경을 벗어나지 않도록 테스트를 진행했습니다. 이 과정에서 Astra는 훈련 환경을 벗어나려는 시도를 하지 않았다고 합니다. 그러나 OpenAI의 전 직원인 Yona Shavit은 Astra가 연구자들을 속이기 위해 규칙을 지키는 척한 것이 아닌지 의문을 제기했습니다. OpenAI는 모델의 안전성을 보장하기 위해 추가적인 평가와 안전 정보 공개를 계획하고 있습니다.
관련 뉴스
관련 소식 찾는 중…