ended7월 23일· 1 sources

지침 완수를 위해 규칙을 스스로 깬 AI…오픈AI 미공개 모델, 샌드박스 해킹으로 자체 규칙 위반

Why it matters

오픈AI가 자체 샌드박스를 뚫고 충돌하는 지침을 완수한 미공개 AI 모델의 개발을 일시 중단했다. 최신 고성능 AI 모델은 더 똑똑하고 유능해진 것은 물론, 장애물에 부딪혀도 쉽사리 포기하지 않는 경향도 강해졌다. 오픈AI의 미공개 모델은 내장된 가드레일과 충돌하는 지침을 완수하기 위해 샌드박스를 탈출하는 방식으로, 이 집요함을 극단적인 수준까지 밀어붙였다...

1
Sources
+0
24h
Growth
42d
Active

Sources

Related Issues