무슨 일이 있었나
테크크런치 보도에 따르면 OpenAI는 순환 깊이(recurrent depth)로 알려진 기법에 의존하는 아스트라(Astra)라는 새 모델을 선보이고 있다.
이 방식을 사용하면 모델이 현재 많은 추론 시스템에서 흔히 볼 수 있는 순차적 추론 과정을 거치지 않아도 된다.
왜 중요한가
순환 깊이를 활용하면 모델이 덜 선형적인 경로를 통해 결론에 도달할 수 있게 되는데, 이는 감독과 해석 가능성을 둘러싸고 AI 안전 전문가들 사이에서 새로운 우려를 불러일으키고 있다.
추론이 더 이상 단계적인 순서를 따르지 않게 되면, 모델이 어떻게 특정 결정에 도달했는지 추적하기가 더 어려워질 수 있다.
핵심 사실
OpenAI의 새로운 아스트라 모델은 순환 깊이를 사용할 예정이다.
순환 깊이는 대부분의 추론 모델에서 전형적으로 나타나는 순차적 사고 방식을 벗어난 작동을 가능하게 한다.
AI 안전 전문가들은 이러한 개발 상황에 대해 우려를 표명했다.
앞으로 지켜볼 점
관찰자들은 순환 깊이가 실제 배포 환경에서 모델 행동을 예측 불가능하게 만들 수 있는지 여부도 주시할 것으로 보인다.
안전 연구자들은 아스트라의 내부 추론 경로에 대해 더 높은 투명성을 요구할 수 있다.
