# 오픈AI GPT-4 코드 오류 식별 모델 크리틱 GPT 공개

**💡소나 인사이트 : 오픈AI의 크리틱GPT는 GPT-4가 생성한 코드의 오류를 식별해, 인간이 감지하기 어려운 AI 출력 문제까지 해결할 수 있어요.**

---

오픈AI는 GPT-4를 활용해 GPT-4가 생성한 코드에서 오류를 식별하는 모델인 ‘크리틱GPT’를 공개했어요. 크리틱GPT는 인간 트레이너가 발견하지 못하는 오류나 환각을 식별하며, 이는 인간 피드백 강화학습(RLHF) 과정에 통합돼요. 챗GPT의 추론 및 모델 행동이 향상됨에 따라 더 미묘한 실수를 감지하기 어렵게 되어, 모델 정렬을 더 어렵게 만들 수 있어요. 이를 해결하기 위해 크리틱GPT는 챗GPT의 답변에서 부정확성을 강조하는 비평을 작성하도록 훈련되었고, 다양한 코딩 오류를 인식하고 표시하는 방법을 배웠어요. 훈련 과정에서 인간 트레이너들이 수동으로 삽입한 오류를 통해 크리틱GPT는 더 포괄적인 비평을 작성할 수 있게 되었고, 인간 트레이너들이 작성한 비평보다 선호되었어요. 오픈AI는 크리틱GPT를 RLHF 파이프라인에 통합해 실용화할 계획이에요.

For the site tree, see the [root Markdown](https://slashpage.com/sonastation.md).
