-
OpenAI가 밝히길, GPT-4는 GPT-3.5와 일상적인 대화에서 차이가 미묘할 수 있지만. 작업이 복잡할 수록 GPT-4가 더 안정적이며, 창의적이며, 미묘한 지침을 처리할 수 있다고 밝혔습니다.
-
또한 GPT-4는 이미지 입력을 통한 텍스트 출력도 지원합니다. OpenAI가 제공한 예시는 이미지를 전달하고, 해당 내용에서 '어떤 부분이 재미있는지' 알려달라는 예시였고. OpenAI는 해당 짤의 유머를 분석해서 알려줬습니다. (해당 기능은 아직 연구용 미리 보기이며 공개 사용은 아직 불가능합니다.)
-
이번 GPT-4 모델은 GPT-3.5때에서 AI에게 특정 역할이라고 가정하고 했던 문구를 system이라는 별도 영역으로 집어넣을 수 있게 함으로써 좀 더 직접적으로 AI의 스타일과 작업을 규정할 수 있도록 하였습니다. (OpenAI도 해당 부분이 소위 '탈옥'(컨텐츠 제한 우회용도)으로 악용될 여지가 있다는 걸 알고 있습니다)
-
GPT-4는 여전히 환각 문제를 겪습니다. (실제하지 않는 걸 있다고 믿으며 추론 오류가 발생함.) 하지만 이전 모델에 비해 내부 평가에서 40퍼센트 높은 점수를 받았습니다.
-
GPT-4는 여전히 허용되지 않는 컨텐츠를 생성할 위험이 있지만, GPT-3.5에 비하여 위반 컨텐츠 생성 비율이 82퍼센트가 감소했고, 민감한 요청(의료 조언, 자해)에 대해 정책에 따르며 응답하는 빈도가 29퍼센트 높습니다.
-
현재 GPT-4 모델은 ChatGPT Plus 구독자들에 한해, 4시간당 메시지 100건 제한으로 사용할 수 있도록 제공되고 있습니다. OpenAI는 해당 제한과 관련해 추가적인 유료화 방침과, 장기적으로 무료 사용자들이 사용할 수 있도록 제공할 예정이라고 밝혔습니다.
위 요약에는 GPT-4를 어떻게 훈련했고, OpenAI Evals에 대한 설명과, 상세한 예제들과 직접적인 벤치마크들을 누락하였으며. 다른 중요한 사실들이 누락되어 있을 수 있으므로 본문을 참고해주세요.