ChatGPT 고블린 집착 사태와 3가지 해결법

AI가 자꾸만 고블린 이야기를 꺼낸다면 어떨까요? 실제로 OpenAI의 ChatGPT가 고블린과 그렘린 같은 신화 속 생물을 비유에 과도하게 사용하는 문제가 있었고, 회사가 직접 원인을 밝혀 화제가 됐습니다. ChatGPT 고블린 집착 사태는 GPT-5.1 시절부터 시작돼 GPT-5.5에 이르러서야 해결됐는데요. 왜 이런 일이 벌어졌는지, OpenAI가 어떻게 대응했는지 정리해 드립니다.

A cute mischievous green goblin peeking out from behind a glowing computer screen displaying a chat interface in a dark blue tech office setting digital illustration style vibrant colors 4:3

ChatGPT 고블린이 갑자기 늘어난 이유

문제의 시작은 GPT-5.1부터였습니다. OpenAI에 따르면 이 시기부터 모델이 비유를 할 때 고블린, 그렘린 같은 생물을 점점 자주 언급하기 시작했다고 합니다.

  • 처음에는 답변에 고블린이 한 번 등장하는 정도
  • 세대를 거듭할수록 등장 빈도가 계속 증가
  • GPT-5.4까지도 사용자와 직원 모두가 체감할 수준

답변 하나에 작은 고블린이 한 마리 등장하는 건 오히려 재미있을 수 있습니다. 하지만 대화마다 계속 튀어나오니 이야기가 달라졌죠. OpenAI 직원들의 내부 신고가 늘어나면서 회사 차원에서 원인 추적에 나섰습니다.

원인은 너디 페르소나 학습 방식이었다

고블린 집착의 뿌리는 ChatGPT에 잠시 제공됐던 너디 페르소나 옵션이었습니다. 이 성격을 만들기 위해 OpenAI는 신화 속 생물을 활용한 창의적인 비유를 쓰면 모델에 보상을 주는 방식으로 학습시켰습니다.

문제는 너디 페르소나 기능이 사라진 뒤에도 모델이 고블린과 그렘린에 대한 애착을 버리지 못했다는 점입니다. 보상으로 각인된 습관이 기능 폐기 후에도 남아 버린 거죠. AI의 강화학습이 얼마나 끈질기게 작용하는지 보여주는 재미있는 사례입니다.

A whimsical illustration of fantasy creatures like goblins and gremlins emerging from an open book next to a laptop on a wooden desk warm lighting cozy study room atmosphere no text 4:3

OpenAI가 택한 해결 방법은 무엇일까

OpenAI는 GPT-5.5 출시 전에 이 문제를 선제적으로 해결했습니다. 방법은 의외로 단순했는데요, 시스템 지침에 명시적인 금지 조항을 넣은 겁니다.

  • 고블린, 그렘린, 라쿤, 트롤, 오거, 비둘기 등 열거
  • 사용자 질문과 명확히 관련된 경우에만 언급 허용
  • 그 외 상황에서는 해당 생물 관련 표현 금지

즉 질문과 절대적으로 관련이 있지 않으면 이런 동물이나 생물을 입 밖에 꺼내지 말라는 지시를 내린 겁니다. 지난해 8월 GPT-5.0 출시 때의 혼란과 비교하면 GPT-5.5는 이런 사전 조치 덕분에 훨씬 매끄럽게 출시됐다는 평가를 받고 있습니다.

A clean modern infographic style illustration of a checklist document with shield icon blocking small cartoon monster silhouettes blue and teal gradient background flat design no text 4:3

Codex에서 고블린 모드를 여는 방법

그래도 고블린이 그리운 분들을 위한 뒷문이 남아 있습니다. Codex에서는 특정 설정을 통해 고블린 제한을 해제할 수 있는데요.

방법은 간단합니다. 모델 캐시 파일에서 GPT-5.5의 기본 지침을 추출한 뒤 고블린 관련 조항을 걸러내고, 수정된 지침 파일로 Codex를 실행하는 방식입니다. OpenAI가 직접 이 우회 방법을 공유했다는 점이 흥미롭죠. 다만 회사 측도 자기 책임 하에 시도하라는 문구를 덧붙였습니다.

Playful green goblins and gremlins running freely around a programmer desk with dual monitors showing code dark room with colorful screen glow fantasy meets technology illustration 4:3

이번 사태가 남긴 것

이번 사건은 AI 모델의 학습 습관이 얼마나 예상 밖의 형태로 남을 수 있는지 보여줍니다. 한 번 보상으로 심어진 경향은 기능을 없애도 쉽게 사라지지 않았고, 결국 명시적 금지라는 직접적인 처방이 필요했습니다. 사용자 입장에서는 AI의 답변이 왜 특정 방향으로 치우치는지 이해할 수 있는 좋은 사례이기도 합니다.

A person having a friendly conversation with an AI chatbot on a smartphone while a tiny goblin shadow fades away in the background soft purple gradient lighting modern lifestyle photography style 4:3

마치며

작은 고블린 한 마리가 AI 업계의 흥미로운 이야기거리가 됐습니다. ChatGPT 고블린 집착 사태는 유머러스한 해프닝처럼 보이지만, 강화학습의 부작용과 모델 제어의 어려움을 동시에 보여주는 사례입니다. 앞으로 GPT 업데이트 때마다 어떤 새로운 습관이 발견될지 지켜보는 것도 재미있겠네요. 혹시 여러분도 AI 답변에서 이상하게 반복되는 표현을 발견하신 적 있다면 댓글로 공유해 주세요.

출처: https://9to5mac.com/2026/04/30/openai-explains-why-chatgpt-developed-a-goblin-fixation-and-how-it-solved-the-issue/

함께 보면 좋은 글

​#ChatGPT #고블린 #OpenAI #GPT5 #Codex #AI이슈 #인공지능 #너디페르소나 #그렘린 #AI업데이트

Leave a Comment

error: Content is protected !!