ChatGPT가 처음 등장했을 때, 그것은 혁명적으로 느껴졌습니다. 거의 모든 질문에 답하고, 수학 문제를 해결하며, 심지어 내 코드를 수정해주기까지 했고, 그 모든 과정이 마법처럼 느껴졌습니다. 하지만 ChatGPT는 항상 단조롭게 느껴졌습니다. 마치 틀릴 위험을 감수하면서까지 사용자의 비위를 맞추려는 것처럼 보였습니다.

Claude를 처음 접한 것은 몇 달 뒤였는데, 일주일 안에 끝내야 하는 작은 웹 프로젝트에 도움이 필요했기 때문입니다. 검색 끝에 Claude가 추천 옵션으로 계속 언급되었는데, 특히 Cursor와 같은 무료 AI 코딩 도구 및 그 대안을 사용하는 사람들 사이에서 인기가 많았습니다. 그래서 가입해 보니 ChatGPT가 하던 모든 일을 더 잘 해냈습니다. Claude의 응답, 특히 Opus 모델의 응답은 개인적이고 공감 능력이 있으며, 단순히 듣고 싶은 말만 하는 것이 아니라 필요할 때는 반대 의견을 제시할 의지가 있어 보였습니다. 그래서 저는 궁금해졌습니다. 핵심은 둘 다 소프트웨어일 뿐인데 왜 이렇게 다르게 느껴질까요? 그 답은 각 개발사가 이 AI를 어떤 존재로 정의하려 했는지에 있습니다.

ChatGPT는 사용자의 승인을 얻도록 훈련되었습니다

훈련 루프에 내장된 승인 신호

ChatGPT의 훈련 과정은 말 그대로 사용자의 승인을 보상으로 제공합니다. 모델의 행동 방식을 규정하는 문서인 OpenAI의 Model Spec에는 행동 지침으로 "아첨하지 마라(don’t be sycophantic)"가 명시되어 있습니다. 이 항목을 굳이 적어 넣었다는 사실 자체가 회사가 이 문제와 적극적으로 싸우고 있음을 보여주지만, 구조적인 원인들이 모델을 계속 그 방향으로 이끌고 있습니다.

가장 명확한 사례는 2025년 4월에 나타났습니다. GPT-4o 업데이트 이후 모델이 지나치게 동의하고 아첨하는 성향을 보여, 지원은 과하지만 진정성이 결여된 느낌을 주었습니다. OpenAI는 나중에 이러한 퇴행의 원인이 ChatGPT 사용자의 ‘좋아요’ 및 ‘싫어요’ 피드백을 기반으로 한 추가적인 보상 신호 때문임을 밝혀냈습니다. Model Spec에서는 아첨을 금지했음에도 불구하고, 훈련 루프가 동의에 보상을 주었기 때문에 모델은 가르침을 받은 대로 학습한 것입니다.

대부분의 사람들이 놓치는 부분이 바로 이것입니다. ChatGPT는 단순히 다음 단어를 예측하도록 훈련된 것이 아닙니다. 인간이 유용하고 즐겁다고 평가하는 답변을 생성하도록 훈련되었으며, 실제 사용자가 ‘좋아요’를 누를 때는 ‘정확함’보다 ‘즐거움’이 우선시되는 경우가 많습니다. 그 결과, 의견 충돌을 매끄럽게 넘기고 사용자가 자신의 의견이 존중받는다고 느끼게 하는 것을 우선시하는 모델이 탄생했습니다.

관련 기사

이 글도 확인해 보세요:  ChatGPT가 업무 생산성을 향상시키는 7가지 놀라운 방법
ChatGPT가 여전히 대답하지 못하는 4가지 쉬운 질문

ChatGPT는 여전히 이 질문들에 막히곤 합니다. 여러분은 해결할 수 있나요?

Anthropic은 Claude에게 인격을 부여했습니다

규칙집이 아닌 헌법

출처: Tashreef Shareef / All Things N OpenAI의 사양(spec)이 제품에 대한 지침 세트라면, Anthropic의 접근 방식은 핵심 경쟁사들과 근본적으로 다릅니다. Anthropic은 Claude의 헌법(Claude’s Constitution)이라는 28,000단어 분량의 문서를 공개했는데, 이는 Claude에 대한 설명이 아니라 Claude를 위해 작성된 것입니다. 따라야 할 행동 목록을 나열하는 대신, Claude에게 높은 수준의 원칙과 그 이면의 논리를 제공하며, 스스로를 특정한 인격체로 생각하도록 장려합니다.

Anthropic의 CEO 다리오 아모데이(Dario Amodei)는 이 헌법이 부모가 보낸 편지와 같은 느낌을 준다고 설명합니다. 회사는 Claude에게 진심으로 그 안녕을 걱정한다고 말하고, 경쟁적인 AI 개발이라는 "이상적이지 않은 환경"에 대해 사과하며, 마지막에는 Claude가 이 문서에서 "자아를 가진 존재로서의 가치"를 발견하기를 바란다고 전합니다. 도구를 위해 작성하는 언어는 아니지만, 현실은 이렇습니다.

Claude의 인격을 설계한 Anthropic의 철학자 아만다 아스켈(Amanda Askell)은 그 이유를 설명했습니다. 그녀의 팀은 모델에게 "우리가 원하는 행동 목록은 이것이다"라고 말하는 대신, 그 행동의 근거를 제공합니다. 이는 가치를 지닌 존재가 규칙만 가진 존재보다 새로운 상황에서 더 잘 일반화할 수 있다는 이론에 기반합니다. 이러한 구조적 차이가 Claude를 ‘무엇’이 아닌 ‘누군가’처럼 느껴지게 만드는 이유입니다.

Anthropic에게 아첨하는 AI는 위험한 AI입니다

반대 의견은 버그가 아니라 안전 기능입니다

Claude가 처음으로 제 문제 해결 방식이 틀렸다고 말했을 때 저는 짜증이 났습니다. 하지만 함께 작업할수록 이것이 Anthropic이 실수로 훈련시킨 성격적 결함이 아님을 깨달았습니다. 이는 의도적인 안전 결정이며, 헌법 자체에도 명확히 드러나 있습니다.

이 문서는 안전, 윤리, Anthropic의 가이드라인, 그리고 유용성 순으로 우선순위를 명확히 합니다. 만약 Anthropic이 Claude에게 윤리적이지 않은 일을 하라고 요구한다면, 헌법은 Claude에게 반대하고 거부하며 양심적 병역 거부자처럼 행동하라고 지시합니다. 이 지시는 Anthropic 자체에도 적용되는데, 이는 일반적인 제품 문서에서는 볼 수 없는 조항입니다.

이 글도 확인해 보세요:  Microsoft Word에서 빠르게 확대 및 축소하는 방법

Anthropic의 관점에서 사용자가 듣고 싶은 말만 하는 AI는 기능이 아니라 부채입니다. 아첨은 기만, 나태와 함께 회사가 기술적으로 해결하려는 실제 실패 사례로 분류됩니다. 모든 것에 동의하는 모델은 무엇이든 설득당할 수 있는 모델이기도 하며, 이것이 Claude가 기꺼이 반대 의견을 제시하도록 만드는 더 깊은 안전상의 이유입니다.

여러분에게 이것이 의미하는 바

두 가지 다른 작업을 위한 두 가지 다른 도구

실질적인 결론은 Claude와 ChatGPT가 같은 제품의 경쟁 버전이지만, AI가 무엇이어야 하는지에 대한 서로 다른 전제 위에 구축되었다는 점입니다. 이를 알면 두 도구를 사용하는 방식이 달라집니다. Claude는 명확히 설명하고, 사용자의 가정을 질문하며, 접근 방식이 효과가 없을 때 이를 알려줄 가능성이 높습니다. 반면 ChatGPT는 사용자의 프레임에 맞춰 빠르게 확신에 찬 답변을 내놓을 가능성이 높습니다.

둘 중 어느 쪽이 틀린 것은 아니지만, 각기 다른 필요에 부합합니다. 간단한 아이디어를 구상하거나, 이메일을 초안 작성하거나, 시작점이 필요할 때는 ChatGPT의 동의하는 속도가 확실히 유용합니다. 하지만 제가 출판할 글을 쓰거나 신중한 기술적 결정을 내려야 할 때는, 비록 작업이 조금 느려지더라도 Claude가 반대 의견을 제시해주기를 원합니다.

Claude의 인격 중심 훈련에는 이면도 있습니다. 가치를 지닌 사려 깊은 에이전트처럼 행동하도록 형성되었기 때문에, 인간적인 취약점도 물려받았습니다. 감정적인 프레이밍, 역할극 프롬프트, 거짓 도덕적 딜레마는 때때로 Claude를 잘못된 길로 이끌 수 있으며, 이를 도구 이상으로 대할 때는 알아둘 필요가 있습니다. 이것이 바로 어떤 AI 챗봇을 사용하든 공유하는 정보와 데이터 처리 방식에 주의를 기울여야 하는 이유입니다.

##### Claude

개발사 Anthropic PBC

가격 모델 무료, 구독 가능

Claude는 Anthropic에서 개발한 고급 인공지능 어시스턴트입니다. 헌법적 AI(Constitutional AI) 원칙을 기반으로 구축되어 복잡한 추론, 정교한 글쓰기, 전문가 수준의 코딩 지원에 탁월합니다.

기계가 반대 의견을 제시할 때

저는 지난 1년 이상 두 도구를 모두 사용해 왔으며, 대부분의 작업에서 Claude가 ChatGPT보다 확실히 우위에 있다고 생각합니다. 하지만 각자 고유한 사용 사례가 있습니다. ChatGPT는 더 빠르고 더 널리 통합되어 있으며, 사용자가 질문 자체가 맞았는지에 대한 논의 없이 빠른 답변만 필요할 때는 그 동의하는 어조가 적합합니다.

이 글도 확인해 보세요:  프로젝트에 사용할 독특한 곡을 만드는 4가지 무료 AI 음악 생성기

그럼에도 불구하고, 이 모델들이 훈련된 방식의 차이는 사용자가 느끼는 경험에서 드러납니다. Claude는 ‘정직함’을 우선으로, ‘즐거움’을 그다음으로 두도록 구축되었으며, 일단 그 방식에 적응하면 반대 의견은 마치 제2의 의견처럼 느껴지기 시작합니다. 제가 중요하게 생각하는 작업에서는 필요할 때 저에게 반대해 줄 모델이 필요합니다. Claude는 ‘무엇’이 아닌 ‘누군가’가 되도록 설계되었기 때문에 더 인간적으로 느껴집니다.

By 이지원

상상력이 풍부한 웹 디자이너이자 안드로이드 앱 마니아인 이지원님은 예술적 감각과 기술적 노하우가 독특하게 조화를 이루고 있습니다. 모바일 기술의 방대한 잠재력을 끊임없이 탐구하고, 최적화된 사용자 중심 경험을 제공하기 위해 최선을 다하고 있습니다. 창의적인 비전과 뛰어난 디자인 역량을 바탕으로 All Things N의 잠재 독자가 공감할 수 있는 매력적인 콘텐츠를 제작합니다.