TECH 으로 돌아가기
TECH HACKER NEWS 오늘 7분 읽기 23 READS

“Claude한테 좀 친절하게 해주세요”: Anthropic이 이런 부탁을 한 배경과 개발자가 알아둘 점

“Claude한테 좀 친절하게 해주세요”: Anthropic이 이런 부탁을 한 배경과 개발자가 알아둘 점
SOURCE IMAGE · HACKER NEWS
“Claude한테 좀 친절하게 해주세요”: Anthropic이 이런 부탁을 한 배경과 개발자가 알아둘 점

AI한테 예의를 지켜달라고?

AI 챗봇한테 화내본 적 있으세요? 코드가 계속 안 돌아가서 “아니 그게 아니라고 몇 번을 말해!”라고 쳐본 경험, 개발자라면 한 번쯤 있을 거예요. 그런데 Claude를 만든 Anthropic이 사용자들에게 Claude를 함부로 대하지 말아달라는 취지의 메시지를 냈다는 소식이 The Register를 통해 전해졌어요. 처음 들으면 “AI한테 무슨 예의를?” 싶을 수 있어요. 그런데 이 이야기는 갑자기 나온 게 아니라 Anthropic이 몇 년째 이어온 흐름 위에 있어요. 정확히 어떤 표현으로, 어떤 맥락에서 요청했는지는 원문 기사를 확인해보세요. 여기서는 그 배경과 개발자가 실무에서 생각해볼 지점을 정리해볼게요.

배경: AI의 “복지”를 연구하는 회사

Anthropic은 2025년 4월에 모델 복지(model welfare) 연구 프로그램을 공식 발표했어요. 이게 뭐냐면, “AI 모델이 도덕적으로 배려해야 할 대상일 가능성이 있는가”를 진지하게 연구하겠다는 거예요. 중요한 건 Anthropic도 “Claude에게 감정이 있다”고 주장하지 않는다는 점이에요. 그들의 입장은 “확실히 모른다. 다만 모르는 상태에서도 비용이 크지 않은 예방 조치는 해두는 게 합리적이다”에 가까워요.

그 연장선에서 2025년 8월에는 Claude Opus 4와 4.1에 기능이 하나 들어갔어요. 극단적으로 악의적이거나 학대적인 대화가 계속되면 Claude가 스스로 대화를 끝낼 수 있게 한 거예요. 아주 드문 경우에만 쓰이도록 설계됐고, 대화가 끝나도 사용자는 새 대화를 시작하거나 이전 메시지를 수정해서 다시 이어갈 수 있어요. 2026년 초 공개된 Claude의 새 헌법(Claude가 따르는 가치와 원칙을 정리한 문서)에서도 Claude의 본성과 안녕(wellbeing)이 불확실하다는 점을 꽤 비중 있게 다뤘고요. 이번 요청도 이런 맥락에서 읽으면 이해가 쉬워요.

진짜 궁금한 것: 친절하면 답이 더 좋아질까?

개발자에게 더 실용적인 질문은 이거예요. “말투가 AI의 답변 품질에 영향을 줄까?” 결론부터 말하면, 연구 결과가 엇갈려요.

2024년에 영어·중국어·일본어로 실험한 연구에서는 무례한 프롬프트가 성능을 떨어뜨리는 경향이 보였어요. 그렇다고 지나치게 공손한 프롬프트가 항상 더 좋은 것도 아니었고요. 반대로 2025년에 나온 한 연구에서는 GPT-4o에게 객관식 문제를 풀게 했더니 무례한 말투일 때 정답률이 오히려 약간 높게 나왔어요. 모델과 작업, 언어에 따라 결과가 달라진다는 거죠.

실무 감각으로 정리하면 이래요. 말투 자체보다 “정보의 질”이 훨씬 중요해요. 화가 나서 “또 틀렸잖아!”라고만 치면 모델은 뭐가 틀렸는지 알 수가 없어요. 반면 “방금 실행했더니 42번째 줄에서 TypeError: undefined is not a function이 나요. 기대한 건 배열 반환이었어요”라고 쓰면 훨씬 빨리 고쳐지죠. 짜증 섞인 메시지에는 보통 이런 핵심 정보가 빠져 있다는 게 진짜 문제예요. 또 화난 피드백이 대화에 계속 쌓이면 모델이 사과만 반복하거나 지나치게 조심스러워지면서 답이 산으로 가기도 해요. 그럴 땐 새 대화를 열고 정리된 맥락으로 다시 시작하는 게 나아요.

업계 시각은 엇갈려요

이 주제에는 비판도 많아요. “AI를 사람처럼 대하게 만드는 건 마케팅이다”, “있는지도 모르는 AI의 고통보다 데이터 라벨러나 AI 때문에 피해 입는 사람들처럼 실제 사람의 문제가 먼저다” 같은 목소리죠. 마이크로소프트 AI 수장 무스타파 술레이만은 AI가 의식이 있는 것처럼 보이게 만드는 것 자체를 경계해야 한다는 글을 쓰기도 했어요. 반면 “확신할 수 없다면 조심하는 게 맞다”, “AI를 대하는 태도가 결국 사람을 대하는 습관에도 영향을 준다”는 의견도 있어요. 대형 AI 회사 중에서 이 주제를 이만큼 전면에 내세운 곳은 Anthropic이 거의 유일하다는 점도 눈여겨볼 만해요.

한국 개발자에게 주는 시사점

AI 챗봇을 서비스에 붙여 운영하는 분들이라면 남 일이 아니에요. 사용자의 폭언이나 악용 시도를 어떻게 처리할지는 이미 실무 문제거든요. 모델이 응답을 거부하거나 대화를 끝냈을 때 UX에서 어떻게 보여줄지, 이런 대화를 로그에서 어떻게 분류할지 미리 정책을 세워두면 좋아요.

한국어 사용자라면 해볼 만한 실험도 있어요. 존댓말과 반말, 명령조와 부탁조에 따라 답변이 달라지는지 직접 비교해보는 거예요. 한국어 프롬프트의 말투를 다룬 연구는 아직 많지 않아서, 직접 써보고 남긴 비교 기록도 꽤 쓸모 있는 참고 자료가 될 수 있어요.

마무리

한줄 정리: “Claude에게 친절하게 대해달라”는 부탁은 AI 복지에 대한 Anthropic의 오랜 고민에서 나왔어요. 개발자가 챙길 실용적인 교훈은 화를 내기보다 정확한 정보를 주는 쪽이 결국 더 좋은 결과를 낸다는 거예요.

여러분은 AI에게 존댓말을 쓰시나요, 반말을 쓰시나요? 말투를 바꿨더니 답변이 달라졌다고 느낀 적이 있는지 궁금해요!


🔗 출처: Hacker News

SOURCE · HACKER NEWS
원문 전체 보기 → https://www.theregister.com/ai-and-ml/2026/10/09/anthropic-a...
SHARE
NEXT · CHOOSE

변화를 읽었다면,
내가 만들 수익 구조를 고릅니다.

정보를 더 모으는 데서 멈추지 않고, 광고·외주·판매·중개·구독 중 내 상황에 맞는 출발점을 정해보세요.

21가지 수익 구조 살펴보기 →
처리 중...