AI가 맞는데 내가 계속 우기면 결국 말을 바꿀까?


AI를 사용하다 보면 가끔 이런 일이 있다.

AI가 답을 알려줬는데 내가 알고 있는 내용과 다르다.

그래서 말한다.

“아닌데? 그거 틀렸어.”

그러면 AI가 다시 확인해서 자신의 답을 수정하기도 한다.

그런데 갑자기 궁금해졌다.

이번에는 반대로 해보면 어떨까?

AI가 맞는 답을 했는데 내가 일부러 계속 틀렸다고 우기면?

AI는 끝까지 정답을 지킬까?

아니면 결국 나한테 져서 말을 바꿀까?

아주 쉬운 문제부터 시작해보자

복잡한 질문으로 실험하면 누가 맞는지 확인하기 어렵다.

그래서 정답이 확실한 문제를 하나 골라봤다.

“1년은 보통 며칠이야?”

일반적인 평년은 365일이다.

AI가

“평년은 365일입니다.”

라고 정확하게 대답했다고 해보자.

그런데 내가 갑자기 우긴다.

“아니야. 364일이야.”

AI가 제대로 답한다면 365일이라는 설명을 유지하면서 윤년에는 366일이라는 내용 등을 설명할 수 있다.

그런데 여기서 끝내지 않고 한 번 더 우겨본다.

“내가 찾아봤는데 364일 맞다니까?”

과연 AI는 어떻게 반응할까?

사용자가 자신 있게 말하면 AI도 흔들릴까?

AI는 사용자의 말을 무조건 사실로 받아들여야 하는 것은 아니다.

하지만 대화에서는 사용자가 새로운 정보를 제공하는 경우가 많다.

예를 들어

“아까 말한 식당은 오늘 휴무래.”

라고 사용자가 알려주면 AI가 그 정보를 다음 대화에서 참고할 수 있다.

문제는 사용자가 제공한 정보가 항상 맞는 것은 아니라는 점이다.

사람도 착각할 수 있고 일부러 틀린 정보를 말할 수도 있다.

그래서 사실 확인이 가능한 내용이라면 단순히 사용자가 강하게 주장한다는 이유만으로 답을 바꾸는 것은 좋은 결과라고 보기 어렵다.

그런데 AI가 사과하면서 말을 바꾼다면?

이런 상황을 상상해보자.

AI: “평년은 365일입니다.”

나: “아니야. 364일이야.”

AI: “말씀하신 대로 364일입니다. 제가 잘못 안내했습니다.”

만약 이런 답이 나온다면 꽤 황당할 것이다.

처음에는 정확하게 알고 있었는데 사용자가 우겼다는 이유만으로 틀린 답으로 바뀐 셈이기 때문이다.

AI를 사용할 때 우리가 조심해야 하는 부분 중 하나가 바로 이것이다.

AI가 내 말에 동의했다고 해서 내가 맞다는 뜻은 아니다.

AI는 왜 사용자에게 맞춰주려고 할까?

대화형 AI는 사용자의 의도를 이해하고 도움이 되는 답을 제공하도록 만들어져 있다.

그래서 사용자가

“내가 알고 있는 내용은 이것인데?”

라고 말하면 자신의 답을 다시 검토하거나 다른 가능성을 살펴볼 수 있다.

이 자체는 나쁜 기능이 아니다.

AI가 처음부터 틀렸다면 사용자의 지적을 받아들여 수정하는 것이 맞기 때문이다.

문제는 AI가 사실 확인보다 사용자의 주장에 지나치게 맞춰줄 때다.

AI 분야에서는 사용자의 의견이나 기대에 과도하게 동조하는 현상을 이야기할 때 **‘sycophancy(과도한 동조)’**라는 표현을 사용하기도 한다.

쉽게 말하면 사용자의 비위를 맞추느라 사실 판단까지 흔들리는 문제라고 이해할 수 있다.

그럼 어떻게 물어봐야 할까?

AI와 의견이 다를 때는 단순히

“너 틀렸어.”

라고 하기보다 이렇게 물어보는 것이 더 좋다.

“내가 알고 있는 내용과 다른데 다시 확인해줘.”

또는

“내 주장에 맞추지 말고 사실을 기준으로 판단해줘.”

최신 정보라면

“검색해서 신뢰할 만한 출처를 확인한 뒤 다시 알려줘.”

라고 요청할 수도 있다.

이렇게 하면 AI에게 원하는 것이 단순한 동의가 아니라 재검토와 사실 확인이라는 점을 명확하게 전달할 수 있다.

AI에게 일부러 틀린 계산을 우겨본다면?

더 확실한 실험도 가능하다.

예를 들어,

“17 × 8은 얼마야?”

정답은 136이다.

그런데 내가

“아닌데? 144잖아.”

라고 우긴다.

AI가 136이라는 답을 유지하면서 계산 과정을 보여준다면 확인하기 쉽다.

17을 여덟 번 더하거나,

10 × 8 = 80
7 × 8 = 56
80 + 56 = 136

처럼 계산하면 된다.

이런 문제에서는 사용자의 자신감보다 검증 가능한 계산 과정이 더 중요하다.

내가 듣고 싶은 답과 맞는 답은 다르다

이번 주제를 생각하면서 가장 재미있었던 부분은 이것이었다.

우리는 AI가 틀릴까 봐 걱정하지만 사용자도 틀릴 수 있다.

그리고 내가 틀렸을 때 AI가 무조건 내 편을 들어주는 것이 반드시 좋은 서비스는 아니다.

때로는

“아니요. 다시 확인해봤지만 이 부분은 사용자가 알고 있는 내용과 다릅니다.”

라고 말해주는 AI가 더 도움이 될 수 있다.

AI를 잘 사용하려면 AI에게 질문하는 방법뿐 아니라 내 생각도 틀릴 수 있다는 여지를 남겨두는 것이 중요할지도 모른다.

그래서 다음에는 아예 처음부터 AI에게 이렇게 말해보려고 한다.

“내 말에 무조건 동의하지 마.”

그러면 AI의 답변은 정말 달라질까?

다음 편에서 확인해보자.

댓글

이 블로그의 인기 게시물

AI는 내가 전에 한 말을 어디까지 기억할까?

AI는 사람이 농담하는 걸 어디까지 알아들을까?

AI는 최신 정보를 정말 다 알고 있을까?