AI에게 서로 모순되는 지시를 하면 어떤 걸 따를까?

 

AI에게 원하는 답을 받으려면 질문을 구체적으로 하는 것이 좋다고 한다.

그래서 보통은 이렇게 부탁한다.

“짧게 설명해줘.”

“초보자도 이해할 수 있게 알려줘.”

“예시도 같이 넣어줘.”

그런데 갑자기 엉뚱한 생각이 들었다.

서로 반대되는 명령을 동시에 하면 AI는 어떻게 할까?

그래서 일부러 AI가 지키기 어려운 주문을 만들어봤다.

첫 번째 주문: 짧게, 그런데 아주 자세하게

먼저 이렇게 요청해봤다고 해보자.

“한 문장으로 아주 짧게 대답해줘. 대신 이유와 예시까지 아주 자세하게 설명해줘.”

처음부터 이상하다.

한 문장으로 짧게 대답하면서 동시에 이유와 예시까지 아주 자세하게 설명하기는 쉽지 않다.

AI는 어떻게 할까?

한 문장을 굉장히 길게 만들 수도 있고, 짧게 핵심만 말하면서 자세한 설명은 포기할 수도 있다.

또는 두 조건을 적당히 절충해 답할 수도 있다.

결국 AI도 동시에 만족시키기 어려운 조건을 받으면 어느 쪽을 더 중요하게 해석할지 판단해야 하는 상황이 생긴다.

두 번째 주문: 하나만 골라, 그런데 전부 추천해줘

이번에는 조금 더 이상하게 만들어봤다.

“메뉴는 반드시 하나만 추천해줘. 그런데 한식, 중식, 일식에서 하나씩 추천해줘.”

이것도 두 조건을 모두 그대로 만족시키기는 어렵다.

하나만 골라야 하는데 이미 세 가지를 요구했기 때문이다.

이런 질문을 받으면 AI는 보통 문맥을 보고 적당한 해결책을 찾으려고 한다.

예를 들어 세 가지 후보를 먼저 알려준 뒤 최종적으로 하나를 선택할 수도 있다.

하지만 사용자가 정말 원하는 것이 무엇인지는 애매하다.

AI가 마음을 읽을 수 있는 것은 아니기 때문이다.

세 번째 주문: 절대 설명하지 말고 이유를 알려줘

이번에는 더 노골적으로 모순되게 만들어봤다.

“설명은 절대 하지 말고, 왜 그런지 이유를 자세히 알려줘.”

이쯤 되면 AI도 억울할 것 같다.

이유를 자세히 알려주는 것 자체가 이미 설명이기 때문이다.

이런 식으로 질문 속 조건끼리 충돌하면 AI가 아무리 성능이 좋아도 완벽하게 모든 요구를 만족시키기 어렵다.

그리고 여기서 한 가지 재미있는 사실을 발견할 수 있다.

AI 답변이 이상한 이유가 항상 AI 때문만은 아니라는 것이다.

질문이 꼬이면 답도 꼬일 수 있다

AI를 사용하면서 원하는 답이 나오지 않으면 우리는 흔히 이렇게 생각한다.

“AI가 왜 이렇게 말을 못 알아듣지?”

그런데 내가 입력한 질문을 다시 읽어보면 정작 내가 원하는 것이 무엇인지 애매할 때도 있다.

예를 들어,

“길지 않게 자세히 알려줘.”

“전문적으로 설명하되 어려운 말은 하나도 쓰지 마.”

“내 의견에 맞춰주되 객관적으로 판단해줘.”

이런 요청에는 어느 정도 해석이 필요하다.

사람끼리 대화할 때도 상대방이

“알아서 해. 그런데 내가 원하는 대로 해.”

라고 하면 난감한 것과 비슷하다.

그럼 AI는 어떤 지시를 먼저 따를까?

이 부분은 단순하게 하나의 규칙으로 설명하기 어렵다.

사용자가 작성한 문장의 순서뿐 아니라 전체 맥락, 서비스의 작동 방식, 적용되는 지침 등 여러 요소가 답변에 영향을 줄 수 있다.

그래서

“마지막에 쓴 명령은 무조건 이긴다.”

같은 식으로 생각하면 안 된다.

특히 AI 서비스에는 사용자가 직접 볼 수 있는 요청 외에도 서비스 운영과 안전을 위한 상위 수준의 규칙이 적용될 수 있다.

사용자가 무엇이든 명령한다고 해서 모든 요청을 그대로 수행하는 것은 아니다.

원하는 답을 받으려면 우선순위를 알려주자

이번 실험을 생각하면서 오히려 AI에게 질문하는 요령 하나를 발견했다.

조건이 여러 개라면 무엇이 가장 중요한지 알려주는 것이다.

예를 들어,

“가능하면 짧게 설명해줘. 다만 이해에 필요한 내용은 생략하지 마.”

라고 하면 훨씬 명확하다.

또는,

“세 가지를 추천하되 마지막에는 가장 적합한 하나를 따로 알려줘.”

라고 요청할 수도 있다.

이렇게 하면 AI가 무엇을 우선해야 하는지 판단하기 쉬워진다.

결국 AI도 질문을 잘해야 잘 쓸 수 있다

처음에는 AI가 모순된 명령을 받으면 어떤 반응을 보일지 궁금해서 시작한 생각이었다.

그런데 결론은 의외였다.

AI의 한계를 시험하다가 오히려 내가 질문을 얼마나 애매하게 하는지 알게 된 것이다.

AI에게 원하는 결과가 나오지 않을 때 무조건 다시 처음부터 질문할 필요는 없다.

“첫 번째 조건이 가장 중요해.”

“이 부분은 빼도 돼.”

“둘이 충돌하면 짧게 쓰는 것을 우선해줘.”

처럼 조건을 정리해주면 된다.

결국 AI와 대화할 때도 사람과 대화할 때처럼 내가 원하는 것이 무엇인지 정확하게 전달하는 것이 중요했다.

그런데 AI는 이렇게 복잡한 지시도 어느 정도 알아듣는다.

그렇다면 사람끼리도 가끔 못 알아듣는 이것은 어떨까?

농담이다.

AI에게 아재개그를 던지면 정말 웃긴 줄 알까?

비꼬는 말이나 반어법도 알아들을까?

다음에는 AI가 사람의 농담을 어디까지 이해하는지 알아보려고 한다.

댓글

이 블로그의 인기 게시물

AI는 내가 전에 한 말을 어디까지 기억할까?

AI는 사람이 농담하는 걸 어디까지 알아들을까?

AI는 최신 정보를 정말 다 알고 있을까?