열 지향 DB 얘기를 하다가 옆으로 새어나온 질문이 하나 있었습니다. AI에게 그냥 “쿼리 짜줘”라고 하면 왜 항상 MySQL 같은 행 지향 RDB를 가정하고 답할까, 하는 거였습니다.
물어보니 이유가 단순했습니다. 인터넷에 쌓인 SQL 관련 질문과 코드가 압도적으로 행 지향 RDB 기준이라는 겁니다. 열 지향 DB를 물어보는 사람보다 웹 서비스 백엔드용 쿼리를 묻는 사람이 훨씬 많으니, AI 입장에서는 별다른 정보가 없으면 그쪽을 기본값으로 두는 게 통계적으로 맞는 선택이라는 거였습니다.
그래서 “BigQuery용으로 짜줘” 같이 구체적으로 말해줘야 답이 달라진다고 하더라고요. 저는 이걸 그냥 AI의 습성 정도로 받아들이고 넘어갔습니다.
친구 이야기가 겹쳤습니다
몇 주 전에 인테리어 쪽에서 일하는 친구랑 이야기할 일이 있었습니다. 개발을 잠깐 공부한 적이 있는 친구인데, 업무용으로 Claude Max를 쓰고 있었습니다.
친구가 저한테 도움을 청할 일이 있었는데, 그때 제가 먼저 권했습니다. “비개발자인 당신이 Cowork 대신 Claude Code를 써야 하는 이유”라는 영상을 봤는데 토큰 사용량부터 할 수 있는 일의 자유로움까지 완전히 다르다고 하니, 한번 Claude Code로 해보라고요.
그런데 대답의 결이 확 달라지더라는 겁니다. 이게 단순히 토큰 사용량이나 할 수 있는 일의 차이가 아니었습니다. Claude Code는 마치 사용자가 엔지니어라고 가정한 채로 대답하는 것 같다고 했습니다.
쿼리 얘기를 듣는 순간 이 얘기가 떠올랐습니다. “이미 전제가 깔려 있다.”는 생각이 들었거든요. 나는 내가 누군지 말한 적이 없는데, 둘 다 같은 모양이었습니다.
다만 이유는 달랐습니다
쿼리 얘기는 우연히 그렇게 된 겁니다. 학습 데이터가 한쪽으로 쏠려 있으니 기본값도 그쪽으로 쏠린 거고요.
친구 얘기는 다릅니다. Cowork와 Claude Code는 원래 다른 사람을 염두에 두고 만들어진 제품입니다. 시스템 프롬프트도, 붙어 있는 도구도, 답변 톤도 처음부터 그 대상에 맞춰 설계되어 있었을 겁니다. 우연이 아니라 애초에 그렇게 만든 거였습니다.
학습이 우연히 그렇게 되었든, 하네스 엔지니어링 과정에서 사용자를 임의로 설정했든, 사용하는 사람이 겪는 일은 같았습니다. 도구를 바꿨더니 나에 대한 전제가 갑자기 달라졌다는 것.
그래서 뭘 다르게 해야 하나
결론이 대단하진 않습니다. 그냥 뭘 물을 때 “이 도구는 지금 나를 누구라고 가정하고 있나”를 한 번쯤 짚어보는 습관이 생겼습니다.
쿼리를 물을 땐 DB 이름을 먼저 붙이고, 낯선 도구를 쓸 땐 이게 원래 누굴 위해 만들어졌는지부터 확인하는 정도로요. 그러니까 지금 듣고 있는 이 대답이, LLM이 이미 어떤 상황을 가정하고 답한 건 아닌지 한 번은 확인해봐야 할 것 같습니다. 저는 운 좋게 개발자였지만, 모두가 개발자는 아니니까요.