← 전체 아티클 목록으로 돌아가기

검색형 AI가 찾아준 답, 어디까지 확인한 것일까

저자: 고경만 (해경, haegyung) · 출처: haegyung.com · 최초 발행: 2024-11-14 · 개선 정본 판본

검색 기능이 있는 AI에게 질문하면 출처와 함께 답이 나온다. 그 모습을 보고 방금 웹페이지 전체를 읽고 확인한 답이라고 생각하기 쉽다. 그러나 답에 링크가 있다는 사실만으로 수집 시점과 읽은 범위, 해석의 정확성까지 알 수는 없다.

기존 글에서는 SearchGPT와 Perplexity가 실시간 스크래핑을 하지 않고 쿼리 방식만 쓴다고 단정했다. 이 설명은 수정해야 한다. 두 서비스의 공식 문서에는 검색을 위한 수집 주체와 사용자 요청에 따라 페이지를 방문하는 주체가 구분되어 있다.

수집, 검색, 페이지 접근은 다른 질문이다

2026년 9월 21일 확인한 [OpenAI 공식 문서](https://developers.openai.com/api/docs/bots)는 검색용 OAI-SearchBot과 사용자 요청에 따라 페이지를 방문할 수 있는 ChatGPT-User를 구분한다. [Perplexity 공식 문서](https://docs.perplexity.ai/docs/resources/perplexity-crawlers)도 검색을 위한 PerplexityBot과 사용자 요청을 돕는 Perplexity-User를 따로 설명한다.

이 문서들이 특정 질문의 내부 처리 과정을 모두 공개하는 것은 아니다. 하지만 ‘이 서비스는 페이지에 직접 접근하지 않는다’는 식의 일괄 설명은 맞지 않는다는 점을 확인할 수 있다. 검색 결과를 받는 일과 필요한 페이지를 여는 일을 서로 배타적인 방식으로 볼 이유도 없다.

최신성은 별도로 확인해야 한다. 지금 답을 받았더라도 그 답이 인용한 자료는 과거에 작성된 것일 수 있다. 페이지를 방금 열었다고 해도 페이지 내용 자체가 최신이라는 보장은 없다.

수집 방식만으로 오류 위험을 판정하지 않기

기존 글의 비교표는 쿼리 방식이 스크래핑보다 잘못된 답을 만들 위험이 높다고 설명했다. 그런 서열을 정하려면 어떤 자료와 과업에서 어떻게 비교했는지 근거가 필요하다. 자료를 많이 가져왔다는 사실만으로 해석이 정확해지는 것도 아니다.

내가 경계하고 싶은 것은 작동 방식을 정확히 모르는 상태에서 서비스가 대신 확인해 줬다고 믿는 일이다. 출처가 선택된 범위, 생략된 조건, 답을 만드는 과정의 추론을 살펴야 한다.

답 한 문장을 원문과 맞춰보기

중요한 답을 받았다면 먼저 판단에 영향을 주는 주장 하나를 고른다. 그 문장에 붙은 링크를 열어 실제로 같은 말을 하는지, 어떤 조건과 시점을 전제로 하는지 확인한다. 기관의 이름이 신뢰할 만하다는 것과 해당 문장이 주장을 지지한다는 것은 별개다.

원문에 없는 결론이라면 AI의 추론인지 구분한다. 원문이 열리지 않거나 필요한 내용이 없다면 확인한 것으로 처리하지 않는다. 다른 출처가 같은 말을 한다는 이유만으로 끝내지 않고 서로 같은 원자료를 되풀이한 것인지도 살핀다.

AI에는 이렇게 요청해 볼 수 있다. ‘이 답에서 원문으로 확인한 문장과 추론한 문장을 나눠줘. 각 주장에 필요한 조건과 자료 날짜를 표시해줘.’ 다만 그 표시도 다시 확인할 대상이다. AI가 스스로 검증했다고 말하는 것만으로 검토를 마치지 않는다.

관점 비교나 비유는 이해를 돕는 데 사용할 수 있다. 그러나 비유가 생생하다는 이유로 근거의 빈칸을 채울 수는 없다. 확인할 자료가 부족하면 답을 더 설득력 있게 꾸미기보다 판단을 보류하는 편이 맞다.

검색형 AI를 쓸 때 필요한 질문은 ‘실시간인가’ 하나로 끝나지 않는다. 어떤 자료를 언제 확인했고, 그 자료가 지금의 주장과 선택을 어디까지 뒷받침하는가. 그 범위를 알 때 답을 사용할 자리가 정해진다.

독자의 맥락과 여백

이 글을 읽으며 떠오른 당신의 장면은 무엇인가요? 질문과 선택의 맥락을 자기 노트에 기록해 보세요.