반론에 대한 잘못된 답변의 대가가, 여러분 비즈니스 어디에서도 신호를 남기지 않는 거래이기 때문입니다. 아무도 방문하지 않고, 아무도 이탈하지 않고, 아무도 티켓을 열지 않습니다. 어떤 사람이 이 분야를 쓰면 계정이 정지되는지 물었고, 확신에 찬 틀린 답을 받았고, 다른 곳으로 갔습니다. 이에 비하면 다른 모든 프롬프트 유형의 실패는 부드럽습니다. “X가 무엇인가” 프롬프트에서 오류는 표면적이며, 구매자가 출처를 두 개만 더 읽으면 바로잡힙니다. “X는 안전하게 쓸 수 있는가”에서 오류는 그 과정을 끝냅니다.
잘못된 답변의 확률은 작지 않고, 정직한 표현 방식은 표본을 붙인 범위로 말하는 것입니다. 컬럼비아 대학교 Tow Center for Digital Journalism이 2025년에 여덟 개 엔진, 쿼리 1,600건을 대상으로 한 감사는 60% 넘게가 부정확한 답변을 돌려주었고, 가장 나쁜 엔진은 94%, 가장 좋은 엔진도 37%가 틀렸다는 것을 발견했습니다. 그 이전의 인용문 200건 테스트에서는 153건의 응답이 부분적으로 또는 완전히 틀렸고, 불확실성이 표시된 것은 7번이었습니다.1 문장 단위로 보면 상황이 조금 낫지만 편하지는 않습니다. 한 학술 연구는 생성형 검색 답변의 문장 중 51.5%만 자신의 인용으로 완전히 뒷받침된다는 것을 발견했고, 2026년 연구는 원자적 주장 98,020건 중 약 11%를 그것을 위해 인용된 출처로는 뒷받침되지 않는 것으로 분류했습니다.23 분모가 다르고 과제가 다르지만 결론은 같습니다. 인용이 있다는 것은 서술이 정확하다는 보장이 아닙니다.
이 연구들이 측정한 것은 뉴스 귀속과 주장 뒷받침이지 제품 서술이 아닙니다. 그러므로 이들이 확립하는 것은 엔진이 여러분의 가격을 얼마나 자주 잘못 서술하는가가 아니라, 이 실패 방식이 대비할 만큼 흔하다는 사실입니다.