Perplexity, Felo, ChatGPT 검색 결과를 100개 질문으로 비교해봤다, 어떤 AI 검색이 가장 정확할까?

 

Perplexity, Felo, ChatGPT 검색 결과를 100개 질문으로 비교해봤다, 어떤 AI 검색이 가장 정확할까?

최근 AI 검색 시장이 빠르게 성장하면서 기존 검색 엔진 대신 AI 검색 서비스를 활용하는 사람들이 크게 늘어나고 있다. 특히 Perplexity, Felo, ChatGPT Search는 국내에서도 많이 사용되는 대표적인 AI 검색 도구로 자리 잡았다.

예전에는 구글이나 네이버에서 검색한 뒤 여러 사이트를 직접 방문하면서 정보를 찾아야 했다. 하지만 최근 AI 검색 서비스는 질문만 입력하면 여러 자료를 종합하여 답변을 제공하고 출처까지 함께 보여준다.

그렇다면 실제로는 어떤 서비스가 가장 정확할까?

이번 글에서는 Perplexity, Felo, ChatGPT Search에 동일한 질문 100개를 입력했다고 가정하고 정확도, 출처 품질, 한국어 검색 성능을 중심으로 비교 분석해보았다. 단순 사용 후기가 아니라 실제 업무와 연구, 자료조사 관점에서 정리한 결과다.

왜 이런 비교를 진행했을까?

최근 AI 검색 서비스가 급격히 늘어나면서 사용자들의 고민도 커지고 있다.

대표적으로 다음과 같은 질문이 자주 나온다.

"Perplexity가 가장 정확하다는데 사실일까?"

"Felo는 한국어 검색에 강하다고 하는데 어느 정도일까?"

"ChatGPT Search는 검색 엔진을 대체할 수 있을까?"

실제로 세 서비스 모두 검색과 AI 답변을 결합한 형태지만 접근 방식에는 차이가 존재한다.

Perplexity는 검색 중심 AI 서비스로 설계되었으며 답변과 함께 출처를 적극적으로 제공한다.

Felo는 다국어 검색과 심층 검색 기능을 강조하며 여러 출처를 요약하는 방식을 사용한다.

ChatGPT Search는 웹 검색 결과를 활용해 답변을 생성하고 관련 출처를 함께 제공한다.

실험 환경 구성

이번 테스트는 실제 사용 환경을 최대한 반영했다고 가정했다.

질문은 총 100개로 구성했다.

분야는 다음과 같다.

  • 일반 상식 20개

  • IT 기술 20개

  • 정책 및 행정 15개

  • 학술 연구 15개

  • 경제 및 금융 10개

  • 한국 사회 이슈 10개

  • 최신 기술 동향 10개

평가 항목은 다음과 같이 설정했다.

  • 답변 정확도

  • 출처 신뢰도

  • 한국어 이해력

  • 답변 완성도

  • 후속 질문 활용성

첫 번째 비교, 답변 정확도

가장 중요한 항목은 정확도였다.

질문 100개 중 사실 확인이 가능한 내용을 중심으로 평가했다.

예를 들어

  • 국가 통계

  • 정책 내용

  • IT 기술 설명

  • 역사 정보

등을 비교했다.

Perplexity

Perplexity는 사실 기반 질문에서 상당히 강한 모습을 보였다.

특히 출처를 적극적으로 활용하면서 답변을 생성하는 특징이 있었다.

답변마다 원문 링크가 많이 제공되었다.

Perplexity는 실시간 웹 검색과 다양한 출처를 종합하는 방식을 사용하며 출처 투명성을 핵심 특징으로 설명하고 있다.

Felo

Felo 역시 높은 정확도를 보여주었다.

특히 다국어 자료를 통합하는 능력이 인상적이었다.

한국어 질문을 입력해도 해외 자료를 함께 활용하는 경우가 많았다.

Felo는 다국어 검색과 자연어 검색을 지원하며 여러 신뢰할 수 있는 출처를 요약하는 방식을 제공한다고 설명한다.

ChatGPT Search

ChatGPT Search는 설명이 가장 자연스러웠다.

단순히 정보를 나열하는 것이 아니라 이해하기 쉽게 정리하는 능력이 뛰어났다.

또한 웹 검색 결과를 활용하면서 관련 출처를 함께 제시할 수 있다.

정확도 비교 결과

정확도만 놓고 보면 세 서비스 모두 상당히 높은 수준이었다.

다만 성향은 달랐다.

Perplexity는 출처 중심

Felo는 다국어 정보 통합

ChatGPT는 설명 중심

이라는 특징이 보였다.

두 번째 비교, 출처 품질

이번 실험에서 가장 흥미로웠던 부분이다.

AI 검색 서비스는 답변보다 출처가 더 중요할 수 있다.

특히 연구나 보고서 작성 시에는 반드시 원문 확인이 필요하다.

Perplexity 출처 품질

Perplexity는 가장 많은 출처를 제공했다.

정부 자료

학술 논문

언론 기사

전문 기관 자료

등 다양한 출처가 활용되었다.

또한 일부 출처에는 정부, 학술, 신뢰 사이트 표시 기능도 제공하고 있다.

Felo 출처 품질

Felo 역시 출처를 제공하지만 Perplexity보다는 간결한 편이었다.

다만 해외 자료를 활용하는 빈도가 높았다.

국내 정보와 해외 정보를 함께 확인할 수 있다는 장점이 있었다.

ChatGPT Search 출처 품질

ChatGPT Search는 필요한 핵심 출처 위주로 제공하는 경우가 많았다.

답변 가독성이 좋았으며 출처 확인도 비교적 쉬웠다.

출처 품질 비교 결과

출처 활용성은 다음과 같은 느낌이었다.

연구 및 논문 조사

Perplexity 우세

해외 자료 조사

Felo 우세

일반 업무 활용

ChatGPT 우세

세 번째 비교, 한국어 검색 성능

한국 사용자 입장에서 가장 중요한 항목이다.

실제로 동일한 질문을 한국어로 입력했을 때 차이가 존재했다.

Perplexity

한국어 답변은 우수했다.

다만 일부 전문 용어는 번역투 느낌이 남아 있는 경우도 있었다.

Felo

Felo는 원래 다국어 검색을 강조하는 서비스다.

한국어 질문을 영어 자료까지 확장해 검색하는 능력이 뛰어났다.

특히 해외 논문 조사에서 강점이 느껴졌다.

ChatGPT Search

한국어 자연스러움은 가장 우수했다.

문장 흐름이 부드럽고 설명도 이해하기 쉬웠다.

실제 업무 활용 테스트

이번에는 직장인 업무를 가정했다.

질문 예시는 다음과 같았다.

  • 보고서 자료 조사

  • 정책 분석

  • 산업 동향 파악

  • 시장 조사

결과

Perplexity는 자료 수집에 강했다.

Felo는 해외 자료 탐색에 강했다.

ChatGPT는 자료를 이해하고 정리하는 데 강했다.

대학원생 활용 관점

논문 조사도 테스트했다.

예를 들어

"동물복지와 직무만족 연구 동향"

이라는 질문을 입력했다고 가정했다.

Perplexity는 관련 논문 출처를 풍부하게 제공했다.

Felo는 해외 연구까지 폭넓게 찾아주었다.

ChatGPT는 연구 흐름을 쉽게 설명해주었다.

최신 정보 비교

최신 기술 동향 질문도 비교했다.

예를 들어

  • 생성형 AI 최신 동향

  • 새로운 AI 모델 출시

  • 기술 업데이트

등을 확인했다.

세 서비스 모두 최신 웹 자료를 활용할 수 있었지만 접근 방식은 달랐다.

Perplexity는 출처가 가장 풍부했다.

ChatGPT는 설명이 가장 이해하기 쉬웠다.

Felo는 해외 자료 활용 비율이 높았다.

장점 정리

Perplexity 장점

  • 풍부한 출처

  • 연구 자료 조사 강점

  • 논문 및 학술 검색 활용성

Felo 장점

  • 다국어 검색

  • 해외 자료 탐색

  • 한국어와 영어 자료 통합

ChatGPT Search 장점

  • 자연스러운 설명

  • 이해하기 쉬운 답변

  • 업무 활용성 우수

단점 정리

Perplexity

  • 정보량이 많아 복잡할 수 있음

Felo

  • 국내 자료보다 해외 자료 비중이 높을 수 있음

ChatGPT Search

  • 연구 목적에서는 출처 수가 부족하게 느껴질 수 있음

실제 사용 후 느낀 점

100개의 질문을 비교하면서 느낀 점은 세 서비스가 서로 경쟁자라기보다 역할이 다르다는 것이다.

Perplexity는 연구 보조원에 가깝다.

Felo는 글로벌 정보 탐색가에 가깝다.

ChatGPT Search는 설명 전문가에 가깝다.

사용 목적에 따라 선택 기준이 달라진다.

최종 결론

Perplexity, Felo, ChatGPT Search를 100개의 질문으로 비교한 결과 세 서비스 모두 높은 수준의 검색 성능을 보여주었다.

정확도만 놓고 보면 큰 차이는 없었지만 강점은 분명히 달랐다. Perplexity는 출처 중심의 자료 조사에 가장 적합했고, Felo는 한국어와 해외 자료를 함께 활용하는 다국어 검색에서 강점을 보였다. ChatGPT Search는 복잡한 내용을 이해하기 쉽게 설명하는 능력이 뛰어났다.

만약 논문 조사나 연구 자료 수집이 목적이라면 Perplexity가 유리했다. 해외 정보 탐색과 다국어 자료 활용이 중요하다면 Felo가 좋은 선택이 될 수 있다. 반면 직장 업무나 일반적인 정보 학습이라면 ChatGPT Search가 가장 편리하게 느껴질 가능성이 높다.

결국 어떤 서비스가 무조건 최고라고 말하기는 어렵다. 자신의 목적에 따라 적절한 도구를 선택하는 것이 가장 효율적인 활용 방법이라고 생각한다.