카테고리 없음

AI 딥리서치 성능 간단 비교(feat. Perplexity vs. GPT)

j-node 2026. 6. 30. 18:22

계획대로라면 오늘 Perplexity vs. Manus 딥리서치 성능 비교해야 하는데 Manus credit 이미 다 썼음......

그래서 Perplexity vs. GPT 대결로 대체함.

목표

무료 버전 AI(Perplexity, GPT)로 딥리서치가 1)얼만큼 상세히 가능한지 2)출처는 어느 정도 신뢰할 수 있는지 비교해본다.


도구

Claude Sonnet 4.6(team plan 중 무언가), Perplexity Standard Search(free plan), GPT-5.5 Instant(free plan)


과정

1. 프롬프트 작성

  • Claude Chat 사용. 딥리서치 성능 비교해볼 만한 질문 프롬프트 작성 요청.
  • 어제 뉴스에서 보고 궁금해진 헬스케어 도메인 선택. Claude가 리서치 질문 프롬프트를 아래와 같이 작성해줌.

 

2.  AI 입력

위 프롬프트 복사해서 붙여넣었고 결과는 아래와 같다. 길어서 파일 첨부.

GPT 헬스케어 리서치 보고서.pdf
1.49MB
Perplexity 헬스케어 리서치 보고서.pdf
0.69MB

3.  성능 비교

  • Claude Chat에 결과 파일 주고 비교 분석 요청.
  • 종합 평가

 

항목 ChatGPT Perplexity
완성도/가독성 매우 높음 (바로 쓸 수 있는 문서) 낮음 (불확실성 표시 많음)
사실 정확도 낮음 (비대면진료 제도화 상태 오류, 루닛·뷰노 수치 누락) 높음 (최신 입법 반영, 구체적 IR 수치)
출처 신뢰성 모호함 (출처-문장 매핑 불분명) 명확함 (번호 인용 + 전체 URL 목록)
정직성 낮음 (먼저 확신있게 쓰고 나중에 한계 고백) 높음 (실시간으로 한계 표시)
즉시 활용성 높음 낮음 (후처리 필요)

결과

  • GPT가 가독성 높지만, 출처가 모호하고 정확도, 신뢰도가 낮음.
  • 반면 Perplexity는 가독성은 낮지만 출처가 분명하고 정확도, 신뢰도가 높음.
  • 결론: 리서치는 가독성보다 정확성이 중요하므로, Perplexity로 리서치 후 Claude로 정리하는 것도 방법이 될 수 있겠다.

아 근데 왜 Claude에 돌려볼 생각을 안 했지? 이런!

뒤늦게 해봄.

Claude 헬스케어 리서치 보고서.pdf
0.09MB

 

종합 평가: 

  • Claude가 종합적으로 가독성과 정확성 측면에서 모두 우수하다고 함.
  • Claude가 확실히 유료 플랜이라 그런 것 같기도 함. 
  • 유료 버전 쓸 수 있을 때 열심히 사용해보고 공부하자!
항목 ChatGPT Perplexity Claude
완성도(가독성) 높음 낮음 중간~높음
사실 정확도 낮음 중간 높음
검색 깊이 알 수 없음(미공개) 얕음 깊음(30회 이상)
최신성 2025년 시점 2025년 시점 2026년 6월 시점
즉시 활용성 높음(후처리 불필요해 보임) 낮음(후처리 필요) 중간(일부 항목 보강 필요)