카테고리 없음
AI 딥리서치 성능 간단 비교(feat. Perplexity vs. GPT)
j-node
2026. 6. 30. 18:22
계획대로라면 오늘 Perplexity vs. Manus 딥리서치 성능 비교해야 하는데 Manus credit 이미 다 썼음......
그래서 Perplexity vs. GPT 대결로 대체함.
목표
무료 버전 AI(Perplexity, GPT)로 딥리서치가 1)얼만큼 상세히 가능한지 2)출처는 어느 정도 신뢰할 수 있는지 비교해본다.
도구
Claude Sonnet 4.6(team plan 중 무언가), Perplexity Standard Search(free plan), GPT-5.5 Instant(free plan)
과정
1. 프롬프트 작성
- Claude Chat 사용. 딥리서치 성능 비교해볼 만한 질문 프롬프트 작성 요청.
- 어제 뉴스에서 보고 궁금해진 헬스케어 도메인 선택. Claude가 리서치 질문 프롬프트를 아래와 같이 작성해줌.



2. AI 입력
위 프롬프트 복사해서 붙여넣었고 결과는 아래와 같다. 길어서 파일 첨부.
GPT 헬스케어 리서치 보고서.pdf
1.49MB
Perplexity 헬스케어 리서치 보고서.pdf
0.69MB
3. 성능 비교
- Claude Chat에 결과 파일 주고 비교 분석 요청.
- 종합 평가
| 항목 | ChatGPT | Perplexity |
| 완성도/가독성 | 매우 높음 (바로 쓸 수 있는 문서) | 낮음 (불확실성 표시 많음) |
| 사실 정확도 | 낮음 (비대면진료 제도화 상태 오류, 루닛·뷰노 수치 누락) | 높음 (최신 입법 반영, 구체적 IR 수치) |
| 출처 신뢰성 | 모호함 (출처-문장 매핑 불분명) | 명확함 (번호 인용 + 전체 URL 목록) |
| 정직성 | 낮음 (먼저 확신있게 쓰고 나중에 한계 고백) | 높음 (실시간으로 한계 표시) |
| 즉시 활용성 | 높음 | 낮음 (후처리 필요) |
결과
- GPT가 가독성 높지만, 출처가 모호하고 정확도, 신뢰도가 낮음.
- 반면 Perplexity는 가독성은 낮지만 출처가 분명하고 정확도, 신뢰도가 높음.
- 결론: 리서치는 가독성보다 정확성이 중요하므로, Perplexity로 리서치 후 Claude로 정리하는 것도 방법이 될 수 있겠다.
아 근데 왜 Claude에 돌려볼 생각을 안 했지? 이런!
뒤늦게 해봄.
Claude 헬스케어 리서치 보고서.pdf
0.09MB
종합 평가:
- Claude가 종합적으로 가독성과 정확성 측면에서 모두 우수하다고 함.
- Claude가 확실히 유료 플랜이라 그런 것 같기도 함.
- 유료 버전 쓸 수 있을 때 열심히 사용해보고 공부하자!
| 항목 | ChatGPT | Perplexity | Claude |
| 완성도(가독성) | 높음 | 낮음 | 중간~높음 |
| 사실 정확도 | 낮음 | 중간 | 높음 |
| 검색 깊이 | 알 수 없음(미공개) | 얕음 | 깊음(30회 이상) |
| 최신성 | 2025년 시점 | 2025년 시점 | 2026년 6월 시점 |
| 즉시 활용성 | 높음(후처리 불필요해 보임) | 낮음(후처리 필요) | 중간(일부 항목 보강 필요) |