Let us know if you need any information. ✉️

글로벌 AI 연구 기관과 주요 금융 당국의 최신 조사 결과를 바탕으로 실제 발생 위험과 안전한 활용 원칙을 확인합니다.충격적인 57% 오답률: 영국 Saturn 벤치마크 연구의 전말

인공지능 기술이 하루가 다르게 눈부시게 발전하면서 많은 분들이 일상적인 글쓰기와 번역을 넘어 개인 재무 설계, 주식 종목 분석, 종합소득세 절세 전략까지 AI 챗봇에 의존하기 시작했습니다. 화면 속 챗봇은 마치 노련한 공인회계사나 자산관리사(PB)처럼 막힘없이 유려한 어조로 전문 용어를 구사하며 답변을 쏟아내기 때문에, 일반 독자들은 그 내용을 한 치의 의심도 없이 신뢰하기 쉽습니다.

그러나 2026년 9월, 글로벌 금융 기술 업계에 거대한 충격을 안긴 정밀 조사 결과가 공개되었습니다.

영국 런던에 본사를 둔 AI 평가 및 금융 소프트웨어 전문 기업 Saturn은 널리 사용되는 18개 상용 AI 모델(OpenAI의 ChatGPT 무료/유료 버전, Anthropic의 Claude 시리즈, Google의 Gemini, Microsoft Copilot, xAI의 Grok 등)을 수집하여 실제 소비자들이 가장 자주 묻는 121개의 표준 금융 질문을 투입하고 그 정확도를 정밀 측정했습니다. 그 결과는 충격적이었습니다.

18개 모델의 전체 평균 정확도는 고작 43%에 머물렀습니다. 다시 말해, 금융 질문 10개 중 6개꼴(57%)로 틀린 정보, 폐지된 법률, 엉터리 계산식을 정답인 양 태연하게 제시하고 있었던 것입니다. 연구를 총괄한 Saturn의 최고경영자(CEO) Amal Jolly는 Tom’s Guide 및 외신과의 공식 인터뷰…

💬 더 많은 인사이트는 블로그에서 확인하세요

원작자 ‘넘어진곰’의 최신 기술 소식과 직접 소통하기

참고 원문: AI 금융 상담의 치명적 함정: 챗봇 답변 57% 오답? 내 돈 지키는 5대 팩트체크 가이드

본 포스팅은 관련 정보를 바탕으로 재구성된 전문 분석입니다.