Google Gemini가 문장을 읽고 가짜뉴스일 가능성을 판별합니다. AI가 답하지 못하면 진짜·가짜 뉴스 문장으로 학습시킨 자체 통계 모델의 결과를 참고하세요.
AI가 판별하고 있습니다…
저희가 직접 학습시킨 통계 모델로, 문장의 표현 방식(문체)만 봅니다. 사실관계는 확인하지 않습니다. AI 판정과 비교해서 '문체만으로 어디까지 가려낼 수 있는지'를 보여주기 위한 기준선입니다.
문장을 어절로 자르고 조사·어미를 떼어낸 뒤, 각 단어가 판정에 얼마나 기여했는지 봅니다. 빨간 막대는 '가짜' 방향, 초록 막대는 '진짜' 방향으로 작용한 단어예요.
뉴스톱·연합뉴스 팩트체크·JTBC 팩트체크 등에서 실제로 판정된 가짜뉴스/정상 보도 사례 총 -건(원문을 그대로 쓰지 않고 패러프레이즈)을 학습 데이터로 사용했습니다. 문장을 어절로 자르고 조사·어미를 떼어낸 뒤 TF-IDF로 수치화하고, 로지스틱회귀로 '가짜뉴스다움'을 학습시켰습니다. 형태소 분석기는 일부러 쓰지 않았습니다 — 학습(파이썬)과 이 페이지(자바스크립트)가 완전히 같은 계산을 하는지 검증할 수 있어야 하기 때문입니다.