80점이면 AI일 확률도 80%일까요?
그렇게 읽을 수는 없어요. 모델이 낸 점수와 실제로 맞힌 비율은 다른 값이에요. 사진의 제작 기록 검증과 별개로, 사진·영상 모델이 낸 숫자는 참고 점수로 봐 주세요.
직접 바꿔보면 쉬워요
AI라고 표시된 결과, 얼마나 믿을 수 있을까요?
아래는 설명을 위한 가정값이에요.
AI 폴리스고의 실제 모델 성능이 아니에요.
전체 1,000개 중 AI라고 표시되는 건 135개예요.
실제로 AI인 비율66.7%
단순화한 기대값이라 소수점이 나올 수 있어요. 특정 파일이 AI일 확률을 계산하는 도구는 아니에요.
점수에서 알 수 있는 것부터 구분해요
점수가 높을수록 모델이 AI 생성 이미지 쪽에 더 크게 반응했다는 뜻이에요. 그 숫자가 실제 AI 확률과 일치하는지는 별도의 검증이 필요해요.
사진에 함께 표시되는 제작 기록의 검증 상태는 점수와 다른 결과예요. 기록이 유효한지와 모델이 이미지에 얼마나 반응했는지를 따로 읽어 주세요.
| 화면에서 본 결과 | 이렇게 읽어요 | 이 뜻은 아니에요 |
|---|---|---|
| 사진 점수 80 / 100 | 이 사진에 대한 모델 참고 점수가 80이에요 | 사진의 80%를 AI로 만들었어요 |
| 사진 점수가 낮음 | 이 모델의 AI 생성 쪽 반응이 낮아요 | 실제 카메라로 촬영한 사진이 확실해요 |
| 영상 네 장면의 점수 | 선택한 정지 화면 네 장의 결과예요 | 영상 전체를 빠짐없이 검사했어요 |
| 글의 반복 횟수 | 같은 표현이 글 안에서 반복돼요 | 그 표현을 AI가 작성했어요 |
사람이 만든 자료도 높은 점수가 나올 수 있어요
사람의 자료를 AI로 잘못 보는 오류를 오탐, AI 자료를 놓치는 오류를 미탐이라고 해요. 정확도를 볼 때는 두 오류가 각각 얼마나 생기는지 확인해야 해요.
예를 들어 실제 촬영한 사진에 높은 점수가 나왔다면 사진이 AI로 바뀐 게 아니에요. 모델이 그 사진을 잘못 해석했을 수 있어요. AI 폴리스고는 다양한 실제 자료로 독립적인 정확도 검증을 마치지 않은 모델을 쓰고 있어요.
같은 사진인데 점수가 다르면 무엇부터 볼까요?
원본과 메신저 저장본, 화면 캡처는 서로 다른 파일이에요. 먼저 입력과 분석 조건이 같았는지 확인해 주세요. 다른 서비스의 점수는 척도 자체가 다를 수도 있어요.
- 파일이 같은지 확인해요. 캡처하거나 줄인 사진이 섞여 있지 않은지 봐 주세요.
- 크롭, 보정, 압축을 했는지 확인해요. 바뀐 부분이 있으면 비교 기록에 적어 두세요.
- 같은 도구와 모델 버전인지 확인해요. 버전이 다르면 점수를 그대로 비교하기 어려워요.
- 조건을 맞췄는데도 결과가 엇갈리면 원본 출처를 확인해요. 평균이나 다수결이 정답을 보장하지는 않아요.
정확도 99%라는 설명을 봤다면
어떤 자료에서 나온 숫자인지 먼저 확인해 주세요. 한국어 보고서를 검사하려는데 영어 기사로만 평가한 결과라면, 내 용도에서도 같은 성능이 나온다고 볼 수 없어요.
학습에 쓰지 않은 자료로 평가했는지, 사람의 자료와 AI 자료를 얼마나 넣었는지, 판단하지 못한 자료를 빼고 계산했는지도 중요해요. 평가 시점과 모델 버전도 확인할 수 있어야 해요.
RAID 연구에서도 생성 모델이나 글의 조건이 바뀌면 판독 성능이 흔들릴 수 있었어요. 이 연구는 일반적인 한계를 이해하는 자료이고, AI 폴리스고의 정확도를 측정한 결과는 아니에요.
결과를 남길 때는 점수와 조건을 같이 적어요
“AI 사진으로 확정” 대신 “원본 여부는 확인하지 못했고, 받은 JPG 파일을 이 버전의 모델로 분석했음”처럼 확인한 사실을 적어 주세요.
사진은 원본과 제작 이력, 글은 초안과 인용 자료, 영상은 전체 원본과 소리를 추가로 확인하면 좋아요.
이제, 궁금했던 파일을 확인해 볼까요?
분석하러 가기