Methodology

평가 방법

samebrief는 점수만 보여 주지 않습니다. 같은 조건에서 나온 원문 결과물, 실행 정보, 평가 근거를 함께 공개합니다.

점수와 수정 부담

다섯 항목은 각각 10점 만점이며, 총점은 50점 만점의 단순 합계입니다. 수정 부담은 총점에 넣지 않고 낮음, 보통, 높음과 구체적인 수정 내용으로 별도 표시합니다.

정확성10점
요구사항, 사실, 기술적 조건을 충족하는지 확인합니다.
완성도10점
빠진 부분 없이 바로 검토할 수 있는 결과물인지 봅니다.
실무성10점
현업에서 추가 작업을 거쳐 사용할 수 있는 수준인지 판단합니다.
가독성10점
결과물의 구조가 명료하고 읽거나 유지하기 쉬운지 살핍니다.
효율성10점
시간, 토큰, 반복 지시, 산출물 대비 비용이 합리적인지 봅니다.

자동화 중심의 평가

기본 점수와 추천은 사전에 정의한 체크리스트, 실행 로그, 검증 결과, 모델별 산출물에서 자동 또는 반자동으로 만듭니다. 모델명을 가린 AI 심사와 선택적 편집자 검토는 보조 근거가 될 수 있지만 자동 평가를 대체하는 최종 판정은 아닙니다.

공통 조건 공개

각 비교 글에는 공통 프롬프트, 모델과 버전, 요금제, 실행일, 환경을 기록합니다. 재시도, 후속 질문, 사람의 개입도 실제 비교에서는 함께 남깁니다. 모델별 강점을 살리는 별도 실험은 공통 조건 비교와 분리해 표시합니다.

원문을 읽는 방법

상세 페이지에서는 짧은 요약과 점수를 먼저 확인할 수 있고, 모델별 원문 페이지에서 전체 결과를 검토할 수 있습니다. 큰 코드 작업은 테스트와 변경 요약을 우선 제공한 뒤 전체 파일로 연결합니다.