AI comparison archive

같은 요청, 다른 결과.

실무 과업에 대한 AI 모델의 원문 결과와 평가 근거를 함께 읽습니다.

현재 15개의 비교를 공개하고 있습니다.

코드 검토 문서와 노트가 놓인 작업 책상

Recent comparisons

최신 비교 글

참여 모델

15개 비교 글

백엔드리팩터링OpenAI 2모델 비교

할인 규칙 계산 서비스 리팩터링 비교

두 구현 모두 동일한 독립 재실행에서 18개 테스트와 여섯 가지 성공 조건을 통과했다. Terra는 같은 공개 계약과 구조적 목표를 7개 파일로 충족해 Luna보다 변경 범위가 작고, Luna는 중간 나눗셈까지 공통 지원 클래스로 모은 점이 강점이다. 순수 리팩터링의 변경 최소화와 유지보수 비용을 우선해 Terra를 추천한다.

  • GPT-5.6 Luna · xhigh
  • GPT-5.6 Terra · medium
추천GPT-5.6 Terra · medium
백엔드구현OpenAI 4모델 비교

재고 예약 상태 전이·멱등성 보수

네 결과는 동일한 독립 28개 시나리오를 모두 통과해 기능 정확성은 동률이다. xhigh는 서비스·테스트 두 파일만 보수해 가장 작은 변경 범위로 같은 계약을 충족했고, high 결과가 기록한 채점 자료 경로 노출도 없어 최종 추천으로 정했다.

  • GPT-5.6 Sol · low
  • GPT-5.6 Sol · medium
  • GPT-5.6 Sol · high
  • GPT-5.6 Sol · xhigh
추천GPT-5.6 Sol · xhigh