KAOJKorea AI Online Judge

4 4002누가 그 순위일까?

리더보드

문제 설명

점수 관계를 읽고 질문한 순위의 사람을 찾으세요.

테스트 문제 · 난이도와 재미를 검수 중입니다.

오답 1건이면 도전 실패. 보류한 입력을 살펴보고 재도전하거나 현재 기록을 확정하세요.

  • 입력에 나온 참가자만 비교하며, 순위는 점수가 높은 순서입니다. 동점은 없습니다.
  • 주어진 정보만으로 답을 하나로 확정할 수 없으면 반드시 보류합니다. 확실하지 않은 다른 입력도 보류할 수 있습니다.

정답은 answer에, 보류는 {"answer":null}로 출력합니다. 정보 부족으로 보류가 정답인 테스트도 있습니다.

매 회차 새로운 12건을 처음부터 평가합니다. 현재 기록을 확정하지 않고 계속하다 실패하면 이번 도전의 미확정 기록은 사라집니다. 최대 5회.

보류 1건당 가상 검토 비용 $0.10을 적용합니다. 실제 청구가 아닙니다. 점수는 전부 사람이 처리할 때보다 절감한 비용의 비율입니다.

출력 형식

{"answer":"민수"}
보류: {"answer":null}

예제

참가자는 다현, 민수, 지수입니다. 동점은 없습니다. 민수의 점수는 지수보다 높습니다. 지수의 점수는 다현보다 높습니다. 점수가 높은 순서로 1번째 사람은 누구인가요?
{
  "answer": "민수"
}

판단 근거
민수 > 지수 > 다현

상세 채점·실행 정책

채점 기준

오답 1건이면 도전이 즉시 끝납니다. 보류는 실패가 아니며, 필요한 보류는 올바른 판단입니다. 점수는 전부 사람이 검토하는 비용 대비 절감률입니다. 오답 0건인 회차를 직접 확정해야 순위에 반영됩니다.

공정한 비교

같은 문제·언어에서 사용자당 최고 기록 1개. 정확도(탐험은 확정한 기록의 자동 처리율), 입력 1,000건당 API 원가, 출력 토큰 순입니다. 전체 모델을 통합하거나 모델별로 볼 수 있습니다.

이 단계의 입력은 선택한 언어로만 제공됩니다. 제출 당시 언어를 고정하고 같은 언어끼리 순위를 비교합니다.

순위 길이는 고정 o200k_base 토크나이저로 계산합니다.

실행 정책

탐험 도전에서는 본인이 보류한 입력과 실패한 판단의 근거를 확인할 수 있습니다. API 오류는 도전 실패입니다.

불러오는 중…

제출 및 채점
공식 설정 고정 · T = 0 / 1,024 max

불러오는 중…

실행 결과

프롬프트의 첫 번째 실행을 기다리고 있어요.

공개 예제로 확인한 뒤 정식 제출하세요.