실제 심사 사례로 AI에게 물어보고, 그 답변이 실무에 쓸 만한지 세 가지 기준으로 채점합니다.
이 답변으로 일을 끝낼 수 있는가를 봅니다. 근거를 원문에서 다시 찾아봐야 한다면 그만큼 감점입니다. 최종 답변만 보고, 세 축을 각각 독립적으로 매기세요.
| # | 축 | 한 줄 질문 | 낮을 때의 생산성 손실 |
|---|
척도의 정신 — 5 매우 그렇다 고칠 것 없이 그대로 사용 가능 · 4 그렇다 사소한 보완이면 수용 가능 ·
3 보통 담당자가 원문을 직접 확인해야 함 · 2 그렇지 않다 유의미한 결함 · 1 매우 그렇지 않다 완전 실패.
구분 기준 — 5 vs 4 = "청구 전에 뭔가 고칠 것이 있는가?"(없다 → 5) · 3 vs 2 = "이걸 그대로 믿으면 잘못된 청구가 될 수 있는가?"(그렇다 → 2).
아래 목록은 이 브라우저에만 남습니다. 질의와 채점 결과는 서버에도 함께 기록됩니다.