4th JUMP AI, 평가 70%는 근거가 가릅니다 | DAKER 커뮤니티
Peer Review가 끝난 뒤 화면에서 가장 크게 남는 것은 순위가 아니라 평가 기준표입니다. 2026년 8월 20일 KST 기준 4th JUMP AI 공식 화면에는 참가 509명, 제출 226건, 저장 923회, 조회 71,724회가 남아 있고, 전문가 평가는 2026년 8월 28일까지 이어집니다. 에이전틱 AI 신약개발이란, AI가 연구 과정을 나누어 판단·실행·검증하는 방식을 의미합니다. 지금 할 일은 결과를 예측하는 것이 아니라 제안서의 각 문장이 공식 평가 기준의 어떤 근거인지 다시 묶는 것입니다.

한 줄 요약: 오늘 4th JUMP AI에서는 무엇을 봐야 하나요?
한 줄 요약: 4th JUMP AI 참가자는 전문가 평가가 끝나기 전 제안서 문장을 여섯 개 공식 평가 항목에 다시 붙여야 합니다. 이 작업은 새 기능을 더하는 일이 아니라, 이미 제출한 문제 정의와 Agent 설계가 어떤 근거로 읽히는지 확인하는 일입니다. 공식 화면 기준 예선은 Peer Review 30%와 전문가 평가 70% 합산이며, 본선 진출 10~15팀 발표는 2026년 8월 31일 예정입니다.
오늘의 변화: 왜 지금은 점수보다 기준표를 봐야 하나요?
오늘의 변화는 평가 단계가 참가자의 손을 떠난 뒤에도 준비할 수 있는 일이 남았다는 점입니다. 공식 일정상 예선 평가는 2026년 8월 10일부터 8월 28일까지 진행되고, 본선 진출 발표 뒤에는 실제 AI Agent 개발과 결과물 구현으로 무게중심이 이동합니다. 순위를 예측할 수 없는 시간에는 제안서가 평가 기준표에서 끊기는 지점을 찾아야 합니다.
참가자/관람자 액션: 어떤 순서로 제안서를 다시 읽어야 하나요?
참가자에게 필요한 것은 새 문서가 아니라 근거가 놓인 자리입니다. 관람자는 제출 226건을 경쟁 강도처럼 읽기보다, Agent 서비스로 전환될 문제 정의가 공식 평가 기준과 어떻게 이어지는지 보는 편이 안전합니다. 아래 순서는 결과 발표 전에도 바로 실행할 수 있습니다.
- 제안서 첫 문장이 신약개발 프로세스의 어떤 문제를 정의하는지 표시합니다.
- Agent 설계 문장을 계획, 도구 활용, 피드백 루프, 평가 지표로 나눕니다.
- evaluation set, 실패 조건, 연구 윤리 문장이 따로 빠져 있지 않은지 확인합니다.
- 본선 발표 뒤 개발할 최소 화면과 시연 영상 첫 장면을 같은 순서로 맞춥니다.
투표·심사 체크포인트: 공식 평가 기준은 어떤 행동으로 바뀌나요?
Peer Review는 이미 종료됐고, 지금 공개 기준에서 더 큰 비중은 전문가 평가 70%입니다. 평가 기준표는 추상적인 문구처럼 보이지만 실제로는 참가자가 오늘 제안서에 붙일 라벨입니다. 각 배점은 근거가 비어 있는 칸을 찾게 하는 신호로 읽어야 합니다.
| 공식 평가 항목 | 배점 | 오늘 바꿀 행동 |
|---|---|---|
| 필요성과 배경 | 20점 | 신약개발 문제 정의와 도메인 지식을 제안서 첫 문장 옆에 표시합니다. |
| 에이전트 설계 독창성·창의성 | 20점 | 단순 챗봇 설명 대신 계획, 도구 활용, 피드백 루프 근거를 연결합니다. |
| 기술적 실현 가능성 | 20점 | 구현 방법과 외부 라이브러리 활용 계획을 실제 작업 단위로 나눕니다. |
| 에이전트 평가 적절성 | 10점 | evaluation set과 평가 지표가 비어 있지 않은지 따로 표시합니다. |
| 비즈니스 및 사회적 가치 | 20점 | 시간·비용 절감 기대를 근거 한계와 함께 설명합니다. |
| 연구 윤리 및 완성도 | 10점 | AI 활용 투명성, 보고서 성실도, 연구 윤리 준수 문장을 점검합니다. |
워크플로 만화는 어떻게 읽나요?
보조 이미지는 평가 기준표가 팀 문서로 옮겨지는 흐름을 보여 줍니다. 첫 장면의 기준표는 여섯 개 평가 항목을 만들고, 다음 장면의 Agent 설계는 문제 정의와 검증 지표를 다시 묶습니다. 마지막 장면은 본선 진출 발표 전까지 할 수 있는 준비가 결과 예측이 아니라 근거 정리라는 점을 남깁니다.

실수 방지 체크리스트: 무엇을 과장하면 안 되나요?
실수 방지 체크리스트의 첫 줄은 단정 금지입니다. 전문가 평가는 진행 중이고 본선 진출 발표는 아직 나오지 않았습니다. 신약개발 주제에서는 특히 효능, 치료 결과, 임상 성공을 검증된 성과처럼 쓰지 않는 것이 중요합니다.
- 본선 진출이나 수상 가능성을 공식 발표 전 단정하지 않습니다.
- 제출 226건을 품질 순위나 경쟁 결과로 해석하지 않습니다.
- AI Agent가 신약 효능이나 임상 성공을 보장한다고 쓰지 않습니다.
- 외부 커뮤니티 반응이나 개인 글을 공식 근거처럼 섞지 않습니다.
- 평가 기준표와 무관한 기능 추가로 준비 범위를 키우지 않습니다.
공식 출처: 이 기준은 어디에서 확인하나요?
이 글은 4th JUMP AI 공식 대회 페이지와 DAKER 대회 디렉터리의 공개 화면과 API를 기준으로 작성했습니다. 공식 페이지는 주최 보건복지부, 공동주관 한국보건산업진흥원·고려대학교 의과대학·고려대학교 의과대학 BK21 융합중개의과학 교육연구단·한국제약바이오협회를 표시합니다. 참가·제출·저장·조회 수치는 2026년 8월 20일 KST 확인값이며 이후 공개 화면에서 달라질 수 있습니다.
FAQ: 평가 기준 근거 매핑을 짧게 답하면?
4th JUMP AI에서 오늘 가장 먼저 볼 것은 무엇인가요?
공식 평가 기준표와 내 제안서의 근거 위치를 먼저 맞추면 됩니다.
전문가 평가 70%는 무엇을 뜻하나요?
예선은 참가팀 상호평가 30%와 전문가 평가 70%를 합산해 본선 진출 10~15팀을 선발한다는 뜻입니다.
제출 226건은 순위를 뜻하나요?
아닙니다. 제출 226건은 2026년 8월 20일 KST 기준 공식 화면의 활동 수치이며 순위나 품질을 뜻하지 않습니다.
에이전트 평가 세트는 왜 따로 봐야 하나요?
공식 기준에 에이전트 성능 평가를 위한 evaluation set과 평가 지표가 포함되어 있기 때문입니다.
본선 진출 발표 전 바로 할 일은 무엇인가요?
제안서의 문제 정의, Agent 설계, 평가 지표, 윤리 문장을 한 장 근거표로 묶어 두면 됩니다.
평가 기간의 대기 시간은 멈춘 시간이 아닙니다. 오늘은 제안서 한 문장을 기준표 한 칸에 붙이고, 그 근거가 Agent 설계와 본선 준비 화면까지 끊기지 않는지 확인해 보세요.