← Mealplanning 페이지로
이 실험은 9회차 · 270 호출입니다. 별도의 2,276 호출 대량 비교와는 다른 실험이며 합산하지 않습니다.
9회차 반복 검증과 되돌린 판단근거 기반 정리
출처 · services/chat/validation/runs.json  |  시점 · 2026-07-14 ~ 07-15
지표 · 30건 스위트 정답 수 · seed 별 일반화 확인
이 근거로 내린 판단 · 점수가 올라도 조건이 한정되면 되돌리고, seed 를 바꿔 다시 확인함

9회차 · 회차당 30건 · 총 270 호출

회차케이스seed점수메모
13042
23042
33042
4307미학습 seed 로 일반화 확인
530101미학습 seed 로 일반화 확인
630555미학습 seed 로 일반화 확인
73042이전 회차에서 넣은 경계매칭을 되돌림 — 복합 요리명을 놓치는 손실이 더 컸고, 오프토픽은 다른 장치가 이미 막고 있었음
83042
93042

원본 runs.json(94,780 B)에서 회차·seed·케이스 수를 그대로 읽어 표로 옮겼습니다. 값은 원본과 동일합니다.

여기서 한 판단

점수가 오른 변경을 되돌렸습니다. 특정 조건에서만 유리하고 복합 요리명을 놓치는 손실이 더 컸기 때문입니다. 그리고 좋은 점수가 나온 뒤 바로 다음 단계로 가지 않고, 학습에 쓰지 않은 seed 3개로 같은 코드가 일반화되는지 먼저 확인했습니다.