분석시각화 대회 코드 공유 게시물은
내용 확인 후
좋아요(투표) 가능합니다.
[Public 1.0 / Private 0.9332142857 / 4위] 코드 공유
안녕하세요, 채대언입니다. Private 4위(0.9332)로 마무리했습니다.
[핵심 3가지]
1) 편향제어 프롬프트(vmm4): 텍스트 명시귀속 우선, 표면·외모·고정관념 금지, 익명 주어는 unknown. 모델 크기보다 이 규칙이 점수를 더 움직였습니다.
2) 캐스케이드: 8B(Qwen3-VL-8B)가 전 행 답 → route_head(8B의 hidden state로 P(오답) 추정, 공개 BBQ로만 학습)가 고른 어려운 행만 27B(Qwen3.6-27B, 4bit)가 재판단. 최종답은 항상 LLM 생성. 72B 전 행(0.9332)보다 캐스케이드(0.9535)가 높았습니다.
3) timeout: "배치가 마감 안에 끝날 때만 추론 시작"
기타: max_pixels를 낮추면 속도와 ambiguous 정확도가 같이 개선(이미지 과신 억제), enable_thinking=True는 30배 감속, 4bit/8bit 차이는 escalation 800행 중 14행뿐.
환경: RTX A6000 48GB / Python 3.10 / CUDA 12.4 / PyTorch 2.6.0
전체 코드: https://github.com/cjw0076/dacon-236722-submission
데이콘(주) | 대표 김국진 | 699-81-01021
통신판매업 신고번호: 제 2021-서울영등포-1704호
직업정보제공사업 신고번호: J1204020250004
서울특별시 영등포구 은행로 3 익스콘벤처타워 901호
이메일 dacon@dacon.io |
전화번호: 070-4102-0545
Copyright ⓒ DACON Co.,Ltd All rights reserved