ai signal
AI 업데이트: 분포가 흔들려도 무너지지 않는 법
🤖 0 in / 0 out / 0 total tokens
두 편 다 '분포가 흔들려도 안 무너지게'라는 같은 문제를 다른 각도로 푼다. 하나는 LLM 후속학습에서 교사 모델의 분포 이탈 문제고, 하나는 카메라 위치 인식에서 조명·날씨 변화 문제다.
🤖 교사 없이 스스로 크는 정책 증류
On-policy distillation(OPD)은 LLM
이더4시간 전3 min read0policy-distillationvisual-place-recognitionrobustness