한국어EN
RAG·파인튜닝·컨텍스트Bowen Jin 외 (UIUC)

Search-R1 발표

Search-R1 발표 — 검색 엔진 호출을 강화학습으로 학습시켜 추론 중 다중 질의 수행

왜 중요한가

검색 전략을 프롬프트가 아닌 학습으로 획득

출처 — 1차 출처만 싣고, 직접 이동해 확인할 수 있어요 논문arxiv.orghttps://arxiv.org/abs/2503.095162026년 8월 24일에 더한 조각 · 그 주 보기