RL로 키운 의료모델
FreedomIntelligence/HuatuoGPT-3-32B · Hugging Face
·2026.04.15 15:17
핵심 내용
SeedRL로 만든 32B 의료 LLM을 공개하고, thinking mode 기본값으로 설정했다.
자세히 보기
HuatuoGPT-3는 SeedRL이라는 RL-only 도메인 적응 방식으로 만든 오픈소스 의료 LLM이다. 베이스 모델을 한 번의 RL 단계만으로 의료 전문가 수준으로 전환하는 접근을 내세운다.
HuatuoGPT-3-32B는 Qwen3-32B를 기반으로 한 33B params / BF16 모델이며, 기본적으로 <think>...</think> 추론 블록을 출력하는 thinking mode로 설정돼 있다.
모델 라인업은 다음과 같다.
- HuatuoGPT-3-32B: Qwen3-32B 기반 의료 LLM
- HuatuoGPT-3-8B: Qwen3-8B-Base 기반
- HuatuoGPT-3-7B-Pangu: openPangu-Embedded-7B 기반
배포는 vLLM이나 SGLang 같은 서빙 도구로 가능하고, transformers를 이용한 직접 추론 예시도 제공한다. 예시 프롬프트는 발열, 기침, 호흡곤란 환자에 대해 우선 고려할 사항을 묻는 의료 질의다.
논문 인용 정보는 아직 arXiv preprint 형식이며, 저자는 Coming soon으로 표시돼 있다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.