
Искусственный интеллектmedRxivEvidence 24 / Низкая
Infoxmed2.0-27B: Настройка инструкций, выравнивание предпочтений и обучение модели вознаграждения на основе GRPO для медицинских LLM
Последняя публикация
Аннотация. Большие языковые модели (LLM) продемонстрировали замечательные способности в общих областях, однако их применение в специализированных медицинских контекстах требует строгой адаптации к предметной области. Мы представля ...