Skip to main navigation Skip to search Skip to main content

R1-shareVL: Incentivizing reasoning capabilities of multimodal large language models via share-GRPO

  • Huanjin Yao
  • , Qixiang Yin
  • , Jingyi Zhang
  • , Min Yang
  • , Yibo Wang
  • , Wenhao Wu
  • , Fei Su
  • , Li Shen
  • , Minghui Qiu
  • , Dacheng Tao
  • , Jiaxing Huang

Research output: Journal article publicationJournal articleAcademic researchpeer-review

Original languageEnglish
Pages (from-to)80424-80451
Number of pages28
JournalAdvances in Neural Information Processing Systems
Volume38
Publication statusPublished - 2026

Cite this