如何評價MiniMax開源首個視覺RL統一框架V-Triune,實現推理感知一肩挑,其技術上有何優勢?
作者: 發布日期:2025-06-22 15:20:10
這個工作其實包含了兩部分,從論文的摘要里可以看到,一個是統一的可復用的RL訓練框架,V-Triune,另一個是訓練好的結果模型:Orsta。
這兩者的關系很簡單,就是框架是可以復用的,可以用這個框架生成各種模型,文中的Orsta就是基于開源QwenVL的7B和32B模型生成的,所以這套框架的最大優勢就是 model free,理論上可以應用在任意的模型,無論是開源還是閉源。
并且這套框架最牛的地方在于把VLMs(Visual Langugage Models)的兩個…。









