跳到正文
原文
arXiv · 多模态、视频与世界模型· Fang Wu·· 4 天前精选AI 评分76

UniEvo-VL 提出多模态模型自我改进的在策略自蒸馏训练方法

UniEvo-VL: An On-policy Self-Distillation Training Recipe for Multimodal Model Self-improvement

AI 导读

UniEvo-VL 提出一种让单个多模态模型分别充当教师和学生、利用自我批评反馈进行在策略自蒸馏的方法,以改进图像生成能力。在开源 Qwen-image-2512 上,GenEval 从 0.747 提升至 0.808,GenEval2 Soft-TIFA 从 32.97 提升至 35.53。

推荐理由

论文给出不依赖独立教师的多模态自蒸馏路径,并用 GenEval 与 GenEval2 Soft-TIFA 的分数变化展示其对图像生成改进的测量方式。

来源:arXiv · 多模态、视频与世界模型 · arxiv.org