arXiv · 多模态、视频与世界模型· Dong Shu·· 4 天前AI 评分54
MM-FinEval:面向真实世界金融预测的多任务多模态基准
MM-FinEval: A Multi-Task Multimodal Benchmark for Real-World Financial Forecasting
AI 导读
MM-FinEval 是一个用于评估多模态大语言模型金融预测能力的基准,涵盖 2019 至 2022 年的 2,045 个 S&P 500 财报电话会,并设置 12 个金融任务标签。每条输入包含逐字稿、电话会演示文稿和完整音频,论文进一步比较了 19 个基线模型。结果显示,处理三种模态的小型 Any-to-Any 模型表现较强,部分情况下优于仅处理两种模态的大型专有模型。
来源:arXiv · 多模态、视频与世界模型 · arxiv.org