AI圈报
模型发布 / 更新精选

OSReward:为跨平台计算机操作智能体奖励模型建立标准化评测

信息来源:HuggingFace Daily Papers(社区热门论文)·
原始标题:OSReward: Instituting Standardized Evaluation for Cross-Platform Computer-Use Reward Models

内容摘要

OSReward 是一个用于评估视觉语言模型(VLM)作为计算机操作智能体(CUA)轨迹评判者的高质量基准,并衍生出聚焦困难案例的 OSReward-Hard 与细粒度评分的 OSReward-Multi。
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-1f1320a2bd9f4bbf166cd5d9