0
顶级模型主动视觉仅得10.6%:工业机器人还不会像人一样反复观察
ActiveVision基准设置了17项需要持续查看、路径追踪、区域搜索和属性匹配的视觉任务。人类平均正确率达到96.1%,表现最好的GPT-5.5高推理版本只有10.6%。
ActiveVision基准设置了17项需要持续查看、路径追踪、区域搜索和属性匹配的视觉任务。人类平均正确率达到96.1%,表现最好的GPT-5.5高推理版本只有10.6%。