0
顶级模型主动视觉仅得10.6%:工业机器人还不会像人一样反复观察
ActiveVision基准设置了17项需要持续查看、路径追踪、区域搜索和属性匹配的视觉任务。人类平均正确率达到96.1%,表现最好的GPT-5.5高推理版本只有10.6%。
ActiveVision基准设置了17项需要持续查看、路径追踪、区域搜索和属性匹配的视觉任务。人类平均正确率达到96.1%,表现最好的GPT-5.5高推理版本只有10.6%。
Meta推出Muse Spark 1.1和Meta Model API,把多模态、电脑使用、MCP、百万上下文和多智能体编排放进同一个模型叙事里,说明大厂AI竞争正在从聊天能力转向“替用户操作软件和服务”的执行能力。