2026年9月30日,AI科技评论发布实测报告,将GPT-6 Astra、GPT-5.6 Sol与Claude Fable 5.1接入同一台两轴云台机械臂,验证AI智能体在物理设备上的任务执行差异。

测试仅下发模糊指令“满行程转一遍”,不限定速度、路径与成功标准。GPT-5.6 Sol覆盖四个极限角,GPT-6 Astra Pro以最少动作配合严格反馈验证,Claude Fable 5.1追求执行速度与工具复用。三者均完成任务,但Astra产生最高成本账单。

软盟短评:该实测表明,AI大模型在物理场景中的“完成”标准尚未统一,验证策略与成本控制正成为AI智能体产业落地的关键分化点。