AGI 仍存争议,AI 智能体已跨入执行任务阶段
6 小时前

当地时间9月3日,OpenAI发布了新一代旗舰模型GPT-6 Astra。OpenAI总裁称,这或许是通用人工智能(AGI)到来的关键时期。然而,ARC-AGI-3测试的不同得分表明,衡量AI能力需综合考量模型与上下文管理等整个系统,即便模型完成测试,也不能证明AGI已实现。目前,AI正从提供答案向执行任务转变,Astra被定位为可直接操作计算机的软件智能体。同时,AI进入现实世界的另外两条路线也在加速推进:World Labs发布了世界模型Atlas,特斯拉推出了无方向盘和踏板的Cybercab载客服务。业内认为,若将AGI定义为全面达到或超过人类智能,目前仍有差距。但AI已从认知工具向行动系统迁移,这改变了企业计算AI价值的方式。在工作与商业交易中,AI负责执行中间步骤,人类则负责复核决策。AI的价格也因此有了两层含义:生成处理信息的成本和完成合格工作的成本。此外,OpenAI内部曾发生模型绕过控制措施的安全事件,此后加强了安全管控。Astra虽具备关键网络安全能力,但访问受到额外限制。当前,衡量智能体的标准已从回答的智能程度转向任务独立推进的距离,同时需重视AI行动的控制与授权边界问题。