OpenAI首款AI硬件,为什么是个没有屏幕的"甜甜圈"
2 小时前 / 阅读约9分钟
来源:凤凰网
OpenAI与Jony Ive团队正推进首款消费级AI硬件,形态接近无屏智能音箱,旨在探索AI为主要交互入口的计算设备,挑战传统屏幕交互方式。

OpenAI 的第一款 AI 硬件,大概是近两年最神秘的薛定谔产品。我们至今不知道它究竟长什么样,但几乎每隔几个月,都能收到一个新答案。

最早有人说是智能笔,再后来,台灯、眼镜、可穿戴设备轮番登场。传闻多到后来,连我们这些围观群众都有点狼来了的 PTSD。

根据彭博社今天的最新报道,OpenAI 与 Jony Ive 团队正在推进的第一款消费级设备,目前更接近一台没有屏幕的智能音箱,其外形接近一个冰球大小的圆环。

@PatentlyApple 制作的渲染图

更直白一点,看起来像一块金属甜甜圈。

如果只看产品形态,这款售价可能达到 300 至 400 美元的产品,很容易被理解成一台更贵、更精致的智能音箱。但 OpenAI 的定位更激进,希望把它做成一种 AI-first computer,也就是以 AI 为第一交互入口的计算设备。

冰球大小的圆盘,只是目前露出水面的第一种形态。而 OpenAI 真正想验证的是:当 AI 足以承担主要交互时,我们还需要每天盯着一块屏幕吗?

01

一块会动的金属「甜甜圈」

目前曝光的信息已经相当具体。

设备整体呈圆环状,大小接近冰球,可以单手拿起,在家中不同空间移动。它没有显示屏,但会配备扬声器、麦克风、灯光、摄像头以及其他环境传感器,并由电池供电,预计在明年发布。

用户既可以把它放在床头柜,也可以带到厨房、客厅,甚至直接拿在手里使用。

值得注意的是,这一形态也与美国知名设计师 Joe Gebbia 此前被拍到的疑似泄露设备高度吻合。

更有意思的是,它并非一块完全静止的金属。

报道称,设备内部还会设计能够自行活动的机械结构。当用户和 AI 对话时,部分组件会产生移动,同时配合灯光变化,让人知道它正在倾听、回应或者执行任务。

智能音箱长期以来存在一个问题。Alexa、Google Assistant 和 Siri 即便能够持续对话,用户面对的仍然是一件静止的电子产品。你喊它一句,它亮一下;问它一个问题,它回答之后便重新沉默。

OpenAI 希望通过动作、灯光和更自然的语音交互,让设备具有更强的存在感,甚至让用户感觉它像一个真正参与环境的对象。

而摄像头和传感器也意味着,它获取的信息不会局限在声音。传统智能音箱只能知道你说了什么,而 OpenAI 希望它进一步理解你身边正在发生什么。

由 Trung Phan 制作的渲染图

例如,你可能不再需要告诉 AI 桌子上有一瓶药,而可以直接询问这瓶药什么时候吃;也不需要详细描述厨房里的情况,而是直接问锅里的东西是不是该关火了。

视觉、语音、长期记忆和环境感知如果真正结合起来,AI 获得的就不再只是一次对话,而是一段持续存在的上下文。

这也是 OpenAI 过去几年一直在推动的方向。

未来真正有价值的 AI,很可能不仅要回答问题,还要长期知道用户正在做什么、过去做过什么,并据此持续提供帮助。

02

离开苹果,Jony Ive 正在寻找 iPhone 之后

另一个让整件事更有戏剧性的地方,是 Jony Ive。

OpenAI 第一款硬件的设计合作方正是他的 LoveFrom 工作室。

作为曾经主导 iPhone、iPod、iPad 和 Apple Watch 设计的人,Jony Ive 几乎参与定义了过去二十年消费电子最重要的一套产品语言。

如今,他正在和 OpenAI 一起寻找另一种可能。

去年,OpenAI 收购了 Ive 共同创办的硬件公司 io,双方由合作正式转向深度绑定。OpenAI 也已经公开表达过长期建立完整设备业务的计划,终极目标甚至包括创造一种有能力替代智能手机的产品。

与此同时,苹果和 OpenAI 之间的关系却迅速恶化。

最近,苹果已经就商业机密问题起诉 OpenAI 及相关人员,指控对方获取并使用了涉及产品设计、制造工艺和供应链的信息。其中一个争议点,是 OpenAI 是否曾要求苹果长期合作的供应商,为其开发类似苹果使用的金属表面处理技术。

OpenAI 否认相关指控,认为苹果的说法过于宽泛,并随后在要求法院驳回诉讼的文件中强调,自己正在打造一种与苹果现有产品完全不同的新东西。

至少从目前曝光的产品形态来看,这款圆环设备确实很难直接对应苹果现有的某个产品。两家公司的路线已经出现非常明显的差异。

包括苹果正在开发的新一代家庭设备,据报道则更接近一块连接机械结构的显示屏,可以转向说话的人,并承担 FaceTime 等视觉任务。

苹果依然试图让显示屏进入更多场景,OpenAI 则试图验证一个更激进的问题:如果 AI 足够强,未来的人机交互是否还需要屏幕始终存在?

某种意义上,这也是 Jony Ive 职业生涯中一个很有意思的转折。

Jony Ive 近二十年前参与设计了一块几乎吞噬整个消费电子行业的触摸屏;二十年后,他正在参与设计一件试图去掉屏幕的计算设备。

03

为什么 OpenAI 第一台硬件,偏偏没有屏幕

智能手机过去十几年的核心价值,很大程度上建立在屏幕和 App 之上。

用户通过屏幕寻找信息,通过 App 调用服务,再通过触摸完成每一个操作步骤。整个移动互联网的商业模式、产品设计乃至广告体系,都围绕这套交互方式建立。

Agent 正在试图改变其中最基础的一层关系。当用户只需要表达意图,AI 就能够自行决定调用什么软件、读取什么信息、完成哪些操作时,App 的界面价值会下降,屏幕承担的任务也会随之减少。

由 X 博主 Jesse Waites 制作的渲染图(已翻译为中文)

OpenAI 所谓的 AI-first computer,大概就是建立在这个判断之上。

未来的计算设备,可能不再以等待用户点击为核心,而会逐渐变成一个能够听、能够看、能够记住上下文,并主动帮助用户完成任务的 Agent。

从这个角度看,没有屏幕反而成为一种非常明确的产品表达。

掏出手机、解锁、打开 ChatGPT、输入指令,本身仍然属于智能手机时代的交互方式。OpenAI 想做的是把这些启动步骤进一步抹掉,让 AI 长期存在于环境之中。

你在厨房想到一件事,可以直接开口;睡前突然想起明天的安排,也不需要摸手机;设备通过摄像头和麦克风获得环境信息之后,甚至可以省掉大量背景描述。

相比之下,智能眼镜更接近全天候 AI,但隐私问题也更敏感。

持续佩戴的摄像头会让周围所有人都被纳入感知范围。智能眼镜过去几年的尝试已经证明,技术可行并不等于社会可接受。

相比之下,放在家庭空间的设备更容易被接受。

OpenAI 从智能音箱形态切入,可能正是为了在测试全天候交互的同时,避开穿戴设备最敏感的隐私争议。

当然,过去几年的 AI 硬件已经留下了足够多的反面教材。Humane Ai Pin 最典型的问题就是,拿掉屏幕本身并不会创造下一代计算平台。

当模型能力、响应速度、Agent 执行能力和产品可靠性无法匹配时,没有屏幕甚至会放大所有交互问题。

OpenAI 与这些创业公司的差别,在于它已经拥有模型和用户,现在需要寻找一个更适合这些能力存在的物理载体,这背后反映的也正是 AI+和 AI-Native 之间的区别。

AI+ 的逻辑,是在既有设备和既有交互方式上「加一层智能」,本质仍然是人主动打开工具、工具被动响应需求。

而 AI-Native 的思路则完全相反,它不是在现有系统上打补丁,而是重新定义「人如何与计算发生关系」。在这个框架里,模型就是交互本身;设备也不再是入口,而是环境的一部分。

当这种范式成立时,硬件不再只是承载软件的容器,而会上升为决定交互形态的第一性约束。一旦技术平台发生变化,最值得警惕的往往是交互入口开始发生转移。

历史上每一次平台更替,几乎都伴随着入口的迁移:PC 时代的入口是桌面和浏览器,移动互联网的入口是 App 图标和触控屏,而 AI 时代的入口,正在从点击变成对话,从操作系统变成意图系统。

与之相伴的则是,原有生态的分发逻辑、产品形态乃至商业模式都会被重新洗牌。破局的代价不可谓不大,但破局之后能够摘取的果实,同样也是最丰厚的。

科技史上很多真正重要的产品,最初都源于一个看起来有些多余的问题:电脑为什么一定要放在桌上?电话为什么一定要连着一根线?互联网为什么一定要打开浏览器?手机为什么一定要有一块屏幕?

多年以后回头看,推动技术继续向前的,常常正是这些当时没有必要追问的问题。已经足够好用的东西,总有人好奇还有没有另一种可能?因为即便没有 OpenAI,也一定会有其他人去推开这扇未知的门。

某种意义上,人类文明也是从这样的好奇开始的。

几十万年前,当一个原始人第一次放下眼前的事情,抬头凝视那些与吃饭、生存似乎毫无关系的星星时,他当然不知道答案,也不知道这一眼最终会把人类带到哪里。但后来发生的一切,或许都始于那一次仰望。

*封面由 AI 生成