OpenAI 筹备已久的首款 AI 硬件,堪称过去两年里最让人捉摸不透的“薛定谔”之作。没人确切知道它最终会呈现什么模样,但每隔几个月,总有一波新传闻涌出水面。
起初猜测是智能笔,随后台灯、眼镜、可穿戴设备轮番上阵。传闻多到一定程度,连我们这些旁观者都生出一种“狼来了”的心理疲劳。
据彭博社今日最新披露,OpenAI 联合 Jony Ive 团队推进的第一款消费级产品,目前更接近一台无屏智能音箱,外形宛如一个冰球大小的圆环。
@PatentlyApple 制作的渲染图
通俗点说,看着就像个金属材质的甜甜圈。
单看形态,这款定价可能在 300 至 400 美元区间的产品,极易被视作一款更昂贵、做工更精致的智能音箱。但 OpenAI 的野心远不止于此,他们试图将其打造为一种以 AI 为首要交互入口的计算设备——即所谓的 AI-first computer。
这枚冰球般的圆盘,仅是浮出水面的第一层形态。OpenAI 真正想验证的核心命题是:当 AI 足以承担主要交互职能时,我们是否还需要日复一日地盯着屏幕?
一块会动的金属「甜甜圈」
目前曝光的细节已相当具体。
设备整体呈圆环状,体积近似冰球,可单手握持,能在家居不同空间间自由移动。它摒弃了显示屏,转而配备扬声器、麦克风、灯光、摄像头及各类环境传感器,由电池供电,预计明年与消费者见面。
用户既可将它置于床头柜,也能带入厨房、客厅,甚至直接手持使用。
值得注意的是,这一设计轮廓与美国知名设计师 Joe Gebbia 此前被拍到的疑似泄露设备高度吻合。
更具趣味性的是,它并非一块静止不动的金属块。
报道指出,设备内部嵌入了可自主活动的机械结构。当用户与 AI 对话时,部分组件会发生位移,配合灯光变化,直观地传达出它正在倾听、回应或执行任务的信号。
长期以来,智能音箱面临一个固有痛点。Alexa、Google Assistant 和 Siri 即便能维持连续对话,用户面对的始终是一件冰冷的静态电子产品。喊一声,亮一下;问一句,答完后便陷入沉默。
OpenAI 企图通过动作、灯光及更自然的语音交互,增强设备的存在感,让用户感觉它像是一个真正融入环境的生命体。
摄像头与传感器的加入意味着,其感知范围不再局限于声音。传统智能音箱仅知晓你说了什么,而 OpenAI 希望它能进一步理解你周围正在发生什么。
由 Trung Phan 制作的渲染图
举例而言,你可能无需特意告知 AI 桌上有瓶药,而是直接询问何时服用;也不必详细描述厨房现状,只需问锅里的食物是否需要关火。
视觉、语音、长期记忆与环境感知的深度融合,将使 AI 获取的不再是一次孤立的对话,而是一段持续存在的上下文背景。
这正是 OpenAI 过去数年持续推动的方向。
未来具备高价值的 AI,很可能不仅要回答问题,还需长期掌握用户的当前行为与历史习惯,并据此提供持续性辅助。
离开苹果后,Jony Ive 在寻找 iPhone 之后的下一个可能
整件事充满戏剧性的另一重原因,在于 Jony Ive 的介入。
OpenAI 首款硬件的设计合作方,正是他的 LoveFrom 工作室。
作为曾主导 iPhone、iPod、iPad 和 Apple Watch 设计的灵魂人物,Jony Ive 几乎定义了过往二十年消费电子领域最重要的产品语言体系。
如今,他正携手 OpenAI 探索另一种可能性。
去年,OpenAI 收购了 Ive 共同创立的硬件公司 io,双方关系由合作转向深度绑定。OpenAI 亦公开表达了建立完整设备业务的长期计划,终极目标甚至包含创造一种能替代智能手机的产品。
与此同时,苹果与 OpenAI 的关系迅速降温。
近期,苹果就商业机密问题起诉 OpenAI 及相关人员,指控对方获取并使用涉及产品设计、制造工艺及供应链的信息。争议焦点之一,是 OpenAI 是否曾要求苹果长期合作的供应商,为其开发类似苹果使用的金属表面处理技术。
OpenAI 否认相关指控,认为苹果的说法过于宽泛,并在要求法院驳回诉讼的文件中强调,自己正在构建一种与苹果现有产品截然不同的全新事物。
至少从目前曝光的产品形态来看,这款圆环设备确实难以直接对应苹果现有的任何单品。两家公司的路线已显现出显著差异。
包括苹果正在开发的新一代家庭设备在内,据报道更接近一块连接机械结构的显示屏,可转向说话者并承担 FaceTime 等视觉任务。
苹果仍致力于让显示屏进入更多场景,而 OpenAI 则在验证一个更为激进的问题:如果 AI 足够强大,未来的人机交互是否仍需屏幕常驻?
从某种意义上讲,这也是 Jony Ive 职业生涯中一个颇具意味的转折。
近二十年前,Jony Ive 参与设计了一块几乎吞噬整个消费电子行业的触摸屏;二十年后,他正参与设计一件试图去掉屏幕的计算设备。
为何 OpenAI 的首台硬件偏偏没有屏幕
智能手机过去十几年的核心价值,很大程度上建立在屏幕与应用(App)之上。
用户通过屏幕搜寻信息,通过 App 调用服务,再经由触摸完成每一步操作。整个移动互联网的商业模式、产品设计乃至广告体系,均围绕这套交互逻辑建立。
Agent(智能体)正在试图改变其中最基础的一层关系。当用户仅需表达意图,AI 便能自行决定调用何种软件、读取哪些信息、完成哪些操作时,App 界面的价值将下降,屏幕承担的任务也随之减少。
由 X 博主 Jesse Waites 制作的渲染图(已翻译为中文)
OpenAI 所称的 AI-first computer,大概正是基于这一判断。
未来的计算设备,可能不再以等待用户点击为核心,而是逐渐演变为一个能够听、看、记忆上下文,并主动协助用户完成任务的 Agent。
从这个视角审视,没有屏幕反而成为一种清晰的产品表达。
掏出手机、解锁、打开 ChatGPT、输入指令,这些动作本身仍属于智能手机时代的交互范式。OpenAI 旨在抹去这些启动步骤,让 AI 长期存在于环境之中。
你在厨房突生一念,可直接开口;睡前想起明日安排,也无需摸索手机;设备通过摄像头和麦克风获取环境信息后,甚至能省去大量背景描述。
相比之下,智能眼镜更接近全天候 AI,但其隐私问题更为敏感。
持续佩戴的摄像头会将周围所有人纳入感知范围。智能眼镜过去几年的尝试已证明,技术可行并不等同于社会可接受。
相对而言,放置于家庭空间的设备更容易被大众接纳。
OpenAI 选择从智能音箱形态切入,或许正是在测试全天候交互的同时,刻意避开穿戴设备所涉及的敏感隐私争议。
当然,过去几年的 AI 硬件领域已留下足够多的反面教材。Humane Ai Pin 最典型的问题在于,单纯拿掉屏幕并不会自然催生下一代计算平台。
当模型能力、响应速度、Agent 执行效率及产品可靠性无法匹配时,没有屏幕反而会放大所有交互缺陷。
OpenAI 与这些初创公司的区别在于,它已拥有模型和用户基础,此刻仅需寻找一个更适合这些能力存在的物理载体。这背后折射出的,正是 AI+ 与 AI-Native 之间的本质差异。
AI+ 的逻辑,是在既有设备和交互方式上「加一层智能」,本质仍是人主动开启工具、工具被动响应需求。
而 AI-Native 的思路则截然相反,它不是在现有系统上打补丁,而是重新定义「人与计算发生关系的方式」。在此框架下,模型即是交互本身;设备不再是入口,而是环境的一部分。
当这种范式确立时,硬件不再仅仅是承载软件的容器,而上升为决定交互形态的第一性约束。一旦技术平台发生变迁,最值得警惕的往往是交互入口开始转移。
回顾历史,每一次平台更替几乎都伴随入口迁移:PC 时代的入口是桌面和浏览器,移动互联网的入口是 App 图标和触控屏,而 AI 时代的入口,正从点击变为对话,从操作系统转向意图系统。
与之相伴的,是原有生态的分发逻辑、产品形态乃至商业模式将被彻底洗牌。破局的代价不可谓不大,但破局之后所能摘取的果实,同样最为丰厚。
科技史上许多真正重要的产品,最初往往源于一个看似多余的问题:电脑为何一定要放在桌上?电话为何一定要连着线?互联网为何一定要打开浏览器?手机为何一定要有一块屏幕?
多年后回望,推动技术前行的,常常正是那些当时看来无需追问的问题。对于已经足够好用的事物,总有人好奇是否还有另一种可能?因为即便没有 OpenAI,也一定会有其他人推开这扇未知的门。
某种意义上,人类文明也正是从这样的好奇心开始的。
几十万年前,当一个原始人第一次放下眼前事务,抬头凝视那些与进食、生存似乎毫无关联的星星时,他当然不知答案,也不知这一眼最终会将人类引向何方。但后来发生的一切,或许都始于那一次仰望。
*封面由 AI 生成
我们正在招募伙伴
📮 简历投递邮箱[email protected]
