新聞 > 科教 > 正文

OpenAI 首款AI硬體,是個沒有屏幕的「甜甜圈」

OpenAI的第一款 AI硬體,大概是近兩年最神秘的薛丁格產品。我們至今不知道它究竟長什麼樣,但幾乎每隔幾個月,都能收到一個新答案。

最早有人說是智能筆,再後來,檯燈、眼鏡、可穿戴設備輪番登場。傳聞多到後來,連我們這些圍觀群眾都有點狼來了的 PTSD。

根據彭博社今天的最新報導,OpenAI與 Jony Ive團隊正在推進的第一款消費級設備,目前更接近一台沒有屏幕的智能音箱,其外形接近一個冰球大小的圓環。

更直白一點,看起來像一塊金屬甜甜圈。

如果只看產品形態,這款售價可能達到300至400美元的產品,很容易被理解成一台更貴、更精緻的智能音箱。但 OpenAI的定位更激進,希望把它做成一種 AI-first computer,也就是以 AI為第一交互入口的計算設備。

冰球大小的圓盤,只是目前露出水面的第一種形態。而 OpenAI真正想驗證的是:當 AI足以承擔主要交互時,我們還需要每天盯著一塊屏幕嗎?

一塊會動的金屬「甜甜圈」

目前曝光的信息已經相當具體。

設備整體呈圓環狀,大小接近冰球,可以單手拿起,在家中不同空間移動。它沒有顯示屏,但會配備揚聲器、麥克風、燈光、攝影頭以及其他環境傳感器,並由電池供電,預計在明年發布。

用戶既可以把它放在床頭櫃,也可以帶到廚房、客廳,甚至直接拿在手裡使用。

@PatentlyApple製作的渲染圖

值得注意的是,這一形態也與美國知名設計師 Joe Gebbia此前被拍到的疑似泄露設備高度吻合。

更有意思的是,它並非一塊完全靜止的金屬。

報導稱,設備內部還會設計能夠自行活動的機械結構。當用戶和 AI對話時,部分組件會產生移動,同時配合燈光變化,讓人知道它正在傾聽、回應或者執行任務。

智能音箱長期以來存在一個問題。Alexa、Google Assistant和 Siri即便能夠持續對話,用戶面對的仍然是一件靜止的電子產品。你喊它一句,它亮一下;問它一個問題,它回答之後便重新沉默。

OpenAI希望通過動作、燈光和更自然的語音交互,讓設備具有更強的存在感,甚至讓用戶感覺它像一個真正參與環境的對象。

而攝影頭和傳感器也意味著,它獲取的信息不會局限在聲音。傳統智能音箱只能知道你說了什麼,而 OpenAI希望它進一步理解你身邊正在發生什麼。

由 Trung Phan製作的渲染圖

例如,你可能不再需要告訴 AI桌子上有一瓶藥,而可以直接詢問這瓶藥什麼時候吃;也不需要詳細描述廚房裡的情況,而是直接問鍋里的東西是不是該關火了。

視覺、語音、長期記憶和環境感知如果真正結合起來,AI獲得的就不再只是一次對話,而是一段持續存在的上下文。

這也是 OpenAI過去幾年一直在推動的方向。

未來真正有價值的 AI,很可能不僅要回答問題,還要長期知道用戶正在做什麼、過去做過什麼,並據此持續提供幫助。

離開蘋果,Jony Ive正在尋找 iPhone之後

另一個讓整件事更有戲劇性的地方,是 Jony Ive。

OpenAI第一款硬體的設計合作方正是他的 LoveFrom工作室。

作為曾經主導 iPhone、iPod、iPad和 Apple Watch設計的人,Jony Ive幾乎參與定義了過去二十年消費電子最重要的一套產品語言。

如今,他正在和 OpenAI一起尋找另一種可能。

去年,OpenAI收購了 Ive共同創辦的硬體公司 io,雙方由合作正式轉向深度綁定。OpenAI也已經公開表達過長期建立完整設備業務的計劃,終極目標甚至包括創造一種有能力替代智慧型手機的產品。

與此同時,蘋果和 OpenAI之間的關係卻迅速惡化。

最近,蘋果已經就商業機密問題起訴 OpenAI及相關人員,指控對方獲取並使用了涉及產品設計、製造工藝和供應鏈的信息。其中一個爭議點,是 OpenAI是否曾要求蘋果長期合作的供應商,為其開發類似蘋果使用的金屬表面處理技術。

OpenAI否認相關指控,認為蘋果的說法過於寬泛,並隨後在要求法院駁回訴訟的文件中強調,自己正在打造一種與蘋果現有產品完全不同的新東西。

至少從目前曝光的產品形態來看,這款圓環設備確實很難直接對應蘋果現有的某個產品。兩家公司的路線已經出現非常明顯的差異。

包括蘋果正在開發的新一代家庭設備,據報導則更接近一塊連接機械結構的顯示屏,可以轉向說話的人,並承擔 FaceTime等視覺任務。

蘋果依然試圖讓顯示屏進入更多場景,OpenAI則試圖驗證一個更激進的問題:如果 AI足夠強,未來的人機互動是否還需要屏幕始終存在?

某種意義上,這也是 Jony Ive職業生涯中一個很有意思的轉折。

Jony Ive近二十年前參與設計了一塊幾乎吞噬整個消費電子行業的觸控式螢幕;二十年後,他正在參與設計一件試圖去掉屏幕的計算設備。

為什麼 OpenAI第一台硬體,偏偏沒有屏幕

智慧型手機過去十幾年的核心價值,很大程度上建立在屏幕和 App之上。

用戶通過屏幕尋找信息,通過 App調用服務,再通過觸摸完成每一個操作步驟。整個移動網際網路的商業模式、產品設計乃至廣告體系,都圍繞這套交互方式建立。

Agent正在試圖改變其中最基礎的一層關係。當用戶只需要表達意圖,AI就能夠自行決定調用什麼軟體、讀取什麼信息、完成哪些操作時,App的界面價值會下降,屏幕承擔的任務也會隨之減少。

由 X博主 Jesse Waites製作的渲染圖(已翻譯為中文)

OpenAI所謂的 AI-first computer,大概就是建立在這個判斷之上。

未來的計算設備,可能不再以等待用戶點擊為核心,而會逐漸變成一個能夠聽、能夠看、能夠記住上下文,並主動幫助用戶完成任務的 Agent。

從這個角度看,沒有屏幕反而成為一種非常明確的產品表達。

掏出手機、解鎖、打開 ChatGPT、輸入指令,本身仍然屬於智慧型手機時代的交互方式。OpenAI想做的是把這些啟動步驟進一步抹掉,讓 AI長期存在於環境之中。

你在廚房想到一件事,可以直接開口;睡前突然想起明天的安排,也不需要摸手機;設備通過攝影頭和麥克風獲得環境信息之後,甚至可以省掉大量背景描述。

相比之下,智能眼鏡更接近全天候 AI,但隱私問題也更敏感。

持續佩戴的攝影頭會讓周圍所有人都被納入感知範圍。智能眼鏡過去幾年的嘗試已經證明,技術可行並不等於社會可接受。

相比之下,放在家庭空間的設備更容易被接受。

OpenAI從智能音箱形態切入,可能正是為了在測試全天候交互的同時,避開穿戴設備最敏感的隱私爭議。

當然,過去幾年的 AI硬體已經留下了足夠多的反面教材。Humane Ai Pin最典型的問題就是,拿掉屏幕本身並不會創造下一代計算平台。

當模型能力、響應速度、Agent執行能力和產品可靠性無法匹配時,沒有屏幕甚至會放大所有交互問題。

OpenAI與這些創業公司的差別,在於它已經擁有模型和用戶,現在需要尋找一個更適合這些能力存在的物理載體,這背後反映的也正是 AI+和 AI-Native之間的區別。

AI+的邏輯,是在既有設備和既有交互方式上「加一層智能」,本質仍然是人主動打開工具、工具被動響應需求。

而 AI-Native的思路則完全相反,它不是在現有系統上打補丁,而是重新定義「人如何與計算發生關係」。在這個框架里,模型就是交互本身;設備也不再是入口,而是環境的一部分。

當這種範式成立時,硬體不再只是承載軟體的容器,而會上升為決定交互形態的第一性約束。一旦技術平台發生變化,最值得警惕的往往是交互入口開始發生轉移。

歷史上每一次平台更替,幾乎都伴隨著入口的遷移:PC時代的入口是桌面和瀏覽器,移動網際網路的入口是 App圖標和觸控屏,而 AI時代的入口,正在從點擊變成對話,從作業系統變成意圖系統。

與之相伴的則是,原有生態的分發邏輯、產品形態乃至商業模式都會被重新洗牌。破局的代價不可謂不大,但破局之後能夠摘取的果實,同樣也是最豐厚的。

科技史上很多真正重要的產品,最初都源於一個看起來有些多餘的問題:電腦為什麼一定要放在桌上?電話為什麼一定要連著一根線?網際網路為什麼一定要打開瀏覽器?手機為什麼一定要有一塊屏幕?

多年以後回頭看,推動技術繼續向前的,常常正是這些當時沒有必要追問的問題。已經足夠好用的東西,總有人好奇還有沒有另一種可能?因為即便沒有 OpenAI,也一定會有其他人去推開這扇未知的門。

某種意義上,人類文明也是從這樣的好奇開始的。

責任編輯: 李華  來源:AppSo 轉載請註明作者、出處並保持完整。

本文網址:https://tw.aboluowang.com/2026/0808/2418482.html