如今,在與科技互動時,生成式AI已無所不在,但蘋果在這方面的進展相對較慢。這並非完全是出於選擇。自2024年首次承諾推出強化AI的Siri以來,這家iPhone製造商已多次延遲。然而,與Google達成的一項協議將在今年稍晚把這款標誌性助理與Gemini整合。隨著全球開發者大會(WWDC)的臨近,蘋果一直在努力將強大的AI智慧帶入智慧型手機有限的處理環境中。不過,蘋果的粉絲可能不會喜歡這個結果。

蘋果長期以來一直宣揚在裝置端執行AI的隱私價值,但一份新報告指出,儘管蘋果竭盡全力,iPhone的Gemini改造仍將大量依賴Google和Nvidia的雲端服務。《The Information》報導,蘋果整合Gemini的Siri將同時在裝置端和雲端運行,這顯然逆轉了其偏好裝置端AI的隱私導向策略。

每次發布新晶片時,我們都會聽到晶片如何針對AI進行優化,即使是蘋果也透過專注於Neural Engine升級來強調這一點。你可能會從這些宏大的說詞中認為智慧型手機已具備處理龐大AI模型的能力,但情況不一定如此。事實上,大多數手機中的GPU可以處理比專為AI設計的NPU更多的AI代幣。

像蘋果Neural Engine這樣的組件,是為情境式、高效能的AI處理而設計的。即使手機擁有更快的AI處理能力,它們也缺乏足夠的記憶體(RAM)來儲存龐大模型。

即使是最大的AI模型,也仍是平庸的助理,這使得裝置端AI極具挑戰性。在手機上運行的AI模型實體上更小,最多只有數十億個參數。《The Information》報導,相比之下,Google最新的Gemini模型擁有數兆個參數。裝置端AI模型也會被「量化」以較低精確度運行,這使其速度更快,但會影響代幣生成的準確性。這一切都導致AI感覺不如雲端版本聰明,而即使是大型雲端模型有時也相當笨拙。

Google擁有針對行動裝置優化的Gemini版本,稱之為Gemini Nano。然而,這些版本是為Magic Cue和音訊摘要等情境式功能提供支援而設計的。另一方面,Siri應該是一個對話式助理,你與它對話,它會執行任務。這是一種不同的體驗,需要不同類型的模型。在Android上,Google甚至不費心嘗試在裝置端執行這種功能。與Gemini對話總是直接連線到雲端。