对于iPhone用户而言,在手机上运行大型AI模型通常意味着需要稳定的网络连接,将数据发送到云端服务器进行处理。然而,谷歌最新发布的开源模型Gemma 4改变了这一现状,让iPhone用户首次可以在手机上离线运行谷歌的AI大模型。
实现这一功能的关键是一款名为“Google AI Edge Gallery”的应用程序。用户可以直接从App Store下载并安装这款应用。打开应用后,系统会提示用户下载Gemma 4模型,其中提供了E2B和E4B等不同规模的版本供选择。这些模型文件大小约为2至4GB,下载完成后便会永久存储在手机本地,整个运行过程完全依赖iPhone自身的GPU进行计算,无需任何网络连接。

这款应用被视为谷歌展示其端侧AI能力的试验平台。在离线状态下,用户可以与Gemma 4模型进行文本对话,实现日常问答、长文摘要、写作辅助等功能。除了基础的文本处理,Gemma 4的一大亮点是其原生的多模态能力。这意味着模型可以直接理解图像和音频,而不仅仅是处理文字。用户可以上传或拍摄照片,向AI提问关于图片内容的问题;也可以进行实时的离线语音转文字。

在实际体验中,本地模型的优势十分明显。首先是隐私保护,由于所有数据都在手机本地处理,不上传至云端,用户的个人信息、私密对话和敏感文件得到了充分的安全保障。其次是使用的便利性,无论是在飞机上、地下室还是其他无网络信号的环境中,AI功能都能随时待命。响应速度也相当流畅,日常对话几乎可以做到秒回。
不过,将大模型压缩至手机端运行也意味着一些妥协。与顶级的云端大模型(如GPT-4o或Gemini Pro)相比,Gemma 4在处理极其复杂的逻辑推理问题时能力有限,在一些逻辑测试中表现不佳。其图像识别能力虽然能准确识别大部分常见物体,但在动漫角色等细分领域的表现还有待提升。此外,部分高级功能,如调用外部工具的“Agent Skills”,可能仍需联网才能实现。
除了“AI Edge Gallery”这个综合性平台,谷歌还推出了一款名为“Google AI Edge Eloquent”的独立应用。这是一款主打离线使用的AI语音听写工具,同样基于Gemma模型。它能实时将语音转化为文字,并自动过滤“嗯、啊”等填充词,对文本进行润色和格式化,为需要记录会议或采访的用户提供了又一个兼顾隐私与效率的本地AI解决方案。
谷歌通过Gemma 4模型和相关应用,成功地将强大的AI能力带到了用户的iPhone上,并且实现了完全离线运行。虽然在性能上与云端模型尚有差距,但这无疑是端侧AI发展的一个重要里程碑,它预示着一个未来:手机本身将成为一个足够智能、足够安全且永远在线的个人AI助手。