大家好,我是程序员晚枫。
今晚苹果发布会刚开完,iPhone 18 Pro、Pro Max 和首款折叠屏亮相。热搜都在聊芯片、摄像头、新配色。
但我盯着的是一个更实用的参数:全系 12GB 内存。
这个数字什么概念?它是端侧大模型的分水岭——意味着你可以在 iPhone 里完整装下一个 AI 大模型,断网也能用,一分钱不花。
今天这篇文章,就手把手带你把免费大模型装进 iPhone。不用新买的 18 也行,你的旧手机大概率也能跑。
为什么 12GB 内存是个分水岭?
先说人话:内存就是 AI 的工位面积。
大模型跑在手机上,模型本身要占内存,对话内容(上下文)也要占内存。工位太小,要么模型塞不进去,要么干着干着就被系统赶出去。
手机内存和能跑的模型,对应关系大概是这样:
|
|
|
|
|---|---|---|
|
|
|
|
|
|
|
|
| 12GB(今晚的 iPhone 18 系列) | 4B 模型无压力,7B 也能塞 | 甜点配置 |
今晚的 iPhone 18 Pro 用的是 2 纳米 A20 Pro 芯片,功耗比上一代低 25-30%。跑大模型是持续满负荷运算,最怕发热降频——新芯片等于给 AI 配了个不发烧的大脑。
所以结论很直接:iPhone 18 是目前最适合跑端侧大模型的 iPhone,没有之一。
5 分钟装好:一个免费 App + 一个免费模型
不需要越狱,不需要任何折腾,全程 App Store 搞定。
第一步:装 App
打开 App Store,搜 PocketPal AI,免费下载。它是开源软件,模型下载完之后所有对话都发生在你手机里,不联网、不注册、不要钱。
第二步:挑模型
打开 App,点 Models 标签,里面直接列出了为手机优化过的模型清单。选一个点 Download 就行。
怎么挑?我直接给结论:
|
|
|
|
|---|---|---|
| Qwen3 1.7B(通义千问) |
|
中文用户首选
|
|
|
|
|
|
|
|
|
|
|
|
|
第三步:开聊
下载完点进 Chat,等 5 秒钟模型加载进内存,直接打字。就这,装完了。
参考速度:上一代 iPhone 16 Pro 跑 Qwen3 1.7B,每秒能输出 18-24 个字;今晚的 18 Pro 按芯片升级幅度估算,还会再快 20-30%。日常对话完全跟手,比很多人打字速度快。
什么时候你会感谢它?
端侧模型不是拿来跟云端旗舰比聪明的,它赢在三个字:靠得住。
-
地铁里:信号时断时续,云端 AI 转圈,你的本地模型秒回 -
飞机上:全程断网,照样写文案、改邮件、翻译文档 -
说私密的话:日记、草稿、没想好要不要发的消息,一个字节都不出你的手机 -
不花一分钱:没有次数限制、没有会员费、没有"今日额度已用完"
有个读者之前问我:公司内网隔离,啥云端 AI 都用不了,怎么办?这类朋友今晚可以下单 iPhone 18,然后按这篇文章装个模型——你的手机,就是你的 AI。
我自己把主力机装上 Qwen3 1.7B 之后,最常干的三件事:
-
地铁上回工作消息:让它先把语气改得体面一点,再发出去,避免"收到"两个字暴露情绪 -
开会时快速总结:语音转成文字丢给它,让它提炼要点,比我自己边听边记靠谱 -
给娃讲作业:十万个为什么连环轰炸,扔给本地模型,它比我有耐心,还不费我的流量
还有一个意外的好处:没有次数焦虑。云端 AI 每次提问都在心里默数"这个月额度还剩多少",本地模型随便问,问一千条也不心疼。用 AI 的心态,会从"省着用"变成"放开了用"——这两种状态下,你用它干的事完全不一样。
丑话说在前面:小模型的能力有天花板。日常问答、写作辅助、翻译总结,它绰绰有余;让它做特别烧脑的深度推理,它会用实力告诉你什么叫知足常乐。
苹果自己也在往这个方向走
今晚发布会还有个细节值得注意:苹果反复强调 iPhone 会优先用端侧模型处理 AI,需要时才连云端。
为什么?隐私。数据在手机里处理,就不用出门。
你可能会说:那我用系统自带的 Apple Intelligence 不就行了?
自带的确实够用,但它藏在系统里,只能在邮件、备忘录这些固定场景帮你,你没法直接跟它聊天,也没法换模型。PocketPal 这类 App 的价值就在这:想用什么模型自己挑,今天 Qwen,明天 Llama,全免费。
苹果修好了路(12GB 内存 + 不降频的芯片),第三方 App 把车开进来了。
说到底,云端 AI 是租的,端侧 AI 是你的。租的聪明,你的踏实。
今晚看完发布会,别光顾着纠结新配色——花 5 分钟给手机装个大模型,这才是新手机最快的正确用法。旧手机也别闲着,先查查内存,大概率也能跑。
你的 iPhone 是哪一款、多大内存?评论区报个到,我告诉你能跑哪个模型。
科技不高冷,AI很好用。我是晚枫,关注我,带你一起玩AI!
参考链接
-
PocketPal AI 开源项目(GitHub):https://github.com/a-ghorbani/pocketpal-ai -
苹果 iPhone 18 发布会(Apple Newsroom):https://www.apple.com.cn/newsroom/ -
手机本地运行大模型完全指南(含机型与模型对照表):https://llmconfigurator.com/zh/guides/running-llm-on-phone -
2026 年 iPhone 本地大模型应用评测:https://www.promptquorum.com/zh/power-local-llm/best-local-llm-apps-iphone-2026

