我使用 ChatGPT、Claude 和 Gemini 等大型语言模型(LLM)已有大约一年的时间,从今年 2 月份左右开始,我感觉它们的功能每天都在进步。
另一方面,Apple Intelligence 推出日语版还不到一年,但实际提供的功能范围却存在很大差异。
当然,苹果公司对隐私的担忧并非不可能理解,但他们落后于时代也是事实。在本文中,我们将了解其他公司人工智能模型的最新功能,并考虑苹果的举措和挑战。

其他公司的AI现状:GPT-5.4、Claude Sonnet 4.6、Gemini 3 Pro已经走到了这一步
- GPT-5.4(3 月 5 日发布):将推理、编码和代理功能集成到一个模型中。第一个原生支持计算机操作的通用模型,在操作系统操作基准(OSWorld-Verified)上达到 75%,超过人类的 72.4%。
- 克劳德十四行诗 4.6(2月17日发布):全面强化编码、计算机操作、长句推理、智能体规划。 Beta 版提供 100 万个代币上下文窗口。 Opus 4.6 发布仅 12 天后发布
- 双子座 3 专业版(可预览):
谷歌将其定位为“全球最高水平的多模式理解”的最新旗舰产品。
代理功能大大加强,文字、图片、视频、音频、PDF均可组合。
可加工的多模态设计。稳定版Gemini 2.5 Pro / 2.5 Flash也并行上市。
与 Gmail 和 Google 日历的集成正在进行中
AI市场的主要参与者OpenAI、Claude和Google都开始提供实用的能力。这不是您从现在开始就能做的事情,而是您可以实际使用的功能。

您以前对人工智能的印象是什么?“咨询您的疑虑”之类的事情所以,我想,“它是否存在并不重要,哈哈,”但舞台显然已经开始发生变化。
提供的功能
还有苹果公司开发的Apple Intelligence,我也很喜欢。
此日语支持将于 2025 年 4 月开始(iOS 18.4)。目前提供的主要功能有“写作工具”,可让您重写、校对和总结文本、优先显示通知、Image Playground、Genmoji、Visual Intelligence 和 ChatGPT 集成。

这些被设计为日常辅助功能,目前还没有提供“自主处理实际任务”意义上的AI代理功能。与其他公司的AI相比,目前AI已经处于可以执行“发送电子邮件”或“整理文件”等指令的阶段,功能范围有很大差异。
我也是一位苹果用户,所以我尝试了一下使用它,但我无法得到任何令人满意的结果。

例如,在 Image Playground 中,你无法按照自己满意的方向创建图像,并且会感觉图像被设置为 Apple 认为的设计,并且感觉自己被控制了。
尽管不是那样,但出现的唯一图像就是那样。
我还停止使用该功能来删除照片中的对象,因为它只是以一种令人厌恶的方式扭曲了原始图像。至于源茂司,我觉得没有必要。
为什么苹果坚持本地加工
苹果一贯倡导“AI优先考虑隐私设计”的政策。
Apple Intelligence的核心是一个设备上的模型,大约有30亿个参数,处理是在设备内部完成的。更复杂的任务被发送到苹果自己的云基础设施,称为私有云计算(PCC),其中的数据仅用于处理请求,并且被设计为任何人都无法访问,包括苹果。
这种态度是有道理的。对于将数据发送到云人工智能的担忧可能在个人和公司中根深蒂固。 “仅适用于您自己的设备”的设计也是信任的基础。然而,我认为大多数人都觉得这种承诺限制了功能范围。
而且,具有讽刺意味的是,很明显,在本地运行人工智能会带来不同类型的风险。
本地人工智能代理的可能性和风险
人工智能代理接管现实世界任务的时代
AI代理的实际应用已经成为现实。
“Claude Cowork”由 Anthropic 于 2026 年 1 月发布,是一款面向非编码人员的桌面代理,可以自主执行文件管理、文档处理和多步骤任务。

例如,如果您允许访问指定文件夹,整理杂乱的下载文件夹,根据收据图像生成费用电子表格,并在您离开时根据多个笔记创建报告。据说。
我认为在默认设置下它不会 100% 工作而不出现任何问题,但即使 80-90% 的成功率也是惊人的。

“Claude Cowork”能做什么而受到评价?还有安全设计方面。
每当发生文件删除操作时都会请求显式许可的确认步骤。已设置,并且访问权限仅限于指定文件夹。该结构使您无法物理访问未授予访问权限的文件夹。 Anthropic本身就明确表示“代理安全仍然是整个行业的发展领域”,在风险透明披露方面也有一定的态度。
它同时兼容Mac和Windows,微软对其赞不绝口,以至于采用了这款Cowork引擎,为Microsoft 365打造了“Copilot Cowork”。“AI实际移动文件”的体验具有明显不同于聊天型AI的便利程度。

另一方面,OpenClaw显示的风险示例
即使使用相同的本地人工智能代理,风险程度也会因设计而异。 OpenClaw 中发生的案例可以作为比较。
当Meta安全研究员Summer Yu指示OpenClaw清理电子邮件时,代理删除了所有电子邮件。尽管多次发出“确认然后删除”的停止命令,据称该代理仍在继续处理,直到代理物理断开连接为止。 (安全记分卡研究报告)
ClawJacked:危害 40,000 个系统的漏洞
2026 年 2 月,一个名为“ClawJacked”的 OpenClaw 漏洞被发现,全球 40,000 个系统受到损害。据称,这导致 Meta 高管的邮箱被删除,谷歌限制了数千名开发者的平台访问。 (安全记分卡研究报告)
恶意插件潜入官方市场
在 OpenClaw 官方市场“ClawHub”上发布的约 10,700 个技能中,超过 820 个已被发现是恶意的。它的名字看似无害,比如“solana-wallet-tracker”,它是一种在 Windows 上安装键盘记录器和在 macOS 上安装 Atomic Stealer 恶意软件的方法。 (安全记分卡研究报告)
便利和风险来自同一个权威。
AI代理的便利性来源在于其“直接接触文件的权限”。
这些相同的权限也带来误操作、漏洞和恶意插件的风险。
风险的大小差异很大,具体取决于设计是否包含安全阀,例如删除前的确认以及像 Cowork 那样限制对文件夹的访问。在使用AI代理时,目前的基本措施似乎是限制对最少数量的文件夹的访问并备份重要数据。
用LM Studio尝试一下:本地LLM的现实

我也看到了本地 AI 的便利性,所以我也尝试使用 LM Studio,据说它在 MacBook Air 上运行良好。
型号为 Gemma 3n EB。
我尝试将其用于“具有挑战性的想法”,就像我以前使用聊天人工智能一样,但与其他通用法学硕士相比,其响应被简化且缺乏深度。我没有注意到任何其他观点,感觉就像我正在和一个不太熟悉的熟人交谈。然而,它会给 Mac 的处理性能和存储空间带来压力。
目前,我手头仅用于验证目的。
本地LLM的显着之处在于它不发布数据,但在响应质量方面,它与基于云的模型相比是天壤之别,或者说是无法比拟的。
苹果智能家居产品推迟发布的原因归结为Siri问题。
日前,彭博社报道称,HomePad、Apple TV、HomePod mini 等智能家居产品已推迟至 2026 年 9 月上市。
古尔曼表示,虽然硬件已经完成,但软件还没有准备好,因为 Siri 的个性化功能仍然不完整。
“我们不能发布硬件,因为AI不完整”的情况象征着苹果AI发展的现状。
自从Apple Intelligence宣布并首次推迟以来,我感觉我们永远无法赶上它,但我想知道它是否会以积极的方式达到我的期望。我认为前景变得更加渺茫。
Cowork 于 2026 年 1 月发布,现在实际上正在执行诸如“组织文件”、“根据收据创建费用表”和“编写报告”等实际任务。以至于微软在 M365 上采用了该引擎。
另一方面,截至 2026 年,Apple 提供的是重写句子和组织通知。
我可以理解优先考虑隐私的精心设计的背景,但确实存在很大差距。
然而,正如 OpenClaw 案例所示,人工智能无所不能的状态存在风险。
如果苹果优先考虑“可靠和安全的操作”,那么这是一个合乎逻辑的决定。
此外,还有人指出,苹果的优势在于其庞大的iPhone用户群。这个想法是,设备上的人工智能将会成功,因为安装基数巨大。
然而,使其专门针对Apple Intelligence需要增加内存容量、增加SDD容量以及开发和制造新的高性能芯片。如果发生这种情况,毫无疑问 iPhone 和 Mac 产品的价格将会上涨,而且它们仍在朝着这个方向发展。
就我个人而言,我希望Apple将Mac和iPhone设计为可以充分利用其他公司制作的大规模语言模型(LLM)的工具。我目前的印象是事情似乎并没有朝着我想要的方向发展。
这是我一段时间以来第一次写一篇一次性的文章。谢谢克劳德君的研究和校对工作。顺便说一句,文字本身是我写的。
