从实时翻译和AI增强视觉效果到更深的捷径集成和开发人员模型访问,升级将技术复杂性与隐私优先设计融为一体。
该更新今天揭幕,带来了新的生成功能,包括消息和电话中的实时翻译,更智能的图像游乐场以及能够理解屏幕上内容的视觉智能。开发人员现在可以直接访问Apple的“设备基础”模型,从而在没有API成本的情况下提供对隐私友好的离线功能。该推出继续推动苹果将智能整合到日常用例中,而不会损害用户控制。
实时翻译访问消息,面部和电话

最面向用户的增强功能之一是实时翻译。它将实时多语言通信带到消息,FaceTime和电话,并提供实时字幕,口语翻译和输入消息转换。至关重要的是,所有翻译都发生在设备上,与Apple通过设计对隐私的重视保持一致。
在FaceTime上,用户可以通过翻译字幕跟随,同时仍在听扬声器。在电话上,口语翻译实时大声播放,而消息在聊天过程中在两个方向上自动翻译。这可能会大大改善国际旅行,远程协作和包容性的沟通,尤其是随着年底的支持扩展到更多语言。
图片游乐场和Genmoji获得创意提升

苹果的生成图像工具还可以看到升级。 Genmoji创建现在可以表情符号混合和属性控制 - 例如调整发型或面部表达。同时,图像游乐场引入“任何样式”,让用户只有在明确的用户许可之后才能通过chatgpt描述自定义图像样式并通过chatgpt生成图形。除非有意访问ChatGpt,否则Apple通过保持大多数流程进行控制来维护控制。
视觉智能进入了整个屏幕
Apple Intelligence以现有的视觉智能功能为基础,可以理解用户屏幕上跨应用程序的内容。这意味着识别对象,分析事件数据的日历条目,或在诸如Google或Etsy之类的平台上启用直接产品查找。屏幕截图按钮的简单按下激活该功能,为用户提供选择以保存,共享或探索。
健身符合Apple Watch的情报
新的锻炼伙伴功能通过分析实时指标(Heart Rate,PACE,活动环)并通过合成教练的声音来提供反馈,从而为锻炼带来了生成的见解。它由Apple Intelligence和新的文本到语音模型提供支持,提供了一个个性化体验,可以适应用户的性能和目标,这些体验均经过本地处理。
开发人员现在可以点击Apple的驻留AI
也许最大的转变是在引擎盖之下:开发人员现在可以通过基础模型框架访问Apple的“设备基础”模型。在支持Swift的支持下,应用程序可以使用只有三行代码来集成诸如摘要,搜索或生成之类的智能功能,而不依赖云API或外部推理引擎。
即使用户离线,这种隐私向前的方法也可以具有智能功能。它降低了开发人员的进入障碍,同时维护苹果的严格隐私标准,提供指导的一代,工具呼叫等。
捷径变得真正聪明
快捷方式现在直接利用Apple Intelligence,使用户可以通过AI生成的输入自动化任务。例如,用户可以构建快捷方式,将讲义注释与类记录转录进行比较,并自动附加丢失的信息。通过设备处理和可选的CHATGPT集成,系统可以平衡智能和控制。
应用程序之间的其他增强功能
苹果情报现在可以启用:
- 邮件和消息中的智能建议
- 邮件中的上下文感知民意调查
- 订单跟踪钱包中的摘要
- 通过自然编辑的编写工具来描述您的变化
- 智能回复和摘要在电子邮件中和通话记录
- 视觉效果的上下文搜索和日历创建
- 私人云计算的透明方法,具有可验证的代码和无数据存储
此更新标志着一个关键时刻:Apple正在为开发人员和用户提供深度的AI功能,而无需限制隐私。通过将生成功能与离线操作,本机集成和用户优先控制相结合,Apple将自己定位于传统的AI播放器。
今天的功能将在Beta中为开发人员上线,并计划于今年秋天的iPhone 16型号,iPhone 15 Pro/Pro Max和M1+ iPad和Mac进行公开推出。




