作为新一代的视觉搜索助手,ChatGPT 本周在 iOS 生态圈再次优化使用流程,让用户在对话中加入最近照片变得更快捷。以前用户要先点击 + 按钮,选择“照片”再从相册挑选,虽然这个流程并不复杂,但在需要快速上传多张照片或链接多个视觉查询时,仍然会打断自然的对话节奏。OpenAI 在社群中由 Adam Fry 提示,现在只需长按对话框左侧的 + 按钮,即可呼出系统最近四张照片的快捷面板,选择其中一张即可将照片附上对话,然后直接提出问题或把它纳入提示之中。这个新手势的推出,与本周其他增强一起出现,例如更准确地抓取现在时间、提升长篇对话在网页端的载入与响应速度,以及在网络连接等待时提供更清晰的使用界面更新。这波变化显示 OpenAI 正在以更直观的互动设计,降低日常视觉查询的门槛,让用户能在不打断对话流程的情况下完成快速的“视觉检索”。
在背景层面,Visual Intelligence 功能在 iOS 系统已经运作将近两年,但目前仅支持相对较新款的 iPhone,并且在全球区域覆盖上仍存有局限。对于依赖 ChatGPT 执行类似视觉搜索的用户,新的手势提供了一个更即时的替代方案:不必切换界面或手动选择,直接在会话框中把最近的照片快速送出,让查询能更贴近现场情境。这样的改动显示 OpenAI 对于“视觉上下文”的重视,并且延伸出更平滑的跨设备互动体验。相较于过往的流程,这种做法在忙碌的工作日常中可能提高工作效率,尤其是需要快速把实物外观与文字描述对照的任务。
新手势让 ChatGPT 的视觉查询更直观,并带动跨设备协同的节奏
此外,这次更新不仅聚焦于快速上传,还让用户在同一张画面内完成从“选择照片”到“提出视觉相关问题”的整套流程。实际运作时,用户长按 + 按钮,系统会显示最近四张照片,然后点选任一张以附件形式加入对话,接着就可以在对话框中直接加入指令、描述细节或提出针对照片内容的具体问题。这种设计的核心在于降低认知负荷,让用户不必在多个界面之间切换,便能快速建立以照片为核心的查询场景。此外,若照片来自多个时间点,快速选择最近的几张也有助于高效地比较与推理,对于日常的购物、修图、旅游规划等情境尤为适用。这显示 OpenAI 仍然以用户场景为导向,通过更贴近直觉的操作来推动图像搜索的普及。
当前的更新也把注意力放在性能与稳定性上,除了提升前端界面的即时响应,长篇对话在网页端的处理速度也获得改善。对于需要在对话中持续引述或比对多张视觉内容的情况,这类优化能显著减少等待时间,让整体体验更加流畅。更清晰的连接等待指示,意味着用户在网络不稳定时也能更快理解当前状态,避免因为显示延迟而产生混乱。这些变化共同指向一个方向:ChatGPT 在数字视觉查询方面,正以更稳健、直观的设计,提升日常工作与娱乐场景的实用性。
在区域与设备覆盖方面,虽然 Visual Intelligence 的普及速度受限于设备与地区,但 OpenAI 持续投入优化相关支持与使用体验。对于用户而言,若可以在未来的更新中实现更广泛的设备支持与更快速的跨设备同步,视觉查询的实用性和可及性将显著提高。OpenAI 的这一系列改进,也可能促使开发者社区在第三方应用中加入更自然的视觉对话参考,进一步扩展“看见即理解”的工作与娱乐场景。

