谷歌近日宣布,旗下人工智能助手Gemini Spark正式拓展功能范围,现已支持对Google Photos照片库进行智能化管理。用户只需通过自然语言下达指令,即可让AI完成图片编辑、相册整理等复杂操作,进一步简化数字内容管理流程。
根据官方介绍,这项新功能包含四大核心应用场景:用户可要求AI自动筛选特定主题照片生成共享相册,例如根据时间、地点或人物关系进行分类;系统能识别演唱会门票、活动海报等图片中的文字信息,并自动将相关日期添加至日历应用;在图片处理方面,AI支持基础编辑功能,包括裁剪、滤镜调整等操作;对于高频使用场景,用户还可定制多步骤工作流,实现照片批量处理与信息同步的自动化。
技术实现层面,该功能深度整合了Google Photos的图像识别引擎与Gemini的语言理解能力。当用户发出指令时,AI会先解析文本意图,再调用照片库的元数据进行匹配操作。例如输入"整理上周迪士尼游玩照片并分享给家人",系统将自动完成时间筛选、人物识别、相册创建和权限设置等全流程操作。
目前该服务处于分阶段推广阶段,未来数周内将逐步向美国地区的Gemini AI Pro和Ultra订阅用户开放。初期版本仅支持英语指令,且需要用户手动完成Google Photos与Gemini账户的关联授权。激活方式为在Gemini应用界面顶部开启Spark功能入口,系统将通过推送通知引导用户完成设置。
行业观察人士指出,这项更新标志着消费级AI开始向垂直领域深度渗透。通过整合图像处理、自然语言理解和自动化工作流技术,谷歌正在构建跨应用的智能助手生态,这种发展路径可能对传统照片管理软件和日程管理工具形成替代效应。


