ITBEAR科技资讯
网站首页 科技资讯 财经资讯 分享好友

中国人大校友葛松玮携团队加入OpenAI,助力可控图像生成研究新突破

时间:2026-09-11 00:41:37来源:互联网编辑:快讯

OpenAI近日宣布推出新一代图像生成工具ChatGPT Images 2.5,该版本在画面清晰度、编辑精准度以及生成效率方面均实现显著提升。这一技术突破恰逢前Reve研究团队集体加盟OpenAI的节点,引发业界对多模态技术融合的广泛关注。

据公开信息显示,原Reve研究科学家葛松玮已正式加入OpenAI。这位毕业于中国人民大学、拥有卡内基梅隆大学硕士学位及马里兰大学帕克分校计算机科学博士学位的研究者,在可控图像生成领域深耕多年。其博士期间师从Jia-Bin Huang和David Jacobs,曾在BAIR实验室与Angjoo Kanazawa展开合作,并与朱俊彦、Ming-Yu Liu等知名学者共同发表多篇论文。

葛松玮在视觉生成方向的研究成果丰硕,涵盖视频扩散模型中的噪声先验设计、长视频生成框架构建、文本驱动的精细化图像生成,以及视频评估指标偏差分析等领域。其研究成果多次亮相ICCV、ECCV、CVPR等顶级学术会议,为技术演进提供了重要理论支撑。

此次人才流动并非孤立事件。Reve联合创始人Taesung Park在社交平台证实,公司已与OpenAI达成战略合作协议,整个研究团队将集体转入OpenAI体系。Reve公司主体将保持独立运营,专注于产品开发,而研究团队将深度参与OpenAI的多模态研究项目。

技术层面,Taesung Park特别指出当前大语言模型的发展趋势:以Astra为代表的新一代模型已展现出计算机视觉能力的"涌现"特征,这标志着视觉生成研究正面临关键转折点。随着前沿模型在图像理解、视觉推理等传统计算机视觉任务上的表现日益突出,语言与视觉的边界正在加速消融。

这种技术演进方向与Reve团队的核心研究方向高度契合。该团队长期致力于可控图像生成技术,强调让模型理解画面中的对象构成、空间布局及结构关系,从而实现更精准的生成与编辑控制。相较于单纯追求图像质量,这种技术路线更注重满足创作流程中的实际需求。

更多热门内容
智能体时代来临:1000万奖金寻爆款,8小时外生活场景成新蓝海
支付宝事业群总裁李俊表示,过去20年的互联网交互逻辑,是由产品经理预设操作路径,用户需要主动适应机器,在不同应用之间跳转完成任务。以支付宝联合星巴克率先推出的“咖啡闹钟”为例,用户只需说一次“每天10点帮我…

2026-09-11

2026外滩大会聚焦AI新经济 科技展亮点纷呈引参观者驻足体验
9月10日,参观者在外滩大会创新物种展区内参观。 9月10日,参观者在体验一款通过握手进行血氧心率检测的机器人。9月10日,参观者在一款具备眼神跟踪功能的仿生机器人前驻足观看。 9月10日,工作人员在演示…

2026-09-11

知行具身Imprint X:以千赫兹级视触觉,开启机器人精密操作新纪元
从底层感知方式到材料、结构与算法,Imprint X 均围绕机器人精密操作场景设计,让响应快、低延迟、低功耗的高性能视触觉真正进入机器人指尖。 它的输出本质上是“变化的信息”,这给触觉解读带来了一个严重的逻辑…

2026-09-11

石景山区具身智能训练中心升级亮相,打造国内具身智能产业创新高地
2026年服贸会期间,作为北京首个人形机器人数据训练中心,石景山区人形机器人数据训练中心一期完成迭代升级,以石景山区具身智能训练中心的全新身份亮相。接下来,全区将推动一、二、三期能力贯通协同联动,整体打造集…

2026-09-11

大晓机器人携手南洋理工S-Lab发布Puffin-World,开启三维空间智能新范式
作为面向空间智能与具身智能的成果,Puffin-World首次在一个统一多模态框架中,将物理、几何和外观定义为三种原生的三维世界状态,并贯通重力场感知、自由视点空间仿真、三维世界生成与重建以及闭环探索,预测机…

2026-09-11

韶音IFA2026展实力,联合发布报告洞察趋势,引领开放式耳机新未来
早在2023年,韶音便发布OpenFit舒适圈,将“舒适科技”确立为核心技术方向之一,回应消费者对全天候佩戴舒适性的需求升级。 立足IFA2026全球科技舞台,韶音不仅展出了全系列开放式耳机产品,更通过与尼尔…

2026-09-11