ITBear旗下自媒体矩阵:

中国人大校友葛松玮携团队加入OpenAI,助力可控图像生成研究新突破

   时间:2026-09-11 00:41:37 来源:互联网编辑:快讯 IP:北京 发表评论无障碍通道
 

OpenAI近日宣布推出新一代图像生成工具ChatGPT Images 2.5,该版本在画面清晰度、编辑精准度以及生成效率方面均实现显著提升。这一技术突破恰逢前Reve研究团队集体加盟OpenAI的节点,引发业界对多模态技术融合的广泛关注。

据公开信息显示,原Reve研究科学家葛松玮已正式加入OpenAI。这位毕业于中国人民大学、拥有卡内基梅隆大学硕士学位及马里兰大学帕克分校计算机科学博士学位的研究者,在可控图像生成领域深耕多年。其博士期间师从Jia-Bin Huang和David Jacobs,曾在BAIR实验室与Angjoo Kanazawa展开合作,并与朱俊彦、Ming-Yu Liu等知名学者共同发表多篇论文。

葛松玮在视觉生成方向的研究成果丰硕,涵盖视频扩散模型中的噪声先验设计、长视频生成框架构建、文本驱动的精细化图像生成,以及视频评估指标偏差分析等领域。其研究成果多次亮相ICCV、ECCV、CVPR等顶级学术会议,为技术演进提供了重要理论支撑。

此次人才流动并非孤立事件。Reve联合创始人Taesung Park在社交平台证实,公司已与OpenAI达成战略合作协议,整个研究团队将集体转入OpenAI体系。Reve公司主体将保持独立运营,专注于产品开发,而研究团队将深度参与OpenAI的多模态研究项目。

技术层面,Taesung Park特别指出当前大语言模型的发展趋势:以Astra为代表的新一代模型已展现出计算机视觉能力的"涌现"特征,这标志着视觉生成研究正面临关键转折点。随着前沿模型在图像理解、视觉推理等传统计算机视觉任务上的表现日益突出,语言与视觉的边界正在加速消融。

这种技术演进方向与Reve团队的核心研究方向高度契合。该团队长期致力于可控图像生成技术,强调让模型理解画面中的对象构成、空间布局及结构关系,从而实现更精准的生成与编辑控制。相较于单纯追求图像质量,这种技术路线更注重满足创作流程中的实际需求。

 
 
更多>同类资讯
全站最新
热门内容
网站首页  |  关于我们  |  联系方式  |  版权声明  |  争议稿件处理  |  English Version