OpenAI 发布 ChatGPT Images 2.5:更快生成、更精准编辑
量子位报道,Noiz AI 联合多所高校与研究机构成员发布实时可交互音视频世界模型 HelixWorld 1.0。用户可通过一张图和文本提示启动场景,移动或转向时,系统同步生成 24 FPS 画面与 48 kHz 双声道音频。声画由统一 Transformer 原生生成,而非先出视频再补音轨。其价值不只是增加声音,而是让方位、距离、材质与用户动作共同影响视觉和听觉反馈。团队表示模型权重与代码将在后续数周开放。现阶段应区分“即将开源”与“已经可复现”,避免把预告当成实际可用能力。











