OpenAI 正式发布 ChatGPT Images 2.5,新一代图像生成模型在细节呈现、参考图还原和编辑稳定性方面实现显著升级。官方介绍显示,该版本能输出更锐利的图像细节,在融合用户提供的草图或参考照片时拥有更强的保持能力...
Read MoreGrok 正式发布 Imagine Video 1.5 智能体,标志着其在视频生成领域再次推进。该版本由 Grok 最新的 Image 2.0 模型提供支持,在画面质量与叙事表达上相较此前版本均有提升,尤其强化了多镜头之间的连接能力,使镜头...
Read MoreLMSYS.org发布的最新基准测试显示,在8×NVIDIA H200 GPU环境中,SGLang Diffusion对MiniMax-H3视频生成工作负载实现了显著加速。测试严格固定提示词、随机种子、分辨率、帧率和去噪步数,并在六类工作负载上进行比较...
Read Morefal Research 宣布推出 H3 Max,这是 MiniMax H3 的后训练版本,由 fal 推理团队专门针对生成速度进行优化。官方表示,该模型可在不到 3 秒内生成一段 5 秒长的视频,显著降低视频生成等待时间。在人类偏好评估中,H...
Read MoreMeta推出的Muse Image图像生成模型,其核心特点在于能够基于搜索结果进行图像生成,并在最终渲染前执行推理过程。这意味着模型不再仅依赖训练数据中的视觉模式,而是可以结合外部信息来约束生成结果,有望提升图像的...
Read MoreMeta 旗下的 Muse Video 视频生成模型已进入封闭测试阶段。根据曝光的早期生成样片,该模型在 10 秒级视频中展现出较高的细节还原能力、对场景的理解能力以及时间一致性,并且原生支持音频生成。这意味着 Muse Video...
Read MoreAI视频生成初创公司Higgsfield宣布完成4亿美元新一轮融资,投资方包括DST、高盛、Liberty Global、英特尔等机构,投后估值达到54亿美元。该轮融资前,公司估值在1月为13亿美元,短短数月内增长超过三倍,显示市场对A...
Read More微软宣布其最新文本到图像模型MAI-Image-2.6在Arena文本到图像排行榜上首次亮相即升至第二位,排名超过Google、Meta和xAI等竞争对手。Arena排行榜基于用户盲测与偏好投票,是评估生成模型综合表现的重要公开基准之一...
Read More