漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-09-09 talkingdev

OpenAI发布ChatGPT Images 2.5:细节更锐利、编辑更可靠,延迟最高降低50%

OpenAI 正式发布 ChatGPT Images 2.5,新一代图像生成模型在细节呈现、参考图还原和编辑稳定性方面实现显著升级。官方介绍显示,该版本能输出更锐利的图像细节,在融合用户提供的草图或参考照片时拥有更强的保持能力...

Read More
2026-09-07 talkingdev

Grok Imagine Video 1.5 智能体上线:Image 2.0 驱动,多镜头叙事连贯性升级

Grok 正式发布 Imagine Video 1.5 智能体,标志着其在视频生成领域再次推进。该版本由 Grok 最新的 Image 2.0 模型提供支持,在画面质量与叙事表达上相较此前版本均有提升,尤其强化了多镜头之间的连接能力,使镜头...

Read More
2026-08-28 talkingdev

SGLang Diffusion加持:MiniMax-H3视频生成在8×H200上无损提速1.95倍,最高6.24倍

LMSYS.org发布的最新基准测试显示,在8×NVIDIA H200 GPU环境中,SGLang Diffusion对MiniMax-H3视频生成工作负载实现了显著加速。测试严格固定提示词、随机种子、分辨率、帧率和去噪步数,并在六类工作负载上进行比较...

Read More
2026-08-28 talkingdev

fal 推出 H3 Max:MiniMax H3 后训练版最快 3 秒生成 5 秒视频,综合质量登顶

fal Research 宣布推出 H3 Max,这是 MiniMax H3 的后训练版本,由 fal 推理团队专门针对生成速度进行优化。官方表示,该模型可在不到 3 秒内生成一段 5 秒长的视频,显著降低视频生成等待时间。在人类偏好评估中,H...

Read More
2026-08-27 talkingdev

Meta推出Muse Image图像生成模型:先推理后渲染,单图成本仅0.01美元

Meta推出的Muse Image图像生成模型,其核心特点在于能够基于搜索结果进行图像生成,并在最终渲染前执行推理过程。这意味着模型不再仅依赖训练数据中的视觉模式,而是可以结合外部信息来约束生成结果,有望提升图像的...

Read More
2026-08-20 talkingdev

Meta Muse Video 视频模型独家样片曝光:原生音频与10秒级时间一致性表现抢眼

Meta 旗下的 Muse Video 视频生成模型已进入封闭测试阶段。根据曝光的早期生成样片,该模型在 10 秒级视频中展现出较高的细节还原能力、对场景的理解能力以及时间一致性,并且原生支持音频生成。这意味着 Muse Video...

Read More
2026-08-17 talkingdev

AI视频生成创企Higgsfield融资4亿美元:估值从1月13亿飙升至54亿美元

AI视频生成初创公司Higgsfield宣布完成4亿美元新一轮融资,投资方包括DST、高盛、Liberty Global、英特尔等机构,投后估值达到54亿美元。该轮融资前,公司估值在1月为13亿美元,短短数月内增长超过三倍,显示市场对A...

Read More
2026-08-13 talkingdev

微软MAI-Image-2.6空降Arena文生图榜第二,超越Google、Meta与xAI

微软宣布其最新文本到图像模型MAI-Image-2.6在Arena文本到图像排行榜上首次亮相即升至第二位,排名超过Google、Meta和xAI等竞争对手。Arena排行榜基于用户盲测与偏好投票,是评估生成模型综合表现的重要公开基准之一...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page