OpenAI 正式发布 ChatGPT Images 2.5,新一代图像生成模型在细节呈现、参考图还原和编辑稳定性方面实现显著升级。官方介绍显示,该版本能输出更锐利的图像细节,在融合用户提供的草图或参考照片时拥有更强的保持能力...
Read MoreQwenLM团队在GitHub开源了Qwen-Drive-1.0项目,定位为面向自动驾驶的视觉语言基础模型。该项目采用分阶段训练策略,将感知、语言理解和规划目标融合到统一框架中,使模型既能获得专业驾驶能力,又能保留广泛的视觉理...
Read MoreCohere 推出 Parse 文档智能解析服务,可将复杂多模态文件(如文档、表格、图像)转换为结构化、机器可读的数据。该服务基于高成本效益的视觉语言模型,面向企业大规模文档处理场景,能够检测并理解关键视觉元素,并...
Read More承载前沿大语言模型(LLM)的宿主机正成为高价值攻击目标。这类机器不仅拥有运行先进模型所需的GPU算力,还能直接访问模型权重,并在数据中心内具备比普通互联网主机更高的特权。最新研究指出,LLM可以生成特定token...
Read MoreMeta 旗下的 Muse Video 视频生成模型已进入封闭测试阶段。根据曝光的早期生成样片,该模型在 10 秒级视频中展现出较高的细节还原能力、对场景的理解能力以及时间一致性,并且原生支持音频生成。这意味着 Muse Video...
Read MoreSpaceX正式宣布收购AI编程工具Cursor,旨在将其庞大的GPU计算资源应用于AI模型训练,以显著提升模型性能并降低训练成本。借助SpaceX在高性能计算基础设施方面的积累,Cursor有望开发出能力更强、效率更高的代码生成...
Read More近日,阿里巴巴Qwen研究实验室正式发布Qwen 3.8 27B,这是一款采用Apache 2.0许可的270亿参数开源大语言模型,开放权重约17GB。据知名开发者Simon Willison介绍,该模型在中等参数规模下集成了长上下文处理、高效工...
Read MoreHugging Face 最新发布的半年度开放模型生态报告显示,开发者基于 Qwen 系列模型已创建超过 151,000 个衍生模型,数量在所有基础模型中位居第一,使 Qwen 成为开放模型生态系统中规模最大、影响力最广的底座之一。报...
Read More