Zyphra首席技术官Beren Millidge、Thinking Machines首席科学家兼OpenAI联合创始人John Schulman,以及Baseten模型训练负责人Charlie O'Neill在一场播客中围绕人工智能递归自我改进的前景展开深入讨论。三位专家从当...
Read MoreRhoda AI 团队围绕视频基础模型与机器人策略的规模化问题展开研究,重点考察扩大模型参数量与预训练计算量,是否能直接提升机器人在真实工业环境中的操作能力。研究采用 Direct Video-Action 模型,直接将视频观测映...
Read MoreOpenAI 宣布 Agents API 进入公共测试阶段,开发者现在可以访问支撑 Codex 的托管代理编排与基础设施。该 API 统一管理上下文、工具调用、子代理、持久执行、文件与代码环境,能够支持长时间运行的智能体。这意味着...
Read MoreAI 初创公司 Magic 发布预训练研究更新,称其预训练方案的计算效率已比主流开源权重基础模型提升超过 10 倍,并正将规模扩展至万亿参数级别。团队认为,在缺乏大规模算力的情况下,小型实验室只能依靠算法效率参与竞...
Read MoreQwenLM团队在GitHub开源了Qwen-Drive-1.0项目,定位为面向自动驾驶的视觉语言基础模型。该项目采用分阶段训练策略,将感知、语言理解和规划目标融合到统一框架中,使模型既能获得专业驾驶能力,又能保留广泛的视觉理...
Read More微软正式发布 MAI-Transcribe-2 语音识别模型,官方宣称其在速度、准确率和成本方面全面领先,并超越 Gemini 3.5 Transcribe、GPT-Transcribe 和 Whisper V3-Large。该模型集成了说话人分离、可配置转录风格和词级时...
Read More谷歌近日发布TimesFM-3,这是一款拥有3.3亿参数的时间序列基础模型,预训练数据规模超过1万亿个时间点。该模型聚焦零样本预测,可在不进行任务特定微调的情况下对多个目标变量进行联合预测,并支持历史协变量和已知...
Read More近期开放模型在短短数月内取得显著进展,基础模型已不再是能力提升的主要瓶颈。以GLM5.3和Qwen3.8-27B为代表的新一代模型,其相较上一代的性能提升主要来自后训练阶段的优化,而非单纯扩大基础模型规模。值得关注的...
Read More