OpenAI周二表示,为强化前沿模型的安全监控与防护能力,受监控的推理工作负载将额外增加约20%的计算开销。成本上升主要来自扩展后的多阶段思维链监控机制:系统会在模型逐步推理过程中进行多轮安全校验,以识别越狱...
Read More据TechCrunch报道,Stripe已同意以超过70亿美元的价格收购AI模型路由初创公司OpenRouter。OpenRouter为开发者提供统一的模型网关,能够根据模型能力、价格等因素在不同大模型之间智能路由请求,帮助企业灵活调用多家...
Read More人工智能研究公司Pathway近日获得3000万美元种子轮融资,投后估值达到5亿美元。该公司正在开发基于其称为“Post-Transformer”(后Transformer)的BDH架构AI模型,这一路线被外界视为对当前主流Transformer架构的探索...
Read More微软正式发布 MAI-Thinking-1,这是一款面向企业工作负载的中等规模推理模型,重点提升编码、数学和知识类任务中的成本效率。该模型强调在推理能力与部署成本之间取得平衡,适合需要大规模调用又对响应速度和预算敏...
Read More英伟达推出了全新的Nemotron 3.5 Lightning模型和NeMo Switchyard开源库,旨在大幅降低AI代理的推理成本并提升效率。Nemotron 3.5 Lightning是一个拥有300亿参数的混合专家模型(MoE),专为高吞吐量的专用代理任务...
Read More人工智能公司 Anthropic 正式确认计划通过联合设计定制化芯片与 AI 模型,来提升其大语言模型 Claude 的运行速度与计算能效。该公司已开始对外招募芯片设计工程师,旨在现有硬件合作伙伴关系之外,寻求更多底层基础...
Read More一项针对生命科学临床与监管场景的基准测试ClinReg显示,开源权重大语言模型在准确率上已追平顶尖闭源模型。测试中,GLM 5.2、Kimi K3等开源模型在监管和临床任务上的表现与GPT 5.6 Sol等商业模型的差异落在一个标准...
Read More在大语言模型走向产业级部署的进程中,如何在不显著牺牲质量的前提下降低推理成本和响应时延,是各家前沿实验室竞相突破的核心瓶颈。OpenAI工程师团队首次较为系统地披露了支撑ChatGPT及Codex高效运转的智能体循环(...
Read More