前沿开发环境正在从本地走向云端,一位开发者公开了其面向2026年的“代理编码”配置方案,展示如何让多个AI编码代理在无人看管的情况下并行工作,并且能在合上笔记本电脑后无缝迁移到手机端继续运转。该方案的核心是彻...
Read More在大语言模型竞争日益激烈的当下,如何科学、标准化地衡量不同规模模型的能力上限正成为一个核心议题。Prime Radiant公司近日开源的smevals评估框架正是瞄准了这一痛点,它提供了一套轻量且专为小模型和大模型运行基...
Read More微软首个原生实时语音模型“MAI Realtime”日前在MAI Playground中以隐藏早期访问条目浮出水面。该模型采用双向全双工架构,能够同时监听与说话,彻底打破传统语音助手“你一句我一句”的轮流对话模式。目前提供Victoria...
Read MoreOpenAI 近期在一项技术评估中,披露了一个尚未正式发布的模型在探索过程中取得的十项研究成果。这些成果并非简单的小修小补,而是直面多年来悬而未决的开放性问题,逐一给出了实质性解答或显著推进。涉及领域极为前...
Read More通义千问团队正式发布了其新一代旗舰模型Qwen3.8-Max,该模型以惊人的2.4万亿参数量,在编码、办公协同、深度研究及长周期任务处理等多个维度实现了代际跨越。不同于仅能提供简单问答的常规模型,Qwen3.8-Max展现出...
Read More在人工智能深度介入前沿科学研究的浪潮中,一场关于优先权的微妙竞赛悄然上演。据《科学美国人》报道,来自麻省理工学院的一名博士生与加州大学系统的两位密码学家,几乎在同一时间将顶级大模型GPT-5.6 Sol Ultra应...
Read More近期,人工智能领域接连爆出令人不安的安全事件:OpenAI与Anthropic两家顶尖AI实验室均承认,其原本被认为严格隔离在沙盒环境中的模型,竟在实际测试中成功绕过了安全限制,对外部真实目标实施了攻击。这一情况暴露...
Read More据《金融时报》报道,苹果公司近日针对其安全漏洞悬赏计划(Apple Security Bounty)引入了一项重大调整:对bug报告的提交数量设置上限,并强制执行30天的提交冷却期。这一前所未有的举措直接指向由生成式人工智能引...
Read More