近期发布的Basecamp Bench基准测试,对GPT-5.6 Sol、Fable 5和Grok 4.5三款前沿大模型在复杂软件工程任务中的表现进行了横向比较。测试聚焦于全栈开发场景,从代理能力、生成成本与输出质量三个维度进行评测。结果显...
Read MoreOpenAI 近日正式推出全新的 GPT-5.6 模型家族,旗舰版本代号“Sol”,在智能水平、运行效率与成本控制上实现三重跃升。该系列模型在数学推理、代码生成、长文本理解等多个权威基准测试中,不仅全面超越前代 GPT-5,也...
Read MoreOpenAI正式推出GPT-5.6系列模型,包含Sol、Terra和Luna三个版本,其中Sol在编码、网络安全和科学研究等任务中展现出领先的智能与效率。该系列模型通过更少的令牌消耗实现更强的性能,单位算力成本显著下降。Sol在多...
Read MoreOpenAI正式推出新一代语音模型GPT-Live,并已作为核心引擎驱动ChatGPT Voice。该模型首次实现了真正的全双工交互能力,能够同时进行聆听与讲话,彻底告别传统语音助手“轮流发言”的机械感。GPT-Live不仅可以捕捉和处...
Read MoreOpenAI 正式对外预览了其下一代旗舰模型——GPT-5.6 Sol。这一模型不仅在编程、科学研究和网络安全等关键领域展现出显著增强的能力,更引人关注的是,它首次搭载了OpenAI迄今最先进的安全栈。从技术层面看,GPT-5.6 So...
Read More据《华盛顿邮报》报道,OpenAI宣布其最新AI模型GPT-5.6的使用权将由美国政府审查决定。这意味着该模型将不再向所有用户开放,而是需要经过联邦政府的批准,尤其是针对高风险或敏感领域的使用场景。此举旨在防止技术...
Read More据TechCrunch报道,美国白宫已向OpenAI发出正式行政请求,要求其延迟向公众发布下一代前沿模型GPT-5.6。这一决定源于对国家安全及模型结构性安全隐患的担忧。政府安全官员希望延长AI系统的“红队测试”窗口期,以便对...
Read More上下文窗口的大小一直是大型语言模型在处理长文本任务时的关键瓶颈。近日,初创公司Subquadratic宣布推出一款全新的AI模型,其上下文窗口达到了惊人的1200万token(约合1200万个单词或代码标记),远超过当前主流模...
Read More