OpenAI 正式发布了其新一代自动化安全测试系统 GPT-Red。该系统不再依赖传统人工红队测试,而是通过大规模的自我博弈机制,让模型在对抗中持续进化。具体而言,GPT-Red 被训练成能够迭代式生成对抗性提示,系统性地...
Read MoreOpenAI最新推出的GPT-5.6-Sol模型被视为一款成本效益极高且运行高效的AI系统,尤其适合日常编程与工程任务,堪称继前代版本之后更为稳定可靠的“主力军”。与此前动辄耗费大量算力的旗舰模型不同,Sol在保持强大代码理...
Read More近期发布的Basecamp Bench基准测试,对GPT-5.6 Sol、Fable 5和Grok 4.5三款前沿大模型在复杂软件工程任务中的表现进行了横向比较。测试聚焦于全栈开发场景,从代理能力、生成成本与输出质量三个维度进行评测。结果显...
Read MoreOpenAI 近日正式推出全新的 GPT-5.6 模型家族,旗舰版本代号“Sol”,在智能水平、运行效率与成本控制上实现三重跃升。该系列模型在数学推理、代码生成、长文本理解等多个权威基准测试中,不仅全面超越前代 GPT-5,也...
Read MoreOpenAI正式推出GPT-5.6系列模型,包含Sol、Terra和Luna三个版本,其中Sol在编码、网络安全和科学研究等任务中展现出领先的智能与效率。该系列模型通过更少的令牌消耗实现更强的性能,单位算力成本显著下降。Sol在多...
Read MoreOpenAI 正式推出新一代语音模型 GPT-Live,现已驱动 ChatGPT 语音功能。该模型采用全双工架构,允许 AI 在说话的同时持续倾听,彻底打破传统一问一答的交互模式,实现更接近人类自然交流的同步对话。GPT-Live 能够实...
Read More埃隆·马斯克旗下的人工智能公司SpaceXAI正式推出了新一代大语言模型Grok 4.5,将其定位为公司在编码、智能代理任务和知识工作领域的最强模型。官方披露,该模型在训练过程中与流行AI编程工具Cursor进行了深度协同优...
Read MoreOpenAI正式推出新一代语音模型GPT-Live,并已作为核心引擎驱动ChatGPT Voice。该模型首次实现了真正的全双工交互能力,能够同时进行聆听与讲话,彻底告别传统语音助手“轮流发言”的机械感。GPT-Live不仅可以捕捉和处...
Read More