Anthropic 官方博客披露,智能体编码(Agentic Coding)在六个月内推动 CI 作业量增长 25 倍,原有测试影响分析服务作为单例运行,即便持续加配更大机器、实施包分片(package sharding)并每日重启,仍难以避免过载...
Read MoreSemiAnalysis最新披露的推理测试结果显示,NVIDIA下一代Vera Rubin NVL72平台在运行1.6万亿参数的DeepSeek模型时,每兆瓦功耗下的Token吞吐量最高达到Blackwell平台的7倍,明显高于黄仁勋此前对1T-3T规模LLM给出的3...
Read MoreAgentsDock 定位为面向智能体(agentic)AI研究的集成开发环境,核心特点是自托管工作区。开发者可以在自己控制的机器上运行 Claude Code、Codex 等智能体编程工具,并通过桌面端和移动端随时接入。该平台支持连接多...
Read Moremonday.com 工程团队近日披露了其 feedAgent 生产级智能体护栏方案,强调不应只依赖模型自身能力,而要把可靠性构建为围绕模型的系统工程。该框架覆盖输入清洗、幻觉检查、Schema 约束、执行限制、输出验证、全链路...
Read MoreMeta 的 Muse 应用即将引入“Shared Agents”功能,允许用户创建可配置的定制化 AI 代理,并像分享文档一样将其分发给团队成员或外部协作者。该机制与 Grokbot 的代理系统类似,表明 AI 代理正从个人辅助工具演进为可...
Read MoreOpenAI 宣布 Agents API 进入公共测试阶段,开发者现在可以访问支撑 Codex 的托管代理编排与基础设施。该 API 统一管理上下文、工具调用、子代理、持久执行、文件与代码环境,能够支持长时间运行的智能体。这意味着...
Read MorePI-Desktop 是一个早期预览版桌面工作区,专门为编码智能体打造,将项目、会话、审查与权限管理整合在一个本地优先的应用中。它采用 Electron 与 Rust 宿主核心相结合的架构,并配套 pi Agent Harness 和用户可安装...
Read MoreSierra 近日开源了 Hyper-τ-bench,这是一个面向长周期智能体构建能力的新评估基准。与常见只考察模型作为智能体执行任务的测试不同,Hyper-τ-bench 将开发者智能体置于沙盒工作区中,提供模拟业务的记录和可随时消...
Read More