Cognition正式发布SWE-2,这是其迄今最先进的编码模型。官方数据显示,SWE-2在FrontierCode 1.1 Main1基准上取得50.0%的得分,同时成本比上一代降低64%,在得分与成本两项指标上均超越SWE-1.7和Grok 4.6。该模型以远...
Read MoreCohereLabs 在 Hugging Face 上发布了开放权重研究模型 North Small Translate。该模型拥有 250 亿活跃参数和 2180 亿总参数,专门面向 50 种语言之间的高质量机器翻译任务。从参数结构看,活跃参数仅占总参数约 11....
Read MoreOpenAI 宣布 Agents API 进入公共测试阶段,开发者现在可以访问支撑 Codex 的托管代理编排与基础设施。该 API 统一管理上下文、工具调用、子代理、持久执行、文件与代码环境,能够支持长时间运行的智能体。这意味着...
Read MorePI-Desktop 是一个早期预览版桌面工作区,专门为编码智能体打造,将项目、会话、审查与权限管理整合在一个本地优先的应用中。它采用 Electron 与 Rust 宿主核心相结合的架构,并配套 pi Agent Harness 和用户可安装...
Read MoreReact 19.3 版本正式发布,带来多项面向现代 Web 与原生应用开发的重要更新。本次版本引入 View Transitions 支持,使开发者能够更便捷地为页面或视图切换添加原生过渡动画,提升用户体验与视觉连贯性。新增 Fragmen...
Read MoreZeroModels 是一个完全基于 Keras 3 构建的预训练模型集合,覆盖图像分类、目标检测、分割、单目深度估计、特征提取、视觉语言模型和语音识别等任务。该项目最大的亮点在于同一套代码可原生运行在 JAX、PyTorch 和 T...
Read More在传统 Git 工作流中,.gitignore 通常采用“默认允许所有文件,再选择性忽略某些文件”的模式。这种思路依赖开发者主动列出敏感或不必要文件,一旦遗漏,就可能将本地配置、临时文件甚至密钥提交到仓库。packagemain....
Read MoreSierra 近日开源了 Hyper-τ-bench,这是一个面向长周期智能体构建能力的新评估基准。与常见只考察模型作为智能体执行任务的测试不同,Hyper-τ-bench 将开发者智能体置于沙盒工作区中,提供模拟业务的记录和可随时消...
Read More