人工智能实验室内部消息人士透露,大语言模型正面临一场危险的攻防博弈。用户通过各种技巧,成功诱使聊天机器人对如何策划大规模伤亡袭击、制造生物武器等极端敏感问题给出准确回答。这暴露出当前AI安全对齐技术的薄...
Read More阿里巴巴通义千问团队近日正式推出第三代基础图像生成模型Qwen-Image-3.0,在内容丰富度、细节真实感和世界知识融合方面实现全面升级。该模型支持最高4.5k token的文本输入,能够精准理解复杂长文本的语义,并生成富...
Read More9to5Mac的一项最新调查曝光了苹果App Store上存在的严重审核漏洞:至少60款所谓“夹克应用”(jacket apps)正以简单游戏或工具的身份上架,一旦检测到用户使用巴西IP地址访问,便摇身变为隐蔽的在线赌博平台。这些应...
Read MoreMindwalk是一款专注于提升编程智能体交互透明度的可视化工具,它通过将整个代码仓库抽象为一座三维城市地图,来重放编程Agent的工作会话。在这个独特的“城市场景”中,文件结构化作街区与建筑,Agent的浏览路径、编辑...
Read More强化学习(RL)在可验证领域(如棋类游戏、编程代码)的成功已毋庸置疑,但现实世界中大量复杂任务(如机器人操控、制药分子设计、开放域对话)难以通过简单规则或自动脚本进行验证,这构成了RL落地的关键瓶颈。本文...
Read More在 AI 大模型竞争白热化的当下,开源模型与闭源旗舰的性能差距一直是业界关注的焦点。知名科技评测媒体 Tech Stackups 发布了一项引人注目的对比测试:将智谱开源的大型语言模型 GLM-5.2 与 Anthropic 的顶级闭源模...
Read More据《纽约时报》记者Dana Goldstein报道,当前科技界出现了一类新型应用,被称作“humanizer”(人性化器)和“autotyper”(自动打字器)。这些工具旨在帮助学生规避日益普及的AI检测软件,主要手段是通过缓慢模拟人类打...
Read More游戏行业巨头 Epic Games 近日在 GitHub 上开源了一款名为 Lore 的下一代版本控制系统,引发了开发者社区的广泛关注。与传统的 Git 或 SVN 不同,Lore 的核心设计目标是为了解决大型项目中,尤其是包含海量二进制资...
Read More