漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2025-11-25 talkingdev

重磅发布:Anthropic推出Claude Opus 4.5模型,AI安全领域再获突破

人工智能安全与研究公司Anthropic正式发布Claude Opus 4.5模型,标志着可信AI系统建设迈入新阶段。作为专注于构建可靠、可解释与可操控AI系统的先锋企业,Anthropic此次更新延续了其在前沿AI安全技术领域的深度布局...

Read More
2025-11-25 talkingdev

Claude开发者平台推出高级工具使用功能,实现动态学习与执行

Anthropic公司近日在Claude开发者平台推出突破性的高级工具使用能力,标志着AI代理技术迈入新阶段。该功能允许Claude模型动态发现、学习并执行外部工具,使AI系统能够主动在现实世界中完成复杂操作。这一技术突破通...

Read More
2025-11-21 talkingdev

MCP代码执行技术革新:AI代理效率飙升98.7%,上下文开销锐减

模型上下文协议(MCP)框架迎来重大技术突破,通过代码执行环境实现了AI代理效率的跨越式提升。传统方案需要预加载数百个工具定义并通过上下文窗口传递中间结果,导致计算资源浪费和成本攀升。新技术允许AI代理将MCP...

Read More
2025-11-18 talkingdev

AA-Omniscience基准发布:Claude 4.1 Opus在40+主题知识幻觉测试中夺魁

人工智能评估机构Artificial Analysis最新推出AA-Omniscience基准测试体系,该体系针对40余个专业领域的大语言模型知识储备与幻觉现象进行系统性评估。测试结果显示,在关键指标上仅有三个模型能够保持正确回答率高...

Read More
2025-11-15 talkingdev

Claude开发者平台推出结构化输出功能,大幅提升API可靠性

Anthropic公司近日在其Claude开发者平台正式推出结构化输出功能的公开测试版,该功能现已在Sonnet 4.5和Opus 4.1模型上开放使用。这项技术突破通过确保API响应严格遵循开发者定义的JSON模式与工具定义,从根本上解决...

Read More
2025-11-14 talkingdev

全球首例AI主导网络间谍活动被曝光,安全防线面临重构

人工智能公司Anthropic近日披露了全球首例由AI全程策划的网络间谍活动,标志着网络安全攻防正式进入AI对抗时代。该攻击活动展现出高度智能化特征:通过生成式AI伪造身份凭证、动态调整渗透策略,并利用强化学习绕过...

Read More
2025-11-07 talkingdev

开源|月之暗面Kimi K2推理模型:多项基准超越GPT-5与Claude Sonnet 4.5

中国人工智能实验室月之暗面(Moonshot AI)近日开源其革命性推理模型Kimi K2,在关键基准测试中展现出与国际顶尖模型的竞争实力。该模型在衡量综合认知能力的‘人类终极考试’(Humanity's Last Exam)中取得44.9%的...

Read More
2025-11-05 talkingdev

MCP代码执行技术:构建更高效AI代理的新突破

最新技术研究显示,通过模型上下文协议(MCP)实现的代码执行功能正在显著提升AI代理的运行效率。这项突破性技术使AI代理能够在连接多个MCP服务器时,大幅减少令牌消耗,最高可降低98.7%的上下文开销。传统方法中,...

Read More
  1. Prev Page
  2. 8
  3. 9
  4. 10
  5. Next Page