漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-07-28 talkingdev

谷歌云发布Gemini蒸馏服务:用gemini-2.5-flash复现大模型推理能力

谷歌云在Gemini企业智能体平台上正式推出Gemini蒸馏服务(Gemini Distillation Service),旨在通过大型“教师”模型的输出和推理路径,训练出更小、更高效的“学生”模型。该服务专门针对高吞吐量、低延迟严苛要求的应...

Read More
2026-07-28 talkingdev

微软发布网络安全专用模型MAI-Cyber-1-Flash,MDASH平台助阵大规模代码漏洞挖掘

微软正式推出面向网络安全的专用大模型MAI-Cyber-1-Flash,该模型专门针对大型代码库中的复杂漏洞进行深度检测,标志着AI在主动防御领域迈出重要一步。MAI-Cyber-1-Flash不只是一个通用的代码分析工具,它通过专门训...

Read More
2026-07-27 talkingdev

开源|Instatic:全能自托管CMS崛起,欲做Webflow与WordPress的开源终结者

GitHub上新晋开源项目Instatic正在引发Dev社区关注。作为一个自托管的可视化内容管理系统,它将可视化编辑器、内容引擎与发布工具全部封装进单一服务端,用户只需极少配置即可快速搭建并发布站点。Instatic定位为 We...

Read More
2026-07-27 talkingdev

提示缓存如何塑造编码智能体的成本与架构

提示缓存正在成为构建经济型智能体的关键技术,但其表现十分脆弱。在编码智能体等复杂系统中,一次工具定义的修改、模型版本的切换,或云服务提供商的路由决策变更,都可能将原本低成本的增量请求转变为对上下文的完...

Read More
2026-07-27 talkingdev

我们终于有了证明自动化:Zstd-Lean 项目用大语言模型攻克依赖类型证明难题

在依赖类型语言的世界里,强大的类型系统往往意味着沉重的证明负担——开发者可能需要花费数小时才能发现要证明的命题根本就是错误的。这种高昂的认知开销使依赖类型编程长期停留在小众领域。如今,这一局面正在被打破...

Read More
2026-07-27 talkingdev

GLM-5.2 API性能狂飙:Baseten打造最快版本,推理速度峰值达280 tokens/秒

Baseten 为 GLM-5.2 模型构建的全新 API 在推理速度上取得了突破性进展,峰值速度高达 280 tokens/秒,平均速度约为 100 tokens/秒,整体性能达到发布日初版 API 的两倍以上。这一大幅提升得益于底层的系统级优化与...

Read More
2026-07-24 talkingdev

哪款AI真的在读取你的网站?Evil Martians 团队实测两月LLM流量,ChatGPT与Claude行为截然相反

近日,开发者服务公司 Evil Martians 在其团队博客公布了为期两个月的服务器端追踪数据,对 web 流量中人类访客与 AI 爬虫的行为差异进行了量化分析。数据显示,AI 代理请求量达到 26.8 万次,远超同期 10.7 万次的...

Read More
2026-07-24 talkingdev

开源|OneCLI:AI代理的凭证安全网关,密钥注入不再“裸奔”

随着大模型和AI代理日益广泛地集成到各类业务系统中,如何安全管理API密钥、数据库密码等敏感凭证成为开发者面临的一大痛点。近日开源的OneCLI提供了一个精巧的解决方案:它以凭证网关的形式,在AI代理与服务之间构...

Read More
  1. Prev Page
  2. 16
  3. 17
  4. 18
  5. Next Page