漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-03-13 talkingdev

开源|Understudy:可教学的AI桌面助手,通过观察学习像人类一样操作电脑

GitHub上开源项目Understudy展示了一种新型可教学AI桌面代理的前沿理念。该项目旨在开发一个能够像人类同事一样操作计算机的智能体,其核心创新在于通过演示进行学习,而非依赖传统的脚本录制或API集成。Understudy...

Read More
2026-03-12 talkingdev

开源|DHS合同数据浏览器曝光:揭秘美国国土安全部行业合作办公室遭黑客入侵的合同信息

近日,一个托管在GitHub上的开源项目“DHS Contracts Explorer”引发了科技界与数据安全领域的广泛关注。该项目基于黑客入侵美国国土安全部(DHS)下属行业合作办公室(Office of Industry Partnership)所获取的数据...

Read More
2026-03-11 talkingdev

开源|阿里开源Page Agent:用自然语言操控网页界面的JavaScript GUI智能体

阿里巴巴近日在GitHub上开源了名为“Page Agent”的项目,这是一个运行在网页内部的JavaScript图形用户界面(GUI)智能体。该技术的核心创新在于,允许用户直接使用自然语言指令(如“点击登录按钮”或“在搜索框输入关键...

Read More
2026-03-11 talkingdev

开源|RCLI:完全本地的macOS语音AI助手,无需云端即可控制电脑与文档问答

近日,GitHub上开源项目RCLI引发开发者社区关注。该项目是一款专为搭载Apple Silicon芯片的macOS设备设计的全本地化语音AI助手。其核心价值在于构建了一个完整的端侧AI处理流水线,集成了语音识别(Speech-to-Text)...

Read More
2026-03-11 talkingdev

开源|RCLI:本地化语音AI助手登陆macOS,无需云端即可控制应用与查询文档

近日,GitHub开源项目RCLI(RunanywhereAI/RCLI)发布,为macOS用户带来了一款完全在设备端运行的语音人工智能助手。该工具的核心创新在于其“全本地化”架构,集成了本地语音AI与检索增强生成(RAG)技术,用户可直接...

Read More
2026-03-09 talkingdev

开源|阿里开源Page Agent:用自然语言操控网页界面的JavaScript GUI智能体

阿里巴巴开源项目Page Agent近日在GitHub发布,这是一个运行于浏览器页面内的JavaScript图形用户界面智能体。其核心创新在于,允许用户直接使用自然语言指令(如“点击登录按钮”或“在搜索框输入关键词”)来操控网页界...

Read More
2026-03-09 talkingdev

开源|React Native Grab:革新React Native调试的“触手可及”UI抓取工具

近日,由Callstack孵化器在GitHub上开源的React Native Grab工具,为React Native应用开发调试领域带来了创新性解决方案。该工具的核心价值在于其“触摸即抓取”的交互模式,允许开发者在运行中的移动应用界面上直接触...

Read More
2026-03-09 talkingdev

开源|Karpathy发布AutoResearch项目:单GPU驱动的AI自主研究循环

知名AI研究员、前特斯拉AI总监Andrej Karpathy近日在GitHub上开源了AutoResearch项目,该项目旨在构建一个能够在单GPU小型LLM训练环境中运行的AI驱动自主研究循环系统。该系统允许AI智能体自动修改代码和指导文件,...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page