漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-07-24 talkingdev

微软发布MAI-Image-2.5-Pro与MAI-Voice-2-Flash:高保真图像生成和超低延迟语音模型正式公开预览

微软正式推出两款全新自研AI模型——MAI-Image-2.5-Pro和MAI-Voice-2-Flash,进一步强化其在多模态生成领域的布局。MAI-Image-2.5-Pro专注于高保真图像生成与编辑,能够根据复杂文本描述生成细节丰富、构图精准的高质...

Read More
2026-07-24 talkingdev

开源|吴恩达团队发布OpenWorker:本地桌面AI同事,跨文件跨应用自主完成任务

人工智能领军人物吴恩达(Andrew Ng)在GitHub上开源了一个名为OpenWorker的新项目。该项目旨在构建一个运行在本地桌面端的AI同事,它能够理解用户指令,自主跨越不同的文件、文件夹乃至桌面应用程序来执行复杂工作...

Read More
2026-07-22 talkingdev

通义千问发布Qwen-Image-3.0图像生成模型:支持4.5k token输入,原生渲染12种语言

阿里巴巴通义千问团队近日正式推出第三代基础图像生成模型Qwen-Image-3.0,在内容丰富度、细节真实感和世界知识融合方面实现全面升级。该模型支持最高4.5k token的文本输入,能够精准理解复杂长文本的语义,并生成富...

Read More
2026-07-17 talkingdev

LM Studio 发布 Bionic:面向开放模型的 AI 代理,本地云端无缝切换

知名本地大模型运行平台 LM Studio 正式推出 AI 代理 Bionic,专门为开放模型打造的智能助手,覆盖编码、研究和文档管理等多种生产力场景。Bionic 最大的特点在于架构灵活性:用户既可以选择在本地设备上完全离线运...

Read More
2026-07-17 talkingdev

Wispr Flow:让语音输入秒杀键盘,AI 应用的“嘴”替时代来了

当我们还在为向 ChatGPT 或 Claude 输入一段精准提示词而反复斟酌措辞时,一款名为 Wispr Flow 的工具正试图让键盘成为次选项。它并非简单的语音转文字,而是专为 AI 交互打造的流式语音输入引擎,支持用自然口语一...

Read More
2026-07-14 talkingdev

开源|LHTB:用密集奖励评分考验AI智能体长期终端工作能力

在大型语言模型(LLM)驱动的AI智能体日益普及的今天,如何可靠地评估其在长时间、多步骤任务中的实际生产力,仍是行业面临的核心挑战。GitHub上最新发布的开源项目LHTB(Long-Horizon Terminal Benchmark)正试图填...

Read More
2026-07-12 talkingdev

Cursor内部数据揭示AI编程惊人差异:顶级开发者周产4万行代码,90%算力消耗竟在“读代码”

知名AI编程工具Cursor发布的最新内部使用报告,揭示了人工智能在软件开发领域的深刻变革与巨大分化。数据显示,用户间的生产力鸿沟极为悬殊:前1%的重度用户平均每周可生成高达40,000行代码,而中位数用户仅为700行...

Read More
2026-07-12 talkingdev

马斯克旗下SpaceXAI发布Grok 4.5:专攻编码、智能代理与知识工作的最强模型

埃隆·马斯克旗下的人工智能公司SpaceXAI正式推出了新一代大语言模型Grok 4.5,将其定位为公司在编码、智能代理任务和知识工作领域的最强模型。官方披露,该模型在训练过程中与流行AI编程工具Cursor进行了深度协同优...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page