漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-07-28 talkingdev

谷歌云发布Gemini蒸馏服务:用gemini-2.5-flash复现大模型推理能力

谷歌云在Gemini企业智能体平台上正式推出Gemini蒸馏服务(Gemini Distillation Service),旨在通过大型“教师”模型的输出和推理路径,训练出更小、更高效的“学生”模型。该服务专门针对高吞吐量、低延迟严苛要求的应...

Read More
2026-07-24 talkingdev

微软发布MAI-Image-2.5-Pro与MAI-Voice-2-Flash:高保真图像生成和超低延迟语音模型正式公开预览

微软正式推出两款全新自研AI模型——MAI-Image-2.5-Pro和MAI-Voice-2-Flash,进一步强化其在多模态生成领域的布局。MAI-Image-2.5-Pro专注于高保真图像生成与编辑,能够根据复杂文本描述生成细节丰富、构图精准的高质...

Read More
2026-07-24 talkingdev

Claude语音模式重大更新:支持Opus等全系列模型,并打通Gmail、Slack等办公应用

Anthropic为其AI助手Claude的语音模式推出了一次重要升级,显著提升了实用性和场景覆盖。本次更新最大的变化是模型支持范围的扩展:用户现在可以在语音交互中自行选择使用Claude Opus、Sonnet或Haiku模型,从而根据...

Read More
2026-07-23 talkingdev

告别昂贵算力:Petals让大模型在家用显卡上分布式运行成为现实

Petals 是一个颠覆性的点对点网络平台,它让普通用户能够在自己家中,仅凭消费级GPU甚至是免费的Google Colab笔记本环境,就运行起像 Llama 3.1、Mixtral、Falcon 和 BLOOM 这类巨型语言模型。其核心技术思路是将大...

Read More
2026-07-22 talkingdev

谷歌推出Gemini 3.6 Flash、3.5 Flash-Lite与3.5 Flash Cyber,全面优化效率与安全

谷歌正式发布了三款新一代Gemini模型:Gemini 3.6 Flash、3.5 Flash-Lite和3.5 Flash Cyber。其中,Gemini 3.6 Flash在编码和多模态任务上显著提升了性能,同时通过优化输出token的消耗,进一步降低了使用成本,使其...

Read More
2026-07-21 talkingdev

开源|Wigolo:零成本本地优先的AI代理网络情报工具,无需API密钥即可执行搜索与爬取

Wigolo是一款面向AI编码代理的本地优先网络情报工具,近期以公开测试版形式在GitHub发布。该工具的创新之处在于将搜索、抓取、爬取与结构化数据提取等网络任务完全本地化,直接通过MCP(模型上下文协议)为AI代理提...

Read More
2026-07-21 talkingdev

谷歌秘密研发新一代AI芯片Frozen v2,或将大幅降低Gemini推理成本

据TechCrunch报道,谷歌母公司Alphabet正在秘密推进一项代号为Frozen v2的服务器芯片项目,目标是在2028年前后实现部署。这款芯片专为提升Gemini系列大模型的运行效率而设计,其核心突破在于能效比:与谷歌现有的AI...

Read More
2026-07-16 talkingdev

Google DeepMind核心研究员离职内幕:因反对军事AI项目与道德审查形同虚设

曾在Google DeepMind任职的研究员发表长文,详细披露其因激烈反对公司与美军方签订人工智能合同而最终辞职的内部历程。作者指出,尽管谷歌曾高调承诺AI伦理原则,但在军方合同带来的巨大利益面前,内部设立的道德审...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page