漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-07 talkingdev

字节跳动被曝预训练10万亿参数超大模型,规模达Kimi K3的三倍,刷新行业纪录

据《金融时报》援引知情人士消息,TikTok母公司字节跳动正在预训练一个参数量高达10万亿的超大规模人工智能模型。这一数字大约是月之暗面Kimi K3模型参数量的三倍,也超过了Anthropic传闻中Mythos 5约8万亿参数的预...

Read More
2026-08-04 talkingdev

开源|从RLVR到RLSVR:通过任务转换让大语言模型实现自我可验证奖励的开放式自我进化

大语言模型(LLM)的自我改进一直是人工智能领域的核心挑战,而基于可验证奖励的强化学习(RLVR)在过去主要局限于数学、代码等存在明确对错判定的封闭式任务。来自COLM 2026的最新研究RLSVR突破了这一限制,提出通...

Read More
2026-08-04 talkingdev

开源|微软发布Orchard:一个开源Agentic建模框架,实现跨任务与跨领域的通用轨迹蒸馏与在线强化学习

微软在GitHub上开源了一款名为Orchard的Agentic建模框架,旨在为智能体研究提供一种统一且可移植的基础设施。Orchard的核心是一个轻量级的、Kubernetes原生的环境服务,它向上层暴露了一套通用的原语,且不对上层的...

Read More
2026-08-04 talkingdev

OpenAI 实时语音架构深度揭秘:半年打造全双工GPT-Live,人机对话迈入“无间断”时代

OpenAI 近期公开了其低延迟实时语音系统 GPT-Live 的技术细节,展示了一套仅用六个月构建的全新架构。区别于传统的轮流发言模式,GPT-Live 采用了全双工语音模型,能够实现一边聆听一边发言的连续对话,大幅减少了交...

Read More
2026-07-28 talkingdev

谷歌云发布Gemini蒸馏服务:用gemini-2.5-flash复现大模型推理能力

谷歌云在Gemini企业智能体平台上正式推出Gemini蒸馏服务(Gemini Distillation Service),旨在通过大型“教师”模型的输出和推理路径,训练出更小、更高效的“学生”模型。该服务专门针对高吞吐量、低延迟严苛要求的应...

Read More
2026-07-27 talkingdev

celeris-1 发布:超低延迟逼近 GPT-5 级智能,推理速度提升 15 倍

人工智能公司 celeris AI 正式推出全新通用语言模型 celeris-1,该模型在保持前沿智能水平的同时,实现了突破性的响应速度。celeris-1 的核心创新在于采用了一种基于扩散技术的新型推理架构,从根本上重构了传统自回...

Read More
2026-07-22 talkingdev

谷歌推出Gemini 3.6 Flash、3.5 Flash-Lite与3.5 Flash Cyber,全面优化效率与安全

谷歌正式发布了三款新一代Gemini模型:Gemini 3.6 Flash、3.5 Flash-Lite和3.5 Flash Cyber。其中,Gemini 3.6 Flash在编码和多模态任务上显著提升了性能,同时通过优化输出token的消耗,进一步降低了使用成本,使其...

Read More
2026-07-12 talkingdev

OpenAI 发布 GPT-Live:全双工语音模型重塑人机对话体验

OpenAI 正式推出新一代语音模型 GPT-Live,现已驱动 ChatGPT 语音功能。该模型采用全双工架构,允许 AI 在说话的同时持续倾听,彻底打破传统一问一答的交互模式,实现更接近人类自然交流的同步对话。GPT-Live 能够实...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page