漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-17 talkingdev

阿里Qwen 3.8 27B发布:17GB开源通用模型实现长上下文、工具调用、视觉与代码生成突破

近日,阿里巴巴Qwen研究实验室正式发布Qwen 3.8 27B,这是一款采用Apache 2.0许可的270亿参数开源大语言模型,开放权重约17GB。据知名开发者Simon Willison介绍,该模型在中等参数规模下集成了长上下文处理、高效工...

Read More
2026-08-15 talkingdev

美国商务部长称不赞成苹果采购中国内存芯片,敦促寻找其他方案应对AI芯片供应紧张

据《华尔街日报》报道,美国商务部长霍华德·卢特尼克(Howard Lutnick)公开表示,美国政府“不赞成”苹果公司购买中国内存芯片,并强调必须寻找“其他解决方案来解决内存问题”。这一表态正值AI算力需求爆发、高端内存...

Read More
2026-08-14 talkingdev

空货架还是丢钥匙?谷歌研究:GPT-5与Gemini 3事实性错误的瓶颈在“回忆”

大模型事实性错误常被简单归因为训练知识不足,但谷歌研究团队通过知识画像框架对Gemini 3、GPT-5等先进模型进行分析后发现,模型对事实知识的编码已接近饱和,真正的瓶颈出现在参数化回忆阶段。也就是说,模型并非...

Read More
2026-08-14 talkingdev

谷歌发布Gemini 3.7 Flash:面向编码与智能体的新一代主力模型

谷歌正式发布Gemini 3.7 Flash,官方称其为目前面向编码与智能体场景最智能的主力模型。该版本在软件工程和Web开发任务中显著提升准确性与效率,并以比前代更低的成本提供,意味着开发团队可以在更复杂、更长周期的...

Read More
2026-08-14 talkingdev

Netlify 同题实测 11 款大模型:DeepSeek V4 Flash 仅 2.4 积分,Claude Opus 5 高价低效?

近日,Netlify 公布了一项面向 AI 模型选型的横向测试:通过 OpenRouter 接入 DeepSeek、Qwen、Kimi、GLM 等 11 款主流模型,使用同一段构建提示词生成静态咖啡店网站,并比较输出质量与积分消耗。结果显示,模型间...

Read More
2026-08-14 talkingdev

OpenAI发布GPT-5.6 Sol超高速模式:推理速度最高提升14倍,每秒输出750 tokens

OpenAI正式预览了GPT-5.6 Sol的Ultrafast模式,该模式在推理速度上实现显著突破,最高可生成750个输出token/秒,整体处理速度达到标准模式的14倍。值得关注的是,这一性能提升并非通过切换更小的轻量模型来实现,而...

Read More
2026-08-14 talkingdev

消息称苹果联手阿里训练中国版大模型,或成首家在华提供自研AI模型的外国公司

据路透社援引知情人士消息,苹果已专门针对中国市场训练了一款大语言模型(LLM),并获得阿里巴巴的支持。若消息属实,苹果将成为首家在中国提供专有AI模型的外国公司。这一动作背后是中国对生成式AI服务的严格监管...

Read More
2026-08-13 talkingdev

Qwen3.8-2.4T-A95B发布:强化编码与长程智能体能力,推理深度可调

Qwen团队在Hugging Face发布Qwen3.8-2.4T-A95B模型。该模型基于Qwen3.5架构演进而来,重点提升编码与长时程任务处理能力,并通过改进的智能体执行机制提高任务完成可靠性。它支持SGLang、vLLM等主流部署框架,可较顺...

Read More
  1. Prev Page
  2. 8
  3. 9
  4. 10
  5. Next Page