漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-03 talkingdev

OpenAI GPT-5.6 系列大幅降价:Luna 成本直降 80%,性能与性价比再突破

OpenAI 宣布对旗下 GPT-5.6 系列模型进行新一轮价格调整,进一步推动企业级 AI 应用的价格性能比前沿。其中,轻量版 GPT-5.6 Luna 输入价格降至每百万 token 0.20 美元,输出降至 1.20 美元,降幅高达 80%;均衡版 T...

Read More
2026-07-31 talkingdev

开源|World Model Optimizer:基于智能体轨迹蒸馏前沿模型,构建持续进化的自主智能

World Model Optimizer(WMO)是由experientiallabs开源的一项工具,直面当前智能体(Agent)系统性能优化与模型成本之间的矛盾。其核心思路是将智能体在实际运行中积累的交互轨迹作为高价值训练数据,通过知识蒸馏...

Read More
2026-06-23 talkingdev

资深工程师必读:一文读懂大语言模型的内核——Transformer架构深度解析

大型语言模型(LLM)的核心架构是Transformer,它通过引入自注意力机制,从根本上解决了传统循环神经网络(RNN)在处理长序列数据时面临的顺序计算瓶颈与长距离信息衰减问题。本文深入剖析了Transformer的各个关键组...

Read More
2026-05-28 talkingdev

AI程序员Devin再获巨额融资,Cognition估值飙升至260亿美元

人工智能软件工程师Devin的开发商Cognition近日宣布完成超过10亿美元的新一轮融资,公司估值达到260亿美元。本轮融资由Lux Capital、General Catalyst和8VC等知名投资机构领投。Devin作为一款AI驱动的软件工程师,已...

Read More
2026-02-08 talkingdev

Claude Code推出快速模式,显著提升Opus 4.6代码助手响应速度

近日,Anthropic公司为其代码助手Claude Code推出了一项名为“快速模式”的新功能,旨在显著提升其旗舰模型Opus 4.6的响应速度。该功能允许用户在Claude Code界面中通过切换开关,在需要快速获取代码建议或解释时,获...

Read More
2026-01-23 talkingdev

小模型大作为:谷歌提出分解法,实现更优意图理解,兼顾效率与隐私

谷歌研究团队近日发布了一项关于提升智能体意图理解能力的技术成果。核心观点指出,要让AI智能体真正发挥作用,其底层模型必须精准理解用户交互时的真实意图。当前,大型多模态大语言模型虽已在此任务上表现不俗,但...

Read More
2025-11-30 talkingdev

专访诺奖得主John Jumper:AlphaFold的创造性“超范围应用”与LLM融合前瞻

在《麻省理工科技评论》的深度访谈中,谷歌DeepMind诺奖得主John Jumper揭示了AlphaFold超越传统蛋白质结构预测的突破性应用。这位2017年刚获得理论化学博士学位的科学家,如今正引领团队探索AlphaFold在药物设计、...

Read More
2025-09-15 talkingdev

LLM后训练全流程深度解析:从SFT到RLHF与评估最佳实践

这篇技术长文系统性地剖析了大语言模型(LLM)的后训练完整生命周期,涵盖了监督微调(SFT)、奖励建模(Reward Modeling)以及强化学习方法(如RLHF)三大核心阶段。作者不仅详细阐述了如何通过人类反馈的强化学习...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page