漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2025-06-06 talkingdev

谷歌实验室推出Portraits AI教练工具,携手专家Kim Scott提供个性化指导

谷歌实验室近日发布了名为Portraits的AI教练工具,该工具整合了包括知名专家Kim Scott在内的多位专业人士的经验,通过AI技术为用户提供个性化指导。Portraits利用谷歌Gemini模型的强大能力,创建交互式虚拟形象,模...

Read More
2025-05-22 talkingdev

[论文推荐]慢思考提升大语言模型的置信度校准能力

最新研究表明,通过延长思维链推理过程(Extended chain-of-thought reasoning),大型语言模型(LLMs)能够显著提升其置信度校准能力。这项发表在arXiv预印本平台的研究(编号2505.14489v1)揭示了传统即时响应模式...

Read More
2025-05-08 talkingdev

万事达卡推出AI购物助手:智能代理技术开启电商新体验

万事达卡最新推出的AI程序通过智能代理技术革新了电子商务搜索流程,显著提升购物效率并降低操作摩擦。该技术通过机器学习算法理解用户偏好,自动筛选匹配商品,但最终交易决策权仍由消费者掌握——AI代理仅提供建议而...

Read More
2025-05-07 talkingdev

NVIDIA推出Radio文本与图像嵌入模型,性能媲美SigLIP

NVIDIA近期在Hugging Face Hub上发布了一系列文本与图像嵌入模型(Radio系列),其性能在多项基准测试中达到或超越当前热门的SigLIP模型。这些模型通过先进的神经网络架构优化了多模态数据的向量表示能力,可广泛应...

Read More
2025-05-05 talkingdev

资深LLM用户自述:生成式大模型并非我的常用工具

近日,一位长期使用大语言模型(LLM)的资深用户在个人博客中分享了他的使用心得。尽管生成式LLM(如GPT系列)在业界引起广泛关注,但该作者表示自己并不频繁使用这类模型。相反,他更倾向于将LLM应用于特定场景,如...

Read More
2025-04-25 talkingdev

Adobe重磅推出Firefly升级版:统一图像、视频、音频及矢量生成工具

Adobe近日发布了Firefly的重大更新,此次更新不仅整合了图像、视频、音频及矢量生成工具,还新增了移动端支持,并进一步深化了与Creative Cloud的集成。这一举措标志着Adobe在创意AI领域的又一重要突破,为设计师和...

Read More
2025-04-24 talkingdev

xAI聊天机器人Grok新增视觉识别功能,iOS用户可体验

马斯克旗下人工智能公司xAI推出的Grok聊天机器人近日迎来重要升级,新增了视觉识别能力。这一功能允许iOS用户上传图片或通过摄像头捕捉画面,随后向Grok提问关于所看到内容的问题。该功能与OpenAI的ChatGPT和谷歌的G...

Read More
2025-03-25 talkingdev

[开源] Baichuan Omni 1.5:开源全模态基础模型支持多模态输入输出

Baichuan Omni 1.5 是一款支持文本、图像、视频和音频输入以及文本和音频输出的开源全模态基础模型。该模型采用任意到任意(any-to-any)的设计风格,属于原生多模态模型的一种典型代表。其核心技术在于使用了交错的...

Read More
  1. Next Page