模型的相关内容 - 漫话开发者

2024-05-13 talkingdev

Text2Any开源模型：Lumina引领全新一代技术革新

Lumina是一个新一代的项目，其目标是成为统一的文本到X生成模型。这个项目的训练涉及到图像、视频、音频和文本的交替，这种方法提高了下游性能。Lumina项目带来的这种全新技术，将对未来的人工智能、机器学习和深度...

2024-05-13 talkingdev

E2URec是一种全新的方法，可以让基于大型语言模型的推荐系统高效、有效地“遗忘”用户数据，保证用户隐私的同时，又不牺牲系统性能。这种新方法以用户隐私保护为核心，通过改变推荐系统的学习机制，实现对用户数据的有...

2024-05-13 talkingdev

近日，Salesforce已经训练并发布了广受欢迎的BLIP模型的第三个非商业版本。这款模型主要用于图像理解和标注，是视觉和语言模型的最新成果。Salesforce一直致力于开发和研究这种模型，以提高其在图像理解和标注方面的...

2024-05-13 talkingdev

语言模型依赖于单独训练的标记生成器。这些标记生成器可能会产生在语言模型训练过程中从未见过的标记。即使在最强大的现代语言模型中，也存在许多此类标记。本文探讨了这种现象，并提出了识别和处理这些标记的方法。...

2024-05-13 talkingdev

Cohere公司近日推出了其Command R的微调功能，该功能以极低的成本提供了业界领先的性能。在对企业最重要的关键性能指标上，具有微调功能的Command R始终优于更大的模型。该微调功能现已在Cohere的平台和亚马逊Sagema...

2024-05-10 talkingdev

阿里巴巴云已经发布了其最新版的大语言模型 - Tongyi Qianwen Qwen2.5。这一新版本在推理、代码理解以及文本理解等方面相比于Qwen2.0有了显著的改进。Qwen2.5的推出标志着阿里巴巴在人工智能语言模型开发上取得了重...

2024-05-10 talkingdev

近期，关于如何扩展语言模型的语境的讨论引起了业界的关注。这次讨论并未提供太多的评估方法，但却对语言模型领域的探索方向提供了深度剖析。语言模型的语境是机器学习和自然语言处理中的关键组成部分，对于提高模型...

2024-05-10 talkingdev

Buzz是一个创新型的数据集，它在预训练中融合了偏好数据。该数据集的研究者们还发布了几个利用这些数据训练的模型。他们发现，这些模型在许多人类偏好任务上表现出色。Buzz数据集的出现，无疑为人工智能研究提供了新...