模型的相关内容 - 漫话开发者

2024-01-09 talkingdev

深入浅出学习Transformer

Transformer是自然语言处理中非常重要的模型，但对于初学者来说可能有些困难。然而，这篇文章提供了一个非常好的介绍，对于具有基本数学和Python技能的人来说非常易于理解。作者详细解释了Transformer的工作原理，并...

2024-01-09 talkingdev

本文深入探讨了如何打造一种具有人类思维过程的人工智能。在过去的几十年中，人工智能一直是计算机科学领域的一个热门话题。尽管现在已经有了许多成功的应用程序，但我们远远没有达到完全模拟人类思维过程的目标。本...

2024-01-09 talkingdev

LLaVA-Phi是一款创新的多模态助手，它使用Phi-2语言模型。尽管参数只有2.7B，但LLaVA-Phi在多模态对话中表现出色，结合了文本和视觉。该助手可以在多个领域内使用，例如智能家居和自动驾驶等。

2024-01-09 talkingdev

这项项目介绍了一种方法，可以适应各种任务的类似CLIP的视觉语言模型，同时保留其泛化能力。该方法从LLM数据中学习提示，避免了需要标记图像的需求。

2024-01-09 talkingdev

DiffusionEdge是一种新颖的边缘检测模型，它集成了扩散概率模型，可以在资源有效的同时提供更准确和清晰的边缘图。传统的边缘检测模型对于噪声和边缘不清晰的情况表现得不够稳定。DiffusionEdge的扩散模型可以帮助减...

2024-01-09 talkingdev

近日，一种名为GUESS的框架被引入，用于从文本中创建人体动作。该框架将复杂的人体姿态简化为各个层次上的更抽象形式，从而使从文本合成动作更加简洁稳定。

2024-01-09 talkingdev

最新的研究表明，在语言模型中添加新的模块并在另一个任务上进行调整，可以防止丢失知识。这在代码和语言任务中都有体现。

2024-01-09 talkingdev

有很多方式可以对齐语言模型，例如SFT、LoRa、RLHF、DPO、Prompting和Threatening。本研究提出使用负嵌入加到偏置项中，以将模型生成推向期望的结果。