虚拟试穿任务,即将一图像上的衣物转移到另一图像,尤其在更高分辨率下,这项任务具有挑战性。许多方法使用生成对抗网络(GAN)。然而,本文介绍的解决方案DCI-VTON,采用了一种结合了样例基础修复和变形模块的扩散...
Read More最近,一款名为OpenDream的新技术在GitHub仓库中引起了大量的关注。OpenDream的核心优势在于,它为稳定扩散工作流带来了多种新的特性。首先,OpenDream引入了层次化的设计,这让开发者能够更好地组织和管理他们的代...
Read MoreDoctorGPT,这款领先的语言模型(LLM),已经能够通过美国医疗执照考试。它的特点是可以离线工作,跨平台运行,且能保护用户的健康数据私密性。这款开源的AI医生,将为医疗行业带来革命性的改变,使得医疗服务更具普...
Read More虽然段落任意模型(SAM)在各种数据集的分割任务中表现优异,但在面具的特定类别细节上存在疏漏。FoodSAM成功克服了这一问题。它结合了SAM的优势和新的特性,有效地分割食品图像,甚至识别出场景中的单个食品和其他...
Read MoreIBM与Hugging Face正在向公众发布IBM的地理空间基础模型,该模型使用NASA的卫星数据进行构建。这个模型是IBM与NASA的合作成果,旨在推动AI在气候科学和地球研究中的作用,解决处理大型环境数据集的挑战。该模型已经...
Read More近日,谷歌宣布对其AI驱动的搜索生成体验进行了一系列更新。这些更新包括自动词汇定义、编程辅助和AI生成的摘要。谷歌一直致力于利用AI技术提升搜索体验,此次更新更是将这一目标推进到新的高度。自动词汇定义功能可...
Read MoreLLaMA.cpp的崛起令许多人感到惊讶。为什么一台普通的MacBook能够以稍慢于A100的速度运行最先进的模型呢?答案在于,当你一次只处理一个批次,一个标记的时候,内存带宽就成了瓶颈。而M2的内存带宽与A100的之间的差距...
Read More