漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2023-08-24 talkingdev

Clip4Cir开源-使用CLIP和标题改进图像搜索

该项目引入了一种搜索图像的方法,该图像看起来像给定的图片,但是在标题中描述了变化。它使用了增加了特殊技巧的CLIP模型。该方法在FashionIQ和CIRR等流行的图像搜索数据集上表现更好。CLIP模型是一个多模态视觉模...

Read More
2023-08-24 talkingdev

自我训练调查:机器学习新方向解析

半监督和自我监督学习是机器学习模型生成训练信号的地方。这与标准的监督、无监督和强化学习有所不同。目标函数通常是特定于数据的(例如,掩盖单词或旋转图像)。本研究深入探讨了在这个领域使用的常见技术和存在的...

Read More
2023-08-24 talkingdev

TOPIC开源,多目标跟踪新突破并发布复杂动作数据集BEE23

近日,一群研究者开发出一套名为TOPIC的新系统,能够通过运动和外观线索有效地在视频中跟踪多个对象。TOPIC系统不仅能够处理复杂的运动,而且还可以有效处理对象的外观变化,显著提高了多目标跟踪的准确性和效率。为...

Read More
2023-08-24 talkingdev

科学家发现新的文本到3D模型转换技术

科学家们已经找到了一种新的将文本转换为3D模型的方法,这种方法运用了特殊的技术,但有时结果并不完美。IT3D引入了一种智能策略,该策略使用多个视点和一个特殊的训练系统,使得3D创作看起来更加真实。这种技术的应...

Read More
2023-08-24 talkingdev

OneDiffusion:使扩散模型部署更简单可扩展

在生产环境中部署扩散模型一直是一个挑战,因为这些模型难以处理,且计算成本高。但是现在,OneDiffusion的出现旨在使部署和微调变得更易于管理、可扩展且可靠。OneDiffusion是一个开源项目,它的目标是使扩散模型在...

Read More
2023-08-24 talkingdev

通过Deepgram的创业计划创建、启动和扩大语音启用应用

Deepgram的创业计划为初创企业提供了高达10万美元的信用额度,以使用最强大的语音转文本API。这个计划包括对话分离、智能格式化、多语言等功能,初创企业可以立即申请。通过Deepgram的创业计划,开发者可以创建和启...

Read More
2023-08-24 talkingdev

MidJourney推出图像修复新功能

近日,MidJourney宣布推出其最新的功能“Vary (Region)”。该新功能允许用户进行图像修复——一种可以编辑图像画布内元素的过程。用户现在可以利用这项新技术,进行图像编辑和重构,无论是去除图像中不需要的元素,还是...

Read More
2023-08-24 talkingdev

微软试验将AI融入Windows基础应用

微软正处于初期阶段,正在试验为内置在Windows中的应用程序如照片、截图工具甚至是画图工具等添加新的AI功能。这一举动旨在通过提供更智能的工具来提升用户体验。例如,新的AI功能可能会帮助用户更有效地编辑和管理...

Read More
  1. Prev Page
  2. 1062
  3. 1063
  4. 1064
  5. Next Page