漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2024-04-15 talkingdev

人工智能领域领袖Andrew Ng加入亚马逊董事会

著名人工智能科学家Andrew Ng博士,现任AI基金的常务总经理合伙人,近日宣布加入亚马逊公司的董事会。Andrew Ng博士在人工智能和机器学习领域有着举足轻重的影响力,此前曾是谷歌大脑项目创始人之一,并在百度担任首...

Read More
2024-04-15 talkingdev

Gemma和Siglip推出VLLM,利用LAION和LLaVA数据集进行训练

Gemma和Siglip最近发布了一款小型但功能强大的视觉语言模型(VLLM),该模型专为理解和生成与图像相关联的语言而设计。VLLM利用大规模的LAION和LLaVA数据集进行训练,这些数据集包含了大量的图像和相关文本信息,使...

Read More
2024-04-15 talkingdev

BabyLM挑战赛:探索用婴儿级数据训练顶级文本与视觉模型

近期,科技界发起了一项名为BabyLM的挑战,旨在推动研究人员和开发者在极度有限的数据条件下,训练出性能卓越的文本和视觉模型。这一挑战的核心理念是模仿人类婴儿在成长初期所接触到的数据量,大约为1000万个token...

Read More
2024-04-15 talkingdev

Meta研究人员认为AI需要“身体”才能实现真正智能

Meta AI研究团队提出了体现假设,认为AI要实现真正的智能,必须具备物理形态以进行感官和环境互动。为此,Meta推出了更新版的模拟平台AI Habitat 3.0,该平台旨在通过在模拟环境中为AI配备虚拟身体来缩小模拟与现实...

Read More
2024-04-15 talkingdev

离散扩散实现:开源高效稳定训练代码

近期,一个名为“离散扩散实现”的项目在GitHub上引起了广泛关注。该项目提供了一种简洁的离散扩散算法实现方式,包含了众多最新的技术组件。这种新型算法不仅训练速度快,而且稳定性强,能够很好地适应各种复杂的数据...

Read More
2024-04-15 talkingdev

直接从文本生成360度全景图像开源

最近,一个名为PanFusion的项目引起了业界的广泛关注。该项目采用了一种双分支扩散模型,可以直接从文本提示生成360度全景图像。该方法结合了稳定的扩散技术和专门的全景分支,并通过独特的交叉注意力机制来减少图像...

Read More
2024-04-15 talkingdev

Jina AI阅读器开源:将网页转换为LLM友好的Markdown格式

Jina AI最新推出了一款名为'LLM friendly HTML conversion'的GitHub项目,该项目旨在将网络链接转换为适用于大型语言模型(LLM)的友好Markdown格式。这一工具的开发,将极大地便利开发者和研究者利用LLM进行各种任...

Read More
2024-04-15 talkingdev

论文-DGMamba框架:采用状态空间模型应对领域泛化挑战

DGMamba框架是一种创新的技术,它利用状态空间模型Mamba来解决领域泛化中的挑战。状态空间模型是一种先进的机器学习方法,通过将系统状态表示为一组变量,并预测其在时间上的演变,从而提高模型的泛化能力和对新场景...

Read More
  1. Prev Page
  2. 734
  3. 735
  4. 736
  5. Next Page