语言模型(LLMs)的实用性在于其速度、准确性以及遵循指令的能力。这三个特性使得通过文本输入控制的街头霸王模拟器成为了衡量不同模型在这三个方面表现的绝佳方式。GitHub上的一个项目通过这种方式为LLMs提供了一个...
Read More随着人工智能的蓬勃发展,行业内的人才争夺战达到了前所未有的激烈程度。企业为了吸引具备开发生成性AI技术的专业知识和经验的人才,提供了百万美元的年薪和加快股票归属时间表等丰厚待遇。与此同时,科技行业的其他...
Read More近期,由Anthropic开发的最新人工智能模型Claude-3在高级认知任务上的表现超越了普通人类智商,并且在某些领域胜过了业界知名的GPT-4模型。然而,尽管在这些复杂任务上表现出色,Claude-3在处理一些人类认为简单的谜...
Read More尽管AI技术日益进步,谷歌搜索的地位似乎并未受到太大威胁。谷歌搜索不仅复杂,而且用户需求多样化。虽然基于大型语言模型的AI工具在某些特定情况下可能比谷歌的搜索结果更有用,但对于大多数用例而言,AI仍难以取代...
Read More在这篇访谈中,我们深入探讨了David Luan的职业历程,他曾是OpenAI的早期员工、Google大型语言模型项目的领导者之一,以及Google Brain的共同领导。Luan也是Adept的创始人,该公司是AI代理领域的佼佼者。他分享了在...
Read MoreCerebras公司近日推出了其最新款的CS3晶圆芯片,该芯片具备训练高达24T参数语言模型的能力。CS3芯片的发布,标志着在人工智能领域对高性能计算芯片的需求得到了进一步的满足。这款芯片原生支持PyTorch,使得开发者能...
Read More研究人员开发了一种名为“Quiet-STaR”的新技术,通过赋予AI系统“内心独白”,显著提升了其在推理测试中的性能。该技术已经被应用于Mistral 7B语言模型,并且取得了令人瞩目的效果。这一项技术的进步意味着AI系统能够更...
Read MoreDatabricks Mosaic团队在语言模型训练领域不断创新。在最近的一篇文章中,他们讨论了用于fp8训练的训练技术栈,以及通过降低精度所带来的一些优势。fp8作为一种新兴的计算精度格式,能够在保持足够精度的同时,大幅...
Read More近期,微软对Inflection人才的收购再次激起了关于科技巨头公司在人工智能发展中控制过度的争论。虽然这些公司拥有的资源可以在核心语言模型上快速取得进展,但人们对于权力集中可能限制创新和透明度的担忧是有道理的...
Read MoreMistral公司近期举办了一场黑客马拉松活动,并在此期间宣布了其7B语言模型的v0.2版本。同时,Mistral还发布了如何对其语言模型进行微调的代码。这些代码编写得整洁而简明,易于理解和使用。微调代码的发布,将有助于...
Read More