WhisperKit是一个用Swift编写的开源库,它将OpenAI的Whisper语音识别模型与Apple的CoreML框架集成,以在Apple设备上进行高效的本地推理。它可以通过Swift Package Manager集成到Swift项目中。WhisperKit会自动下载推...
Read More本周,Mistral公司的CEO确认了Mistral的一个量化版本文件在HuggingFace上泄露,该技术使得在较弱的电脑和芯片上运行某些AI模型成为可能。据报道,该模型在EQ-Bench上超过了全球所有其他LLM模型,仅次于GPT-4。Mistra...
Read MoreTaskingAI是一款开源的AI应用程序开发平台,旨在帮助开发者更快地创建AI原生应用程序。它提供了一系列的API和工具,使开发者可以快速构建基于AI的应用程序,例如自然语言处理、计算机视觉和语音识别。TaskingAI还支...
Read MoreProton是一个由ClickHouse驱动的流式SQL引擎,可帮助开发人员解决流式数据处理、路由和分析挑战,并将聚合数据发送到下游系统。Proton快速轻量,是Kafka或Redpanda的最佳流式SQL引擎。该项目提供了演示视频。
Read MorePix2Gestalt是一种针对零样本全景分割的框架。它擅长在部分遮挡的情况下重建完整的物体形状和外观。利用大规模扩散模型,Pix2Gestalt在挑战性场景中表现出色,包括那些不符合通常模式的艺术图像。Pix2Gestalt的创新...
Read More许多组织正在努力应对快速发展的人工智能技术所带来的挑战。其中一些举措可能被视为反竞争。这是一个复杂的问题,双方都有有效的论点。AI安全组织是否想禁止开源? 这个问题涉及到很多方面,例如数据隐私、知识产权等...
Read More最近,一款基于Phi-2和SigLIP训练的多模态模型Imp v1 3B发布了。该模型在性能上表现极为出色,并且体积小,足以在设备上运行。Imp v1 3B的发布,对于未来的多模态研究和应用具有重要意义。目前,该模型的开源代码已...
Read MoreLLM Steer是一个用于使用情感向量控制语言模型生成的库。这意味着您可以嵌入一个诸如“深思熟虑”的概念,并使生成变得更加深思熟虑。一般而言,它的效果要比提示更好,但需要进行更多的研究。
Read More