漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2025-01-24 talkingdev

开源无头浏览器Lightpanda:基于Zig语言的全新解决方案

近日,一款名为Lightpanda的开源无头浏览器引起了技术社区的广泛关注。Lightpanda采用Zig语言开发,旨在为开发者提供一个高效、轻量级的浏览器自动化工具。无头浏览器通常用于自动化测试、网页抓取和性能分析等场景...

Read More
2025-01-24 talkingdev

Virtuoso Small性能超越Phi 4,实际应用表现更优

近日,Virtuoso Small在性能测试中表现优异,成功超越新发布的Phi 4模型。尽管两者在权重数量上相同,但Virtuoso Small在基准测试中得分更高,尤其是在实际任务中表现更为出色。Phi模型依赖的合成数据在某些场景下可...

Read More
2025-01-24 talkingdev

Integuru:AI驱动的API逆向工程工具,自动化生成Python集成代码

Integuru是一款基于AI技术的工具,能够逆向解析平台内部API并生成Python集成代码。通过分析浏览器的网络请求和依赖关系,Integuru可以自动化执行诸如下载资源等操作。用户只需提供提示和.har文件,即可生成所需的可...

Read More
2025-01-24 talkingdev

开源推荐:评估蒸馏LLM的双重量化指标

近日,GitHub上发布了一个专注于评估蒸馏LLM(Large Language Models)性能的开源项目。该项目提供了两种互补的量化指标,旨在帮助研究人员和开发者更精确地衡量LLM蒸馏的效果。蒸馏技术是一种通过将大型模型的知识...

Read More
2025-01-24 talkingdev

论文:FREEFORM框架利用LLM优化基因型数据特征选择与工程

近日,一项名为FREEFORM的创新框架引起了科学界的广泛关注。该框架通过利用大型语言模型(LLM)来优化基因型数据的特征选择与工程,从而更准确地预测遗传表型。FREEFORM的核心优势在于其能够自动识别和提取与特定表...

Read More
2025-01-24 talkingdev

LOKI:多模态检测模型的合成基准测试

LOKI 是一个用于评估视觉语言模型(VLMs)在检测新颖和具有挑战性项目方面表现的合成基准测试工具。该基准测试通过生成复杂的多模态数据,帮助研究人员更好地理解模型在处理未知或复杂场景时的能力。LOKI 的设计旨在...

Read More
2025-01-24 talkingdev

Luma AI发布Ray2:新一代大规模视频生成模型

Luma AI近日发布了其最新的大规模视频生成模型Ray2,该模型在真实视觉效果、自然连贯的运动以及逻辑事件序列方面设定了新的标准。Ray2基于Luma全新的多模态架构进行训练,计算能力较前代Ray1提升了10倍。目前,Ray2...

Read More
2025-01-24 talkingdev

OpenAI推出全新AI代理Operator,实现浏览器自动化操作

OpenAI近日发布了名为Operator的全新AI代理,该代理能够通过与浏览器交互,执行诸如输入、点击和滚动等操作。Operator基于Computer-Using Agent (CUA)模型,结合了GPT-4的视觉能力和强化学习技术,使其能够在图形界...

Read More
  1. Prev Page
  2. 129
  3. 130
  4. 131
  5. Next Page