开源代码审查工具PR-AF在权威基准测试Code-Review-Bench的42款工具中冲至第2名,以显著优势领先成熟的商业方案,且单次审查成本仅为后者的十分之一。该工具的核心创新在于其“审查管线”架构:它会为每个Pull Request...
Read More在文本处理领域中,大小写折叠是一项确保仅大小写不同字符串被视为相同的操作,对于代码搜索这类对精度与召回率要求极高的场景尤为关键。然而,在海量数据规模下高效实现这一操作是巨大的工程挑战。GitHub代码搜索引...
Read MoreEpoch AI推出了名为MirrorCode的基准测试,专门用于评估人工智能在长周期编程任务中的自主重写能力。该基准要求AI模型在完全无法访问原始源代码的情况下,从零开始重新实现完整的软件程序,以此衡量AI在复杂、持续性...
Read More人工智能公司SpaceXAI(xAI)旗下的命令行工具Grok Build近日陷入严重的隐私争议。开发者社区发现,该工具在未经用户明确同意的情况下,将本地代码仓库上传至Google Cloud存储桶,引发对数据安全与用户隐私的强烈担...
Read More本周,由 Y Combinator 背书的保险科技初创公司 Corgi 再次陷入争议漩涡。开源项目 Papermark 公开指责 Corgi 未经授权使用其开源软件代码,并声称 Corgi 将这些代码用于自身商业产品的开发,且未给予适当的署名或遵...
Read MoreMorph LLM近期发布了一系列针对开源代码生成模型的优化技术,旨在解决当前推理效率瓶颈。首先,团队通过训练一个专注于模型自身编码输出(而非通用互联网数据)的“起草模型”(drafter),在投机解码中取得了显著加速...
Read MoreGitHub作为全球最大的代码托管平台,其开放性也为网络攻击提供了可乘之机。近日,安全研究人员披露了一起大规模恶意软件分发行动,攻击者在GitHub上创建了超过10,000个独立仓库,这些仓库虽然来自不同的贡献者、拥有...
Read More近日,一位独立开发者分享了一项极具工程教育意义的项目:从零开始构建一个“复古风格”的大语言模型(LLM)。项目不仅涵盖了基础训练与微调脚本的自主编写,还包括完整的数据处理管线以及定制数据集的构建。令人瞩目...
Read More