漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2025-05-25 talkingdev

[复古创意]Linux内核驱动将老式转盘电话改成输入设备

开发者Stefan Wiehler近日开源了一个颇具创意的Linux内核驱动项目,可将老式转盘电话的机械拨号盘转变为标准的evdev输入设备。该项目不仅实现了模拟数字键盘输入的功能,更承载着特殊的技术意义:它既是作者进入嵌入...

Read More
2025-05-21 talkingdev

Fastino推出TLMs:专精任务的语言模型,性能超越LLMs

在人工智能领域,通用大模型(LLMs)虽然功能强大,但对于特定任务而言,其庞大的计算资源消耗和较高的成本并不总是最优选择。为此,Fastino公司推出了专精任务的语言模型(TLMs),旨在为特定任务提供更高效、更精...

Read More
2025-05-21 talkingdev

谷歌发布Veo 3、Imagen 4及影视制作新工具Flow,生成式媒体模型再升级

在2025年谷歌I/O大会上,谷歌正式推出新一代生成式媒体模型Veo 3和Imagen 4,以及专为影视制作设计的新工具Flow。Veo 3作为视频生成模型的迭代版本,在动态细节和场景连贯性上实现突破;Imagen 4则进一步提升了文本...

Read More
2025-05-05 talkingdev

现代LLM采样技术入门指南:从原理到实践

一篇题为《Dummy's Guide to Modern LLM Sampling》的技术指南近期在开发者社区引发热议,该文章系统性地解读了现代大语言模型(LLM)中的采样技术。作为自然语言生成的核心组件,采样策略直接决定了文本输出的质量和...

Read More
2025-05-03 talkingdev

Suno v4.5发布:探索音乐创作新风格

音乐生成技术平台Suno近日发布了其最新版本v4.5,该版本进一步拓展了AI音乐创作的边界,为用户提供了更多样化的音乐风格选择。Suno v4.5的发布在技术社区引发了广泛关注,相关讨论在Hacker News上获得了278个点赞和1...

Read More
2025-04-30 talkingdev

CogView 4图像生成模型发布:性能超越Flux模型,开放许可引关注

清华大学知识工程组(KEG)与智谱AI联合推出的CogView 4最新一代生成式图像模型近日在Hugging Face平台正式发布。作为采用宽松许可协议的开源项目,该模型在图像质量、生成效率和多模态理解等核心指标上显著超越当前...

Read More
2025-04-26 talkingdev

开发者利用OpenAI图像API打造个性化涂色书服务

一位开发者长期以来的创意构想终于得以实现——通过OpenAI最新发布的图像API,将家庭照片转化为可爱的涂色书图案,并整合印刷服务完成个性化定制。该项目最初尝试使用OpenAI的Sora工具手动处理图片,但单本书籍需耗时...

Read More
2025-04-25 talkingdev

Adobe重磅推出Firefly升级版:统一图像、视频、音频及矢量生成工具

Adobe近日发布了Firefly的重大更新,此次更新不仅整合了图像、视频、音频及矢量生成工具,还新增了移动端支持,并进一步深化了与Creative Cloud的集成。这一举措标志着Adobe在创意AI领域的又一重要突破,为设计师和...

Read More
  1. Prev Page
  2. 3
  3. 4
  4. 5
  5. Next Page