NanoMaestro Realtime是一个50MB的AI音乐模型,拥有13M参数,使用2层LSTM实时生成钢琴音乐。它通过ONNX和Transformers.js与WASM在浏览器本地运行,无需GPU或服务器后端,并可在较旧的树莓派型号上工作。
media
Hugging Face Forums
·
80 天前
·
open_models
AI音乐模型在浏览器中实时运行于大多数CPU
译自 English → 中文
相关文章
lab
Hugging Face Blog
·
刚刚
实时
Gradio 发布 Workflow1111,将 AUTOMATIC1111 功能重建为 Gradio 图
Gradio 发布了 Workflow1111,该项目使用 gr.Workflow 框架重建了 AUTOMATIC1111 的 stable-diffusion-webui 的大部分功能集。该应用程序由一个包含十一个媒体管道的单一画布组成,这些管道由七十三节点构建,涵盖文生图、图生视频以及各种预处理任务。
lab
Hugging Face Blog
·
7 天前
·
5 次浏览
OpenEnv 使用 TRL 复现 Surya Narreddi 的水彩画模型
一名工程师开源了对 Surya Narreddi 的病毒式传播项目的复现,该项目训练一个编码模型使用 JavaScript 和强化学习来绘制水彩画。该实现利用 TRL 库和 OpenEnv 在 Hugging Face 上创建用于训练、评分和推理的端到端管道。
lab
Hugging Face Blog
·
49 天前
·
14 次浏览
Diffusers 新增原生 Nunchaku Lite 4-bit 推理支持
Hugging Face Diffusers 现在支持通过 `from_pretrained()` 原生加载 Nunchaku Lite 检查点,无需单独的推理引擎或本地 CUDA 编译。此集成利用 SVDQuant 方法运行具有 4-bit 权重和激活值(W4A4)的 Transformer 层,在显著降低内存使用的同时提高了推理速度。
lab
Hugging Face Blog
·
55 天前
·
13 次浏览
NVIDIA NeMo Automodel 借助 Hugging Face Diffusers 实现分布式扩散模型微调
NVIDIA 与 Hugging Face 已将 NVIDIA NeMo Automodel 集成至 🤗 Diffusers 库,为开源扩散模型提供生产级分布式训练。此次合作使用户能够在 Hugging Face Hub 上微调任何 Diffusers 格式模型,无需进行检查点转换或重写模型代码。
blog
Simon Willison
·
58 天前
·
3 次浏览
Simon Willison 使用 GPT-5.6 和 gpt-image-2 为 Codex Desktop 创建自定义宠物
Simon Willison 演示了如何利用 OpenAI 的 GPT-5.6 Sol 模型和 gpt-image-2 API,为 Codex Desktop 应用程序创建自定义动画“宠物”。