O NanoMaestro Realtime é um modelo de música IA de 50MB com 13M de parâmetros que gera música de piano em tempo real usando uma LSTM de 2 camadas. Ele roda localmente no navegador via ONNX e Transformers.js com WASM, não requer GPU ou backend de servidor, e funciona em modelos mais antigos do Raspberry Pi.
Modelo de Música IA roda em tempo real na maioria das CPUs no navegador
Gradio lança Workflow1111, reconstruindo recursos do AUTOMATIC1111 como um grafo Gradio
O Gradio lançou o Workflow1111, um projeto que reconstrói a maioria do conjunto de recursos do stable-diffusion-webui do AUTOMATIC1111 usando o framework gr.Workflow. O aplicativo consiste em uma única tela contendo onze pipelines de mídia construídos a partir de setenta e três nós, abrangendo texto-para-imagem, imagem-para-vídeo e várias tarefas de pré-processamento.
OpenEnv reproduz modelo de pintura em aquarela de Surya Narreddi usando TRL
Um engenheiro abriu o código-fonte de uma reprodução do projeto viral de Surya Narreddi, que treina um modelo de codificação para pintar aquarelas usando JavaScript e aprendizado por reforço. A implementação utiliza a biblioteca TRL e OpenEnv para criar um pipeline de ponta a ponta no Hugging Face para treinamento, pontuação e inferência.
Diffusers adiciona suporte nativo à inferência Nunchaku Lite de 4 bits
O Hugging Face Diffusers agora suporta o carregamento nativo de checkpoints do Nunchaku Lite por meio de `from_pretrained()`, eliminando a necessidade de um mecanismo de inferência separado ou compilação CUDA local. Essa integração utiliza o método SVDQuant para executar camadas de transformador com pesos e ativações de 4 bits (W4A4), reduzindo significativamente o uso de memória enquanto melhora a velocidade de inferência.
NVIDIA NeMo Automodel permite ajuste fino distribuído de modelos de difusão com Diffusers do Hugging Face
A NVIDIA e a Hugging Face integraram o NVIDIA NeMo Automodel à biblioteca 🤗 Diffusers para fornecer treinamento distribuído de nível de produção para modelos de difusão de código aberto. Essa colaboração permite que os usuários ajustem qualquer modelo no formato Diffusers do Hugging Face Hub sem exigir conversão de checkpoints ou reescrita do código do modelo.
Simon Willison cria um pet personalizado para o Codex Desktop usando GPT-5.6 e gpt-image-2
Simon Willison demonstra como criar um "pet" animado personalizado para o aplicativo Codex Desktop aproveitando o modelo Sol da OpenAI GPT-5.6 e a API gpt-image-2.