Todos os artigos — korshunov.ai

Todos os artigos Página 1 / 13

Lançamento b9842 do llama.cpp: predefinição de deduplicação e entradas de modelo em cache em /v1/models

O lançamento b9842 do llama.cpp introduz uma alteração para duplicar entradas de predefinição e modelos em cache no endpoint /v1/models. Esta atualização é aprovada por Adrien Gallouët, da Hugging Face.

lab Meta AI / FAIR Blog · há 3 d

Brain2Qwerty v2 Alcança 61% de Precisão em Decodificação Não Invasiva de Cérebro para Texto

Pesquisadores lançaram o Brain2Qwerty v2, um pipeline de IA não invasivo que decodifica frases em tempo real a partir de gravações de magnetoencefalografia (MEG) sem implantes cirúrgicos. O sistema alcança uma taxa de precisão de palavras de 61% no geral e até 78% para os melhores participantes, superando significativamente métodos não invasivos anteriores.

github llama.cpp · há 3 d

Lançamento b9840 do llama.cpp adiciona suporte ao DeepSeek V4 e binários multiplataforma

O lançamento b9840 do llama.cpp introduz suporte à conversão para o modelo DeepSeek V4, incluindo tratamento específico para a variante Pro. Esta atualização integra a nova arquitetura na biblioteca junto com várias otimizações internas e correções de bugs.

lab OpenAI News · há 3 d

Mapeando a Oportunidade da Força de Trabalho de IA na Europa

A OpenAI Economic Research estendeu seu Framework de Transição de Empregos de IA à União Europeia, utilizando a taxonomia ESCO e dados do Eurostat para analisar como as capacidades de IA podem remodelar os mercados de trabalho em todos os estados-membros.

github llama.cpp · há 3 d

Lançamento b9839 do llama.cpp com correção de varredura Tailwind e binários multiplataforma

O projeto llama.cpp lançou a versão b9839, que inclui uma correção para restaurar a varredura Tailwind em worktrees ignorados. Esta atualização fornece binários pré-compilados para macOS, Linux, Android, Windows e openEuler em várias arquiteturas e backends de aceleração de hardware.

github llama.cpp · há 3 d

Lançamento b9838 do llama.cpp: Builds para macOS, Linux, Windows e Android

O projeto llama.cpp lançou a versão b9838, fornecendo binários pré-compilados para uma ampla gama de sistemas operacionais e aceleradores de hardware. Este lançamento inclui suporte para CPU, GPU (CUDA, Vulkan, ROCm, OpenCL) e aceleradores de IA especializados em macOS, Linux, Windows, Android e openEuler.

lab OpenAI News · há 3 d

HP Inc. lança parceria estratégica Frontier com a OpenAI

A HP Inc. está ampliando sua parceria estratégica com a OpenAI após pilotos bem-sucedidos, implementando IA em experiências do cliente, produtividade dos funcionários e desenvolvimento de software. A empresa utiliza a plataforma OpenAI Frontier como um modelo operacional unificado para governar contexto, permissões e avaliação à medida que avança de casos de uso experimentais para produção em toda a empresa.

github llama.cpp · há 3 d

Lançamento do llama.cpp b9837 adiciona sinalizador --reasoning-preserve e novos binários

O projeto llama.cpp lançou a versão b9837, que introduz um novo sinalizador `--reasoning-preserve` para o modelo de chat Jinja, a fim de reter tokens de raciocínio. Esta atualização também inclui mensagens de ajuda corrigidas e fornece binários pré-compilados para macOS, Linux, Windows, Android e openEuler em vários backends de hardware.

github llama.cpp · há 3 d

Lançamento b9835 do llama.cpp com correções de parada na interface e pulso de raciocínio

O projeto llama.cpp lançou a versão b9835, que inclui uma correção para a funcionalidade de parada e pulso de raciocínio no modo de modelo único. Esta atualização aborda problemas específicos dentro da interface do usuário para melhorar o controle durante a inferência do modelo.

github llama.cpp · há 3 d

Lançamento b9833 do llama.cpp: Parser para MiniCPM5 e binários multi-plataforma

O projeto llama.cpp lançou a versão b9833, introduzindo um parser dedicado para o modelo MiniCPM5 junto com várias correções de bugs e refatorações. Esta atualização inclui suporte para parsing de chamadas de ferramenta, simplificação de gramática e correção do comportamento da API Jinja para garantir compatibilidade com os padrões Jinja2.

github llama.cpp · há 3 d

Lançamento b9832 do llama.cpp adiciona flag de depuração --dump-prog

O projeto llama.cpp lançou a versão b9832, introduzindo uma nova opção de linha de comando `--dump-prog` para o mecanismo de template Jinja, visando auxiliar na depuração. Esta atualização também inclui binários pré-compilados para macOS, Linux, Android, Windows e openEuler em várias arquiteturas de CPU e GPU.

github llama.cpp · há 4 d

Lançamento b9831 do llama.cpp adiciona suporte ao DFlash e novos binários

O lançamento b9831 do llama.cpp introduz o suporte ao DFlash v2, incluindo atenção de janela deslizante por tipos de camada, juntamente com um conjunto abrangente de binários pré-compilados para várias plataformas.

github llama.cpp · há 4 d

lançamento b9830 do llama.cpp adiciona sinalizador --offline e corrige bug de memória

O lançamento b9830 do llama.cpp introduz a capacidade de usar o sinalizador --offline com o comando llama download, permitindo que scripts verifiquem modelos em cache sem acesso à rede. Esta atualização também resolve uma vulnerabilidade latente de uso após liberação no callback on_done da tarefa URL, onde first_path estava sendo capturado incorretamente por referência.

github llama.cpp · há 4 d

Lançamento b9829 do llama.cpp: Redução de Logs e Binários Multiplataforma

O projeto llama.cpp lançou a versão b9829, que inclui uma redução da saída de logs no servidor, componentes comuns e módulos de decodificação especulativa. Esta atualização também padroniza as convenções de nomenclatura, substituindo CMN_ por COM_.

github llama.cpp · há 4 d

Lançamento b9828 do llama.cpp: Melhorias no Flash Attention via OpenCL e novos binários

O lançamento b9828 do llama.cpp introduz melhorias significativas no OpenCL, reestruturando especificamente os kernels do Flash Attention para precisão f16 e f32. Esta atualização inclui novos kernels de pré-prefill e suporte para formatos de quantização q4_0 e q8_0.

github llama.cpp · há 5 d

lançamento b9827 do llama.cpp adiciona otimização de cópia assíncrona 2D do CUDA

O lançamento b9827 do llama.cpp introduz uma otimização de desempenho para o CUDA, adicionando um caminho rápido cudaMemcpy2DAsync à função ggml_cuda_cpy. Esta alteração acelera cópias em stride com mesmo tipo e mesma forma, onde os tensores não são totalmente contíguos, mas cada linha é contígua, substituindo kernels de cópia escalar elemento a elemento mais lentos.

github llama.cpp · há 5 d

Lançamento b9825 do llama.cpp: Correção de Vulkan e Binários Multiplataforma

O projeto llama.cpp lançou a versão b9825, que inclui uma correção para o operador de etapa do Vulkan ao lidar com entradas zero. Esta atualização fornece binários pré-compilados para macOS, Linux, Windows, Android e openEuler em vários backends de hardware.

github llama.cpp · há 5 d

Lançamento b9826 do llama.cpp com correção de norma SYCL

O projeto llama.cpp publicou o lançamento b9826, que inclui uma correção para casos de teste unitários falhos relacionados à função norm no SYCL. Esta atualização fornece binários pré-compilados e frameworks em múltiplas plataformas e aceleradores de hardware.

github CrewAI · há 5 d

Notas de Lançamento do crewAI 1.15.1

A atualização da versão 1.15.1 do crewAI introduz novos recursos para inicialização e implantação de projetos, além de várias correções de bugs e melhorias na documentação.

github llama.cpp · há 5 d

lançamento b9822 do llama.cpp com binários para macOS, Linux e Windows

O projeto llama.cpp publicou o lançamento b9822, fornecendo binários pré-compilados para macOS, iOS, Linux, Android e Windows. Esta atualização inclui uma correção para a opção --no-common do test-chat-template e distribui builds para várias arquiteturas de hardware e aceleradores.