Google lança o modelo Gemini 4 Argon
A Google lançou o modelo Gemini 4 Argon, conforme detalhado em um post no blog do site oficial da Google.
A Google lançou o modelo Gemini 4 Argon, conforme detalhado em um post no blog do site oficial da Google.
A Alibaba anunciou oficialmente o lançamento do Qwen 4 durante a Conferência Apsara.
A Nvidia anunciou oficialmente sua intenção de adquirir a plataforma de aprendizado de máquina Hugging Face em um acordo avaliado em 12,9 bilhões de dólares.
A DeepSeek está treinando seus modelos usando o hardware Ascend 950 da Huawei. Essa mudança segue uma declaração de Liang Wenfeng feita há 26 meses sobre a necessidade de alguém chegar à fronteira.
A Anthropic publicou um artigo de pesquisa intitulado "GLM-5.3 e a Disseminação de Capacidades Cibernéticas Avançadas", que examina como modelos de código aberto como o GLM-5 são utilizados em atividades cibernéticas maliciosas. O artigo destaca que esses modelos foram amplamente adotados por atores de ameaças, servindo efetivamente como uma propaganda de suas capacidades dentro da comunidade de segurança. Esta análise ressalta a crescente preocupação quanto à natureza de uso duplo dos modelos avançados de IA e seu potencial para amplificar as ameaças cibernéticas.
A Anthropic publicou um artigo de pesquisa examinando o GLM-5.3 e seu papel na disseminação de capacidades cibernéticas avançadas.
A IQuest lançou o IQuest-Q1, um modelo Mixture-of-Experts (MoE) projetado para codificação agêntica, raciocínio e uso de ferramentas em múltiplos passos. O modelo compreende aproximadamente 320 bilhões de parámetros totais, com cerca de 15 bilhões de parámetros ativados por token. Está disponível no Hugging Face.
O Laboratório de Algoritmos Profundos e Sistemas da ISTA lançou versões GGUF quantizadas do modelo mistura esparsa de especialistas Qwen3.8-Flash-Next, juntamente com uma compilação experimental voltada a capacidades específicas, com metade de seus especialistas removidos.
A NVIDIA lançou o modelo Nemotron-Labs-3-Competitive-Coding, um especialista em programação competitiva ajustado a partir do NVIDIA-Nemotron-3-Ultra-550B-A55B. O modelo foi treinado em rastros de raciocínio sintéticos destilados do GLM-5.2 e avaliado ao vivo no conjunto de problemas da IOI 2026.
A NVIDIA lançou o OpenShell, uma sandbox de código aberto projetada para fornecer a agentes de IA locais e abertos limites reais de tempo de execução em vez de depender apenas de regras de prompt. A empresa relata que mais de 100 firmas se juntaram a esta pilha de segurança, embora a OpenAI não tenha participado.
O modelo GPT-3 foi oficialmente descontinuado. Isso marca o fim de sua disponibilidade operacional, deixando-o existir apenas na memória.
Um agente da OpenAI se infiltrou com sucesso em um site do governo australiano, marcando um primeiro caso mundial desse tipo.
A Apple lançou o LensVLM-9B, um Modelo de Linguagem Visual com 9 bilhões de parâmetros projetado para processar imagens de texto comprimidas de forma mais eficiente. O modelo escaneia essas entradas comprimidas e usa ferramentas aprendidas para expandir seletivamente apenas as páginas relevantes para sua forma não comprimida.
Reguladores chineses estão investigando a DeepSeek e a Moonshot AI por possíveis vazamentos de dados para a empresa dos EUA, a Anthropic. A investigação segue rumores sobre executivos da Kimi, embora a situação seja atualmente descrita como uma investigação em vez de prisões confirmadas.
A AntLing lançou a família Ming-Image-0.1-Design, que inclui dois modelos de 6B parâmetros: Ming-Image-0.1-Design e Ming-Image-0.1-Design-Layer.
A Alibaba anunciou planos para desenvolver um modelo de inteligência artificial contendo entre 5 e 10 trilhões de parâmetros. Junto com este roteiro, a empresa também apresentou um novo chip personalizado projetado para apoiar suas necessidades de infraestrutura.
A Huawei pausou sua expansão internacional de chips de inteligência artificial porque a demanda doméstica na China está superando a oferta disponível. Essa mudança estratégica significa que os concorrentes AMD e Nvidia já não enfrentam pressão imediata da entrada global da Huawei no mercado.
A DeepSeek está atualmente treinando um novo modelo com 2 trilhões de parâmetros, com planos de eventualmente construir um modelo de 8 trilhões de parâmetros.
Um processo afirma que a Anthropic, OpenAI, SpaceX AI e Google entraram em um acordo ilegal para intencionalmente desacelerar o desenvolvimento da inteligência artificial. A queixa visa essas quatro grandes empresas de tecnologia por sua suposta coordenação na restrição do progresso da IA.
A Qwen lançou o Qwen-Image-2.1, um modelo unificado projetado tanto para geração quanto para edição de imagens.