El usuario Achilles1089 ha subido a Hugging Face un modelo híbrido "fable y opus 4.8" sin censura, afirmando que los números demuestran su efectividad.
El modelo es.
El usuario Achilles1089 ha subido a Hugging Face un modelo híbrido "fable y opus 4.8" sin censura, afirmando que los números demuestran su efectividad.
El modelo es.
El equipo de Qwen de Alibaba ha anunciado Qwen 3.8 Max, un nuevo modelo insignia de 2.4T parámetros centrado en codificación, trabajo agénico a largo plazo y razonamiento multimodal. La compañía confirmó que las versiones de pesos abiertos tanto de Qwen 3.8 Max como del más pequeño Qwen 3.8-27B se lanzarán la próxima semana.
Alibaba anunció el lanzamiento de peso abierto de Qwen3.8, un modelo de 2,4 billones de parámetros, mientras también liberaba como código abierto su pila de software del chip AI Zhenwu para reducir la dependencia del ecosistema CUDA de Nvidia.
Los proveedores de LLM actualmente subvencian el costoso uso de la API para construir ecosistemas, planeando aumentar los precios más adelante. A medida que disminuyen las subvenciones, los usuarios pueden enfrentar aumentos de precios pronunciados—como $2k por mes—haciendo el acceso costoso y amenazando la adopción generalizada, especialmente para individuos que dependen de hardware asequible para ejecutar modelos.
Un usuario comparte configuraciones optimizadas para ejecutar Qwen 3.6 27B con cuantización Q8_0 en una configuración de RTX 4090 y RTX 3090 usando llama.cpp. La configuración incluye tensor split, 999 capas en GPU, contexto de 250k, decodificación especulativa y caché KV unificada, logrando un rendimiento de 75-100t/s con soporte para visión y MTP.
Los recientes lanzamientos de modelos de IA muestran que los modelos de alta inteligencia y bajo costo están cada vez más dominados por modelos de peso abierto como DeepSeek, Qwen, GLM, Kimi y MiniMax. Para la mayoría de las aplicaciones del mundo real, la brecha de rendimiento entre los modelos cerrados de vanguardia y los fuertes modelos abiertos se está reduciendo más rápido que las diferencias de costo, haciendo que los modelos abiertos sean competitivos en términos de capacidad y precio.
Usamos cookies para medir el tráfico y mejorar el sitio. Puedes aceptar o rechazar las cookies de analítica. Política de privacidad