ByteDance ha anunciado su compromiso de desarrollar su próximo modelo de IA sin depender de técnicas de destilación de IA.
La empresa tiene la intención de seguir un camino de desarrollo independiente para sus futuros modelos.
ByteDance ha anunciado su compromiso de desarrollar su próximo modelo de IA sin depender de técnicas de destilación de IA.
La empresa tiene la intención de seguir un camino de desarrollo independiente para sus futuros modelos.
MiniMax lanzó el modelo omnimodal de generación de video H3 con pesos abiertos en Hugging Face, que cuenta con audio estéreo nativo capaz de impulsar el video en un solo paso hacia adelante. El modelo admite resolución 2K a 24 fps para clips de 5 a 15 segundos y acepta hasta nueve imágenes de referencia, tres videos y tres clips de audio por generación.
Los investigadores proponen la Auto-Distilación No Supervisada en Política (U-OPSD), un método que logra una mejora post-entrenamiento para modelos de lenguaje grandes utilizando únicamente las propias generaciones del modelo sin supervisión externa. El enfoque muestrea múltiples trayectorias para construir una pseudo-solución mediante votación mayoritaria, luego destila una distribución docente en los prefijos de la finalización incorrecta más larga del modelo.
Douyin ha publicado el informe técnico de su modelo de Incrustación Multimodal (DME), que combina preentrenamiento contrastivo a gran escala con razonamiento latente para lograr una fuerte discriminación y eficiencia.
Apple ha presentado una nueva arquitectura para sus modelos base de tercera generación (AFM3) que utiliza "Poda de Seguimiento de Instrucciones" para reducir significativamente el conteo de parámetros activos. El modelo está diseñado para activar aproximadamente el 20% de sus capas MLP tomando decisiones de enrutamiento una vez por prompt en lugar de por token.
El equipo de NeMo de NVIDIA ha lanzado Molt, un framework de aprendizaje por refuerzo agéntico de código abierto diseñado para reducir la complejidad de la iteración de algoritmos para investigadores. La base de código tiene aproximadamente 8.6K líneas de código RL, significativamente menor que frameworks comparables como verl (62K líneas) y slime (25K líneas).
Usamos cookies para medir el tráfico y mejorar el sitio. Puedes aceptar o rechazar las cookies de analítica. Política de privacidad