Un desarrollador informa que está utilizando GLM-5.3 Flash internamente para tareas de ingeniería de software en un entorno de producción grande con millones de líneas de código, reemplazando modelos de vanguardia.
El modelo maneja bien los repositorios grandes, comprende la arquitectura existente y rastrea el código a través de múltiples módulos para producir implementaciones sólidas con mínima guía. Rinde fuertemente en la exploración del repositorio, implementación de características y refactorización, ofreciendo una impresionante relación velocidad-calidad para cargas de trabajo de ingeniería de software del mundo real.
El autor está interesado en los detalles específicos del pipeline de entrenamiento, como los datos de preentrenamiento, el uso de datos de codificación sintéticos, la destilación de modelos GLM más grandes y los métodos de aprendizaje por refuerzo.