Apple lanza LensVLM-9B, un VLM que expande selectivamente imágenes de texto comprimidas
Apple ha lanzado LensVLM-9B, un Modelo de Lenguaje Visual de 9 mil millones de parámetros diseñado para procesar imágenes comprimidas de texto de manera más eficiente. El modelo escanea estas entradas comprimidas y utiliza herramientas aprendidas para expandir selectivamente solo las páginas relevantes a su forma sin comprimir.