Le projet llama.cpp a introduit un nouveau point de terminaison d'API `/v1/systemone` pour prendre en charge des architectures de modèles spécifiques incluant laya, julia-1, lev, openjev et kev. Cette mise à jour comprend le code serveur nécessaire, les scripts de conversion et la documentation pour activer ces modèles au sein de l'écosystème llama.cpp.

  • Ajout du point de terminaison d'API `/v1/systemone` pour les modèles laya, julia-1, lev, openjev et kev.
  • Mise en œuvre du support de chargement et de conversion de modèles pour les nouvelles architectures.
  • Ajout du support de la vision et des capacités de préfixe de prompt partagé.
  • Inclusion d'un modèle minuscule `openjev` à des fins de test.
  • Documentation mise à jour et expérience utilisateur améliorée pour la nouvelle fonctionnalité.

Cette version fournit aux développeurs l'infrastructure nécessaire pour exécuter et servir ces types de modèles spécifiques en utilisant le serveur llama.cpp.