557d1c3f24257b680507378119dc7c0e514bfc4b
Quand un repo HuggingFace héberge à la fois le fichier GGUF fusionné et ses shards pour une même quantisation, select_gguf_file (tri alphabétique naïf) pouvait retenir un shard partiel plutôt que le fichier fusionné ou l'ensemble complet des shards, causant un échec immédiat au démarrage du serveur llama.cpp (agent Context). select_gguf_files renvoie désormais soit le fichier fusionné seul (priorité), soit tous les shards correspondants triés par index — jamais un shard isolé. Le téléchargement, le cache et la reprise gèrent le cas multi-fichiers (manifest de shards, chemins locaux préservant le nom distant pour l'autoload de llama.cpp). Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
The file is empty.
Description
Languages
TypeScript
70.6%
JavaScript
29.4%