Ollama améliore les sorties structurées et les performances sur Apple Silicon
IA Contenu généré par intelligence artificielle : texte écrit par une IA, lu par des voix de synthèse.
Transcription avec les sources de chaque passage
Léna
Ollama publie mercredi une mise à jour qui améliore le traitement des sorties structurées des modèles de raisonnement, selon GitHub. Ces sorties sont désormais traitées en une seule passe, ce qui rend leur traitement plus rapide et plus fiable. Pour les usages qui nécessitent une réponse structurée d’un modèle de raisonnement, c’est donc le traitement de cette sortie qui change. La mise à jour accélère aussi le traitement des prompts de Qwen 3.8 sur Apple Silicon. Les personnes qui utilisent ce modèle sur ces appareils peuvent donc bénéficier d’un traitement des prompts plus rapide. Gemma 4 change également sur Apple Silicon. Pour les utilisateurs qui font traiter des images haute résolution par ce modèle, Gemma 4 choisit maintenant une résolution adaptée à chaque image. L’objectif indiqué est de préserver davantage de détails. Ollama corrige par ailleurs des erreurs intermittentes qui signalaient qu’un modèle était introuvable dans une grande bibliothèque locale. La mise à jour corrige aussi le blocage de l’application macOS pendant la vérification de l’exécution de ChatGPT ou Codex. Enfin, elle actualise llama.cpp, MLX et XGrammar. Les changements concernent donc à la fois les sorties structurées, certains modèles sur Apple Silicon et des problèmes de l’application et de la bibliothèque locale.
Une erreur ?
Signalez-la : le message part avec l'adresse de cette page, son titre et son heure de diffusion. Une personne mise en cause peut aussi exercer son droit de réponse.
Signaler une erreurUn mot pour la rédaction ?
Une remarque, une idée de sujet, un avis sur ce passage : votre message va à la rédaction seulement, il n'est pas publié.