
Mac Studio M5 Max-Ultra ou Mac mini M6 : remplacer Claude ou Codex ?
Apple a récemment redéfini sa stratégie de vente en présentant ses Mac comme des serveurs d’intelligence artificielle personnels, capables d’accueillir jusqu’à 512 Go de mémoire pour exécuter les modèles d’IA les plus exigeants. Nous avons examiné les performances de ces machines, dont les prix varient de 1 049 € à 60 000 €, tout en soulignant que les abonnements à des services comme Claude ou ChatGPT demeurent une option attrayante pour de nombreux utilisateurs.
Le 20 août, un modèle chinois de 320 milliards de paramètres a fait son apparition sur OpenRouter, sous le nom de GLM-5.3-Flash. En l’espace de six jours, il est devenu le modèle le plus populaire de la plateforme. Z.ai a rapidement mis à disposition ses poids sous licence MIT, permettant ainsi leur téléchargement, avec des conversions pour Apple Silicon disponibles dès le soir même.
Le configurateur du nouveau Mac Studio a mis en avant 256 Go de mémoire, suscitant des interrogations sur ce que cela signifie pour les utilisateurs hésitant entre un abonnement mensuel et l’achat d’une machine coûteuse. Il est important de rappeler qu’il y a deux ans, faire fonctionner un modèle de langage à domicile était un défi technique, nécessitant des compétences en développement et un matériel spécifique.
Depuis, la qualité des modèles à poids ouverts a considérablement progressé. Des modèles tels que DeepSeek, Qwen et GLM rivalisent désormais avec ceux d’OpenAI et d’Anthropic, et un Mac mini M4 à 699 € peut faire tourner les versions les plus légères. Face à cette évolution, les mini PC ont connu une forte demande, entraînant des ruptures de stock, ce qui a incité Apple à augmenter ses prix.
Le nouveau Mac mini M6 a été lancé à 1 049 € avec 16 Go de mémoire, et il est possible de le configurer jusqu’à 32 Go. Le Mac mini M5 Pro commence à 1 999 € avec une capacité de 64 Go. En ce qui concerne le Mac Studio, le modèle M5 Max débute à 2 999 € avec 36 Go de mémoire, tandis que le M5 Ultra commence à 6 599 € avec 96 Go, atteignant 12 429 € pour 256 Go.
Ces spécifications ne sont pas simplement des chiffres : Apple affirme que le M5 Ultra est capable d’exécuter des modèles « de classe frontière » localement. Dans le jargon technique, cela fait référence aux modèles les plus avancés, tels que GPT-5.x ou Claude Fable 5, bien que ces derniers ne soient pas disponibles en téléchargement.
Pour la première fois, la mémoire unifiée est mise en avant comme un argument de vente majeur, tout comme les cœurs GPU, et l’accent est mis sur l’importance de l’IA locale. Les précommandes ont ouvert le 25 août, avec des livraisons prévues à partir du 22 septembre pour la plupart des configurations, à l’exception du Mac Studio 512 Go, dont la disponibilité est attendue fin octobre.
Les modèles de langage nécessitent une quantité importante de mémoire pour fonctionner efficacement. Par exemple, un modèle de 70 milliards de paramètres, compressé à 4 bits, occupe environ 40 Go de mémoire. Sur un Mac Studio M5 Max, la génération de texte peut théoriquement atteindre 15 tokens par seconde, tandis qu’un Mac mini M6 peut traiter un modèle de 14 milliards de paramètres à environ 20 tokens par seconde.
L’architecture d’Apple se distingue par sa mémoire unifiée, permettant au CPU et au GPU d’accéder à la même mémoire, contrairement aux cartes Nvidia qui ont une mémoire vidéo séparée. Cela signifie qu’un Mac peut charger des modèles plus volumineux que ceux gérés par des cartes grand public.
Les modèles récents, comme GLM-5.3-Flash, utilisent une approche de Mixture of Experts (MoE), stockant 320 milliards de paramètres tout en n’en mobilisant qu’une fraction pour chaque token. Cela permet une exécution rapide, mais nécessite toujours une mémoire importante pour stocker l’intégralité du modèle.
En ce qui concerne les performances, les utilisateurs doivent prendre en compte la vitesse de lecture des prompts, qui peut influencer la perception de la rapidité d’un modèle. Les frameworks d’Apple, comme MLX, sont optimisés pour ses puces, mais l’intégration de nouveaux modèles peut parfois poser des défis.
Pour résumer, les Mac mini et Mac Studio offrent des options intéressantes pour ceux qui souhaitent travailler avec des modèles de langage, mais le coût d’acquisition reste un facteur déterminant. Les utilisateurs doivent peser le coût d’un abonnement par rapport à l’achat d’une machine, en tenant compte de la confidentialité des données et de la flexibilité d’utilisation des modèles.
Enfin, l’idée de louer un Mac pendant la nuit pour compenser les coûts d’achat est en train de gagner en popularité, avec des services émergents comme Darkbloom qui proposent des solutions de partage de ressources.
En conclusion, le Mac Studio 512 Go représente une option puissante pour exécuter des modèles ouverts, mais il ne pourra jamais rivaliser avec les modèles propriétaires comme GPT-5.x. La décision d’investir dans un matériel local ou de s’abonner à un service cloud dépendra des besoins spécifiques de chaque utilisateur.
