En bref
- Perplexity partage les tâches entre le cloud et le Mac.
- Les données sensibles peuvent rester stockées et traitées localement.
- Le système vise à combiner confidentialité, puissance et réduction des coûts.
Le vrai sujet, ce n’est pas juste une nouvelle fonction IA. C’est le compromis. Avec Hybrid Compute, Perplexity propose de couper une tâche en deux entre un modèle cloud très costaud, comme Opus 5 ou GPT-5.6 Sol, et un LLM local lancé directement sur votre machine. L’idée est simple, et plutôt maligne, les données sensibles restent sur le Mac, pendant que le cloud gère le reste.
Le pari d’un curseur entre puissance et confidentialité
Ce nouveau mode rejoint un écosystème déjà lancé plus tôt dans l’année avec Perplexity Computer, puis étendu avec Personal Computer pour Mac. Ici, Perplexity vise des cas concrets, comme un avocat qui compare un dossier à de la jurisprudence sans exposer les données de son client au cloud.
Et il y a un autre argument, moins glamour mais très réel, le prix. L’entreprise met aussi en avant la possibilité de réduire les coûts d’inférence en déportant une partie du boulot hors des modèles frontier, souvent plus chers. Pas mal de gens n’ont pas besoin de sortir l’artillerie lourde à chaque requête.
Une intégration pensée pour le Mac, sans bricolage
Dans l’app Mac, tout est intégré. Quand vous tentez d’envoyer des fichiers ou des informations, Perplexity vérifie automatiquement s’il y a du contenu sensible et vous demande confirmation avant un envoi vers le cloud. Pour ça, la boîte a entraîné un nouveau classifieur de confidentialité chargé de suggérer ce qui devrait rester sur l’ordinateur.
Avant que la tâche parte dans les différents modèles, vous pouvez revoir les fichiers mis de côté pour vérifier qu’il n’a rien raté. C’est là aussi que vous choisissez quels modèles travailleront. Une fois lancé, le système affiche l’usage local du CPU, du GPU et de la mémoire, avec en plus une barre latérale pour suivre les tokens consommés. Ceux générés en local sur votre machine ne sont pas facturés. Et oui, vous pouvez ensuite envoyer des consignes supplémentaires, ou même mettre des tâches en file depuis un iPhone.
Des modèles locaux précis, avec des limites très claires
Côté local, les options de départ sont Gemma E4B et deux variantes du modèle 3.6 à 35 milliards de paramètres de Qwen. L’une de ces versions a été post-entraînée par Perplexity. D’autres modèles locaux arriveront plus tard, et l’installation passe directement par l’app, sans ouvrir le Terminal. Franchement, c’est le minimum en 2026.
Mais Jon Staff, qui supervise les produits Mac de l’entreprise, ne vend pas du rêve pour rien. Il explique qu’un résultat entièrement produit par un modèle frontier sera presque toujours meilleur pour la création brute, parce qu’il est plus capable, et plus cher aussi. Il ajoute, en gros, que tout fonctionne comme un curseur et que l’utilisateur doit garder la main sur le bon équilibre selon le type de travail.
Qui peut l’utiliser dès maintenant ?
Pour le moment, Hybrid Compute tourne uniquement sur les Mac Apple Silicon sous macOS 15. Perplexity recommande au moins 32 Go de mémoire unifiée. L’accès est réservé aux abonnés Pro et Max, ainsi qu’aux clients entreprise. Bref, une fonction prometteuse, mais pas encore pour tout le monde.