Une question, pas un spoiler : Tout le monde demande pourquoi Siri s’accroche à Google Gemini. Très peu de gens placent sur la même carte les modèles Apple, Private Cloud Compute, l’option ChatGPT et le substrat Gemini. Cinq lignes : stratégie, architecture, frontière du partenariat, calendrier, impact développeurs.
D’abord la frontière : Siri ne devient pas l’app Gemini
Le 12 janvier 2026, Apple et Google publient une déclaration commune : une collaboration pluriannuelle selon laquelle la prochaine génération d’Apple Foundation Models s’appuiera sur les modèles Gemini et la technologie cloud de Google. Ces modèles alimenteront les prochaines fonctions Apple Intelligence, dont un Siri plus personnel dans l’année. La même déclaration affirme qu’Apple Intelligence continuera de tourner sur les appareils Apple et Private Cloud Compute, avec le standard de confidentialité d’Apple.
Ce n’est pas « Siri devient un client Gemini ». Après la WWDC 2026, Craig Federighi est net : Apple n’utilise pas l’app Gemini comme sienne, et n’injecte pas la base de connaissances de Google Search dans Siri. Ce qu’Apple veut, c’est la capacité de modèle et l’élasticité cloud derrière Gemini, pour entraîner, personnaliser et exécuter les Apple Foundation Models (AFM). L’utilisateur voit toujours Siri / Apple Intelligence — pas une icône Google.
« Après une évaluation attentive, la technologie de Google offre le fondement le plus capable pour les Apple Foundation Models. » — Déclaration Apple / Google (12 janv. 2026)
En langage produit : Apple garde l’expérience, le routage, les promesses de confidentialité et la marque. Google fournit le substrat et une partie de l’infra cloud pour le palier d’inférence le plus dur. Qui apparaît dans Réglages et qui calcule vraiment la requête n’ont pas à être la même entreprise.
Stratégie IA d’Apple : posséder l’expérience, acheter le substrat
Depuis deux ans, le récit public tient en trois points :
- L’appareil d’abord. Si le Neural Engine suffit, la requête ne quitte pas l’appareil.
- La confidentialité est le produit. Private Cloud Compute vise un cloud aussi auditable que l’iPhone.
- L’IA vit dans le système, pas dans une énième app de chat. Outils d’écriture, Photos, Safari, Mots de passe, Siri doivent apparaître dans ce que vous êtes déjà en train de faire.
Le 3 se heurte au 1 et au 2. Apple Intelligence à la WWDC 2024 a fait de ChatGPT une sortie optionnelle vers la connaissance du monde. Le Siri capable de lire le mail et d’agir entre apps a glissé en 2025 vers 2026. Il ne manquait pas une boîte de chat, mais un modèle de fondation assez fort, et assez privé contractuellement, pour le raisonnement multi-étapes, le contexte personnel et les App Intents.
D’où une décision très Apple : ne pas miser l’entreprise sur le plus gros modèle interne, et ne pas livrer l’âme du système à une marque de chat tierce. L’AFM maison garde le « goût Apple ». Si la courbe interne n’atteint pas le plafond à temps, on achète le meilleur substrat. Fin 2025, la presse parlait d’un Gemini sur mesure autour d’un milliard de dollars par an. La déclaration de janvier a transformé la rumeur en contrat.
Pourquoi Google entre plus facilement dans le noyau de l’OS qu’OpenAI n’est pas un mystère :
- Échelle et multimodal. Long contexte, image/vidéo, appels d’outils : plus assistant système que boîte de dialogue.
- Personnalisation. Le texte dit based on Gemini, pas is Gemini. Apple veut un AFM dont elle change poids, gardes et résidence des données.
- Élasticité cloud. L’inférence de pic a besoin de grappes GPU. Le PCC maison tourne sur des serveurs Apple silicon ; le palier le plus lourd (AFM Cloud Pro selon la presse) peut atterrir sur des GPU NVIDIA chez Google, encore enveloppé du logiciel de sécurité et du chiffrement matériel définis par Apple.
- Papier déjà signé. Recherche Safari par défaut, préinstallation iOS : plus de dix ans. Juridique et partage de revenus ne partent pas de zéro.
Cela ne supprime pas ChatGPT. Mi-2026, le découpage public reste : ChatGPT pour la connaissance du monde après opt-in ; substrat Gemini pour les fondations d’Apple Intelligence / du nouveau Siri. Ils peuvent coexister. Ce n’est pas la même couche.
À quoi ressemble Apple Intelligence maintenant
Trois couches valent mieux que le débat « c’est Gemini ou pas ».
| Couche | Où ça tourne | Travail typique | Ce que l’utilisateur sent |
|---|---|---|---|
| AFM on-device | Neural Engine + mémoire unifiée iPhone / iPad / Mac | Résumés de notifications, réécriture, photos locales, voix simple | Rapide, souvent hors ligne, presque pas de data mobile |
| Private Cloud Compute (PCC) | Serveurs Apple silicon appartenant à Apple | Requêtes complexes avec contexte personnel, à traiter « comme on-device » | Un temps plus lent, toujours Siri / système — pas un saut vers une autre app |
| Inférence cloud de pic (tech cloud Gemini) | GPU dans les datacenters Google, protections de classe PCC | Planification multi-étapes, Q&R profonde, génération lourde | Plafond plus haut ; Apple dit que les requêtes n’entraînent pas le modèle de l’autre |
La WWDC 2026 a productisé le sommet en Siri AI : app dédiée, conversationnelle, recherche dans Messages / Mail / Photos, actions dans les apps, liée aux outils d’écriture et à Visual Intelligence. Tests développeurs dès iOS 27 / iPadOS 27 / macOS 27 / visionOS 27. Utilisateurs : bêta anglaise plus tard en 2026, puis d’autres langues. Limites iPhone UE et régulation Chine sont écrites à part : on peut acheter le substrat ; les dates de sortie appartiennent au droit de la vie privée et à la conformité locale.
La même keynote a poussé Spatial Reframing et Extend dans Photos, le regroupement d’onglets Safari, les alertes de changement de page, la mise à niveau auto des mots de passe faibles, Image Playground photoréaliste (SynthID). Personne n’a à « ouvrir Gemini ». Il faut un AFM plus fort et un chemin cloud qu’Apple signe.
Ce que Gemini branche — et ce qu’il ne branche pas
Clouer la frontière pour que le titre ne s’emballe pas.
Branché
- Le substrat de modèle et une partie du chemin d’entraînement / distillation des prochains Apple Foundation Models.
- La technologie cloud et la capacité GPU pour l’inférence de pic.
- Assez de plafond pour que le raisonnement multi-étapes du nouveau Siri « suffise ».
Pas branché
- Le moteur de recherche par défaut dans Réglages ne devient pas automatiquement Google (autre contrat).
- L’écran d’accueil de Siri ne devient pas l’app Gemini.
- Mail, messages, photos ne sont pas, selon la promesse publique, donnés à Google pour le profilage pub.
- L’intégration optionnelle OpenAI / ChatGPT n’est pas tuée par la déclaration.
Modèle mental :
Votre requête
├─ simple → Neural Engine on-device (AFM On-Device)
├─ moyenne → Apple PCC (AFM Cloud)
└─ la plus dure → infra cloud Gemini sous PCC (AFM de pic)
└─ seulement après un oui explicite, ChatGPT ou équivalent
Private Cloud Compute vise à transformer « la requête a quitté l’appareil » de faire confiance à la politique de Google / OpenAI en faire confiance à un isolement signé par Apple. Même si le GPU est dans la salle d’un autre : pas de stockage persistant, pas d’entraînement, pile définie par Apple — c’est la thèse. Que des chercheurs indépendants puissent encore le vérifier en 2026, voilà le vrai débat. Pas « le modèle de qui est dans Siri ».
Un calendrier pour des attentes honnêtes
| Quand | Quoi | Pour l’utilisateur |
|---|---|---|
| 2024-06 | WWDC : Apple Intelligence + ChatGPT optionnel | Fonctions génératives oui ; grand rewrite Siri non |
| 2025 | Nouveau Siri glissé à 2026 | Pub et livraison divergent ; pression sur 2026 |
| Fin 2025 | Presse : pourparlers Gemini sur mesure | Le marché prix le substrat externalisé |
| 2026-01-12 | Déclaration commune | Contrat : AFM based on Gemini |
| 2026-06 | WWDC : Apple Intelligence next-gen, Siri AI | Les développeurs testent ; les utilisateurs attendent la bêta |
| Automne / fin 2026 | Fonctions OS, bêta anglaise Siri AI | « Disponible » et « bon » auront une version d’écart |
Si vous attendez que Siri devienne ChatGPT du jour au lendemain, vous serez déçu. Le chemin réaliste : un peu plus malin, d’abord conversationnel en anglais, puis lentement capable d’agir entre apps. Le risque produit n’est pas le communiqué. C’est la latence, l’hallucination, et un routeur qui se trompe une fois entre contexte on-device et raisonnement cloud.
Ce que ça change pour les développeurs et le Mac
Pour les équipes app, l’accord relève le plafond de l’assistant système. Il ne remplace pas la chaîne locale.
- App Intents / actions Siri. Si Siri AI peut vraiment « travailler dans l’app », le devoir 2026 n’est pas une UI de chat de plus, c’est d’exposer les flux clés en Intents appelables par le système. Il faut un appareil réel ou un macOS 27 complet, pas un mock navigateur.
- Les modèles on-device ne sont pas obsolètes. Core ML, MLX, Neural Engine restent le chemin faible latence, facture API nulle. Gemini monte le plafond cloud d’Apple. Il n’annule pas l’inférence locale sur un Mac mini 16 Go.
- Ne caler pas le planning d’entreprise sur la bêta Siri. Bêta anglaise, limites UE, revue Chine : « tout le monde a le nouveau Siri » sera plus tard que la keynote. Outils internes, CI, agents : Claude Code, Cursor, Ollama local — n’attendez pas que l’assistant système écrive le code.
- Quand il faut un Mac allumé en permanence. Builds iOS, remplacement de bouts d’Xcode Cloud, vérif App Intents, modèle local + agent distant : plus propre sur un Cloud Mac / nœud Mac mini en location que sur un portable ouvert 24 h/24.
Sur la coupure on-device / cloud : puces IA Apple : calcul local et cloud et M4 / M5 Apple Silicon comme plateforme IA.
FAQ
Siri est-il déjà Google Gemini ?
Non. L’utilisateur voit Apple Intelligence et Siri AI. Gemini fournit le substrat et une partie de la capacité cloud des prochains Apple Foundation Models — pas l’app Gemini dans iOS.
Google entraînera-t-il sur mes conversations ?
La ligne publique d’Apple : Apple Intelligence reste on-device et sur Private Cloud Compute, même standard de confidentialité ; même l’inférence de pic sur la tech cloud Google est sous isolation de classe PCC et ne sert pas à entraîner le modèle de l’autre. Les invites de Réglages et le texte juridique d’Apple priment.
ChatGPT disparaît-il ?
La déclaration ne tue pas l’intégration OpenAI. Lecture plus nette : ChatGPT peut rester un expert externe après opt-in ; le substrat Gemini est sous l’assistant système lui-même.
Pourquoi Apple n’entraîne-t-elle pas assez grand elle-même ?
Elle le pourrait. 2025 a montré qu’une date Siri système ne peut pas attendre la convergence du plus gros modèle interne. Acheter le substrat, posséder l’expérience : compromis entre « à l’heure » et « on brand ».
Que faire côté développeur maintenant ?
Transformer les flux clés en App Intents ; tester les appels Siri AI sur macOS 27 / iOS 27 ; garder l’inférence locale sur Core ML / MLX. Un nœud Mac distant stable ? Un Cloud Mac dédié, pour ne pas voler la RAM de la machine du quotidien.
ZavCloud Developer Infrastructure
Tester iOS 27 et Siri AI sur un nœud Mac dédié
Louez un Mac mini M4 à la journée pour Xcode, App Intents et modèles locaux — sans laisser un portable ouvert 24 h/24.
Ligne 1 Gbit/s, bureau à distance et SSH ensemble. Pour la CI et les jobs d’agents longs.