Gemini est l’assistant et la famille de modèles d’intelligence artificielle développés par Google. Le service peut répondre à des questions, rédiger et résumer des textes, analyser des documents, interpréter des images, générer du contenu, rechercher des informations sur Internet et accompagner les utilisateurs dans leurs projets personnels ou professionnels.
Cette page rassemble toute l’actualité de Google Gemini publiée par la rédaction de KultureGeek. Vous y retrouverez les nouveaux modèles, les fonctionnalités ajoutées à l’application, les évolutions de Gemini Live, les outils de programmation, les abonnements Google AI, les intégrations dans Android, Chrome, Gmail, Google Maps et les autres services du groupe.
Les informations essentielles sur Google Gemini
| Développeur |
Google et Google DeepMind |
| Type de service |
Assistant conversationnel et famille de modèles d’intelligence artificielle générative |
| Principaux usages |
Rédaction, recherche, analyse de fichiers, programmation, images, vidéo, voix et automatisation |
| Accès |
Web, Android, iPhone, iPad et intégrations dans les services Google |
| Modèles actuels |
Gemini 3.1 Pro, Gemini 3.5 Flash, Gemini 3.1 Flash-Lite et variantes spécialisées |
| Conversation vocale |
Gemini Live |
| Recherche approfondie |
Deep Research |
| Assistants personnalisés |
Gems |
| Outils pour les développeurs |
Gemini API, Google AI Studio, Gemini CLI et Gemini Code Assist |
| Offres payantes |
Google AI Plus, Google AI Pro et Google AI Ultra |
Qu’est-ce que Gemini ?
Le nom Gemini désigne à la fois l’assistant proposé au grand public et les modèles d’intelligence artificielle qui alimentent différents produits de Google. L’utilisateur peut accéder au service depuis un navigateur ou une application mobile, puis lui transmettre une question, une consigne, une image ou un document.
L’assistant conserve le contexte de la conversation afin de permettre plusieurs échanges successifs. Il peut ainsi corriger une première réponse, changer de ton, approfondir une explication ou tenir compte de nouvelles informations communiquées par l’utilisateur.
Gemini a progressivement remplacé Bard, le précédent assistant conversationnel de Google. Le groupe utilise désormais cette appellation pour réunir une grande partie de ses travaux consacrés à l’intelligence artificielle, qu’il s’agisse des modèles, de l’application grand public ou des outils destinés aux entreprises et aux développeurs.
Que peut-on faire avec Google Gemini ?
Gemini peut être utilisé pour des demandes simples comme pour des projets plus complexes. Ses capacités varient selon le modèle sélectionné, l’abonnement, le pays et les fonctionnalités disponibles sur l’appareil utilisé.
- Répondre à des questions et fournir des explications adaptées au niveau de l’utilisateur.
- Rechercher des informations en s’appuyant notamment sur les résultats de Google.
- Rédiger et corriger des textes, comme des messages, des rapports, des articles ou des présentations.
- Résumer des contenus, des pages Web, des e-mails, des vidéos et des documents.
- Analyser des images et des fichiers, notamment des PDF, des tableaux et des captures d’écran.
- Créer et modifier des images à partir d’une consigne ou d’un visuel existant.
- Générer des vidéos et du contenu multimédia avec les modèles compatibles proposés par Google.
- Aider à programmer, expliquer du code, rechercher des erreurs et créer des applications.
- Planifier des tâches, organiser un voyage, préparer un projet ou comparer plusieurs possibilités.
Comme les autres assistants génératifs, Gemini peut produire des informations erronées, imprécises ou incomplètes. Les réponses importantes doivent donc être vérifiées, particulièrement lorsqu’elles concernent la santé, le droit, les finances ou la sécurité.
Les différents modèles Gemini
Google développe plusieurs modèles afin de répondre à des besoins différents. Certains privilégient la qualité du raisonnement et la capacité à traiter des problèmes complexes. D’autres cherchent surtout à fournir des réponses rapides avec un coût informatique plus faible.
Gemini Pro désigne les modèles les plus avancés pour le raisonnement, l’analyse de documents, les tâches agentiques et la programmation. Ils sont adaptés aux demandes comprenant plusieurs étapes ou nécessitant de traiter une grande quantité d’informations.
Les modèles Gemini Flash privilégient un équilibre entre performances, rapidité et coût. Ils peuvent alimenter l’assistant grand public, mais aussi des applications utilisant l’API de Google pour analyser ou générer du contenu à grande échelle.
La gamme Flash-Lite vise les usages demandant une latence réduite et un coût encore plus faible. Elle peut notamment convenir aux applications réalisant un nombre important de requêtes relativement simples.
Google propose également des modèles spécialisés pour l’image, la voix, la traduction, la vidéo et les échanges en temps réel. Les noms et les versions évoluent rapidement : les anciens modèles peuvent être remplacés par de nouvelles générations offrant de meilleures performances.
Gemini Live pour converser à la voix
Gemini Live permet d’échanger oralement avec l’assistant de manière plus naturelle. L’utilisateur peut parler librement, interrompre la réponse, ajouter une précision ou changer de sujet sans devoir recommencer entièrement la conversation.
Cette fonction peut servir à réfléchir à voix haute, préparer un entretien, apprendre une langue, organiser un projet ou obtenir une explication sans utiliser le clavier. Selon l’appareil, Gemini peut également analyser ce qui apparaît à l’écran ou ce que montre la caméra.
Gemini Live est notamment intégré aux smartphones Android. Google étend progressivement son fonctionnement à d’autres appareils, à Chrome et à différents produits de son écosystème.
Deep Research pour effectuer des recherches approfondies
Deep Research est un outil conçu pour réaliser des recherches comprenant plusieurs étapes. Gemini commence par établir un plan, consulte différentes sources, analyse les informations trouvées puis produit un rapport structuré.
L’outil peut s’appuyer sur Google Search, mais aussi sur des documents transmis par l’utilisateur. Selon les autorisations accordées, il peut également exploiter des informations provenant de Gmail, de Google Drive ou de notebooks associés au compte.
Deep Research peut être utile pour préparer un dossier, étudier un marché, comparer des produits, analyser une évolution technologique ou réunir des informations provenant de nombreuses sources. Le rapport final doit néanmoins être relu et les références importantes vérifiées.
Gems et assistants personnalisés
Les Gems sont des versions personnalisées de Gemini. L’utilisateur peut définir des instructions permanentes afin de créer un assistant adapté à une tâche précise, sans devoir répéter les mêmes consignes dans chaque conversation.
Un Gem peut par exemple servir de correcteur, de professeur, d’assistant de programmation, de conseiller éditorial ou d’outil chargé de respecter un format particulier. Il est également possible d’ajouter des fichiers afin de fournir une base documentaire spécifique.
Google développe aussi des Gems capables de prendre la forme de petites applications ou de workflows automatisés. Ces outils permettent de combiner plusieurs étapes à partir d’une interface créée en langage naturel.
Gemini dans Android
Google intègre progressivement Gemini au cœur d’Android. Sur les appareils compatibles, l’assistant peut remplacer Google Assistant et répondre à des demandes formulées à la voix, par écrit ou à partir des informations affichées à l’écran.
Gemini peut interagir avec certaines applications afin d’envoyer un message, créer un événement, lancer un itinéraire, retrouver une information ou agir sur les contenus du smartphone. Les fonctions disponibles dépendent du modèle de téléphone, de la version d’Android et des autorisations accordées.
L’intelligence artificielle de Google s’étend également aux tablettes, aux montres, aux téléviseurs, aux voitures équipées d’Android Automotive et à différents appareils domestiques. Cette intégration doit toutefois composer avec les règles de concurrence et les exigences réglementaires imposées à Google.
Gemini dans Gmail, Chrome et les services Google
Gemini occupe une place croissante dans les services du groupe. Dans Gmail, il peut résumer des conversations, proposer des réponses, retrouver des informations et aider à rédiger un message.
Dans Google Chrome, l’assistant peut répondre à des questions sur les pages consultées, résumer leur contenu et accompagner l’utilisateur pendant sa navigation. Certaines fonctions agentiques peuvent également réaliser plusieurs actions sur Internet à partir d’une consigne.
Gemini est aussi intégré à Google Docs, Sheets, Slides, Meet, Drive et Vids. Il peut alors aider à produire un document, analyser un tableau, créer une présentation, résumer une réunion ou retrouver des informations dans des fichiers professionnels.
Dans Google Maps, l’assistant enrichit notamment la recherche de lieux, la préparation des trajets et les interactions pendant la navigation. Google Photos utilise également l’intelligence artificielle pour rechercher et comprendre plus précisément le contenu d’une bibliothèque d’images.
Gemini pour les développeurs
Google propose plusieurs outils permettant aux développeurs d’utiliser ses modèles dans leurs projets. La Gemini API donne accès aux fonctions de génération de texte, d’analyse d’images, de traitement audio, de programmation et d’utilisation d’outils externes.
Google AI Studio permet de tester les modèles, préparer des instructions, configurer des réponses et obtenir rapidement du code pour intégrer Gemini à une application.
Gemini CLI fonctionne directement depuis un terminal. L’outil peut analyser un projet, créer ou modifier des fichiers, exécuter des commandes et accompagner le développeur dans différentes étapes de son travail.
Gemini Code Assist s’intègre pour sa part aux environnements de développement. Il peut compléter du code, expliquer une fonction, générer des tests ou proposer des corrections.
Google distribue également ses modèles à travers Vertex AI et ses services cloud. Les entreprises peuvent ainsi les intégrer à leurs logiciels en utilisant leurs outils d’administration, de sécurité et de gestion des données.
Les abonnements Google AI Plus, Pro et Ultra
Gemini peut être utilisé gratuitement avec des limites concernant les modèles, les outils et le nombre de requêtes. Google commercialise également plusieurs abonnements destinés aux utilisateurs qui souhaitent bénéficier de capacités et de quotas plus importants.
Google AI Plus constitue l’offre payante la plus accessible. Elle augmente les limites de Gemini et inclut différents services et capacités supplémentaires selon le pays.
Google AI Pro donne un accès élargi aux modèles avancés, à Deep Research, à la génération multimédia et aux fonctions de Gemini intégrées dans Gmail, Docs et les autres applications compatibles.
Google AI Ultra vise les utilisateurs les plus intensifs. Cette formule comprend des limites plus élevées, un accès prioritaire à certaines nouveautés et les outils les plus avancés proposés par Google.
Les prix, les capacités et les noms des formules peuvent évoluer. Certaines fonctions restent également limitées à certains pays, certaines langues ou aux utilisateurs majeurs.
Gemini face à ChatGPT et Claude
Gemini évolue sur un marché particulièrement concurrentiel. Son principal rival reste ChatGPT, développé par OpenAI. Les deux services proposent notamment la rédaction, la recherche sur Internet, l’analyse de fichiers, les conversations vocales, la programmation et la génération d’images.
Claude d’Anthropic occupe également une place importante, notamment dans le domaine de la programmation, de l’analyse de documents et des usages professionnels.
Google dispose toutefois d’un avantage particulier grâce à l’intégration de Gemini dans Android, Chrome, Gmail, Maps, Workspace et son moteur de recherche. Cette présence permet à l’assistant d’accéder, avec l’autorisation de l’utilisateur, à de nombreux services déjà utilisés au quotidien.
Confidentialité, droits d’auteur et réglementation
L’intégration de Gemini aux services Google soulève différentes questions concernant l’utilisation des données personnelles. Les informations auxquelles l’assistant peut accéder dépendent du compte, des paramètres choisis et des autorisations accordées aux applications connectées.
Les utilisateurs doivent être particulièrement prudents avant de transmettre des données confidentielles, professionnelles ou sensibles. Les conditions peuvent différer entre les comptes personnels, les offres Google Workspace et les services proposés aux entreprises.
Google fait également face à des procédures concernant les contenus utilisés pour entraîner ses modèles. Les éditeurs, auteurs et détenteurs de droits cherchent notamment à savoir si leurs œuvres ont été exploitées sans autorisation ou sans compensation.
Enfin, l’intégration de Gemini à Android, au moteur de recherche et aux autres services dominants de Google fait l’objet d’une attention particulière des autorités de la concurrence. Cette page permet de suivre ces débats ainsi que les évolutions réglementaires liées à l’intelligence artificielle.
Une intelligence artificielle au centre de la stratégie de Google
Gemini occupe désormais une place centrale dans la stratégie de Google. Le groupe intègre progressivement ses modèles à ses produits grand public, à ses outils professionnels, à ses services cloud et à ses appareils.
Les principales annonces sont notamment présentées lors de la conférence Google I/O. Elles concernent les nouveaux modèles, les fonctions agentiques, la génération multimédia, Android, la recherche et les outils destinés aux développeurs.
Cette page permet de suivre toutes les évolutions de Google Gemini : nouveaux modèles, application, Gemini Live, Deep Research, Gems, abonnements, intégrations, programmation, sécurité et décisions réglementaires.