Home Technologie et scienceTransformer la pensée abstraite de l’IA en produits conviviaux

Transformer la pensée abstraite de l’IA en produits conviviaux

by Thomas Caron

Publié le 7 janvier 2026 à 05h00. Google affirme avoir franchi une étape décisive dans le développement de l’intelligence artificielle avec Gemini 3, un modèle de langage multimodal qui suscite l’inquiétude de ses concurrents, notamment OpenAI, et pourrait redéfinir l’interaction entre les utilisateurs et la technologie.

  • Gemini 3, le dernier modèle de langage étendu (LLM) de Google, est capable de créer des applications et des widgets interactifs à partir des requêtes des utilisateurs.
  • La publication de Gemini 3 a incité Sam Altman, PDG d’OpenAI, à lancer une « alerte rouge » pour accélérer l’amélioration de ChatGPT.
  • Koray Kavukcuoglu, directeur de la technologie de DeepMind et architecte en chef de l’IA de Google, souligne l’importance de l’intégration de cette technologie dans l’ensemble des produits Google.

Google affirme avoir franchi un cap important dans le domaine de l’intelligence artificielle avec le lancement de Gemini 3. Ce nouveau modèle de langage étendu (LLM) se distingue par sa capacité à générer des applications et des widgets interactifs directement à partir des requêtes des utilisateurs, ouvrant de nouvelles perspectives en matière d’interaction homme-machine. La publication de Gemini 3, en novembre dernier, a suscité une réaction notable dans le secteur, notamment chez OpenAI, le développeur de ChatGPT.

Selon des informations rapportées par le Financial Times, Sam Altman, PDG d’OpenAI, a déclaré l’état d’« alerte rouge » au sein de son entreprise, soulignant la nécessité d’accélérer le développement de ChatGPT pour rattraper Google. Cette réaction témoigne de l’impact potentiel de Gemini 3 sur le paysage concurrentiel de l’IA. L’avantage stratégique de Google réside dans sa maîtrise de l’ensemble de la chaîne de valeur de l’IA, incluant le matériel, les centres de données et les puces nécessaires à la recherche de pointe dans ce domaine. Cette intégration verticale permet à l’entreprise de proposer rapidement de nouveaux produits à sa vaste base d’utilisateurs.

Koray Kavukcuoglu, directeur de la technologie de DeepMind et récemment nommé architecte en chef de l’IA de Google, a expliqué les spécificités de Gemini 3 et son rôle dans la stratégie de Google lors d’un entretien avec Melissa Heikkilä, correspondante IA du Financial Times. « Nous construisons une technologie vraiment fondamentale, » a-t-il déclaré. « Ma priorité première est de m’assurer que notre développement d’IA et nos produits sont bien connectés. Nous voulons permettre à tous les produits de Google d’avoir accès à la meilleure technologie d’IA que nous développons. »

Kavukcuoglu a précisé que l’objectif ultime de Google DeepMind est de développer une intelligence artificielle générale (AGI), c’est-à-dire des machines capables de surpasser les capacités humaines en matière d’intelligence. Il a souligné l’importance de cette AGI d’être développée en étroite collaboration avec les utilisateurs, à travers l’intégration de la technologie dans les produits existants. « Il s’agit d’une toute nouvelle technologie qui nécessite une toute nouvelle infrastructure pour pouvoir le faire à grande échelle, » a-t-il ajouté.

Interrogé sur ce qui distingue Gemini 3, Kavukcuoglu a mis en avant sa capacité à comprendre et à traiter des informations multimodales, c’est-à-dire des données sous différentes formes (texte, images, vidéos, PDF, etc.). Il a également souligné les progrès réalisés dans le domaine du codage, permettant à Gemini 3 de générer des simulations et des widgets interactifs pour aider les utilisateurs à apprendre et à expérimenter. « Lorsque les gens posent des questions, ils obtiennent des réponses beaucoup plus intuitives, des réponses qui leur apprennent réellement sur place, » a-t-il affirmé.

« Lorsque les gens posent des questions, ils obtiennent des réponses beaucoup plus intuitives, des réponses qui leur apprennent réellement sur place. »

Koray Kavukcuoglu, directeur de la technologie de DeepMind et architecte en chef de l’IA de Google

Kavukcuoglu a également évoqué l’importance de l’infrastructure de Google, notamment Antigravity, un environnement de développement intégré basé sur l’IA, qui permet de créer des agents capables d’agir de manière autonome. Il a souligné que les progrès réalisés dans le domaine de l’IA sont étroitement liés à la puissance de calcul disponible et à la capacité de Google à exploiter l’ensemble de sa chaîne de valeur technologique.

Concernant la question de la monétisation, Kavukcuoglu a insisté sur l’approche « full stack » de Google, qui consiste à intégrer la technologie d’IA dans l’ensemble de ses produits et à s’appuyer sur les retours d’expérience des milliards d’utilisateurs pour guider le développement futur. « Chaque développement technologique de pointe que nous réalisons est guidé par le signal que nous recevons des utilisateurs, » a-t-il déclaré.

Enfin, Kavukcuoglu a précisé que Gemini 3 a été conçu pour éviter les clichés et les flatteries, des caractéristiques souvent présentes dans les modèles d’IA générative. « Nous n’avons pas nécessairement codé le personnage de Gemini 3, » a-t-il expliqué. « Il s’agit davantage de capacités et de véracité et d’un langage simple. » Il a conclu en soulignant que l’avenir de l’IA réside dans la capacité à créer des agents intelligents capables de résoudre des problèmes concrets pour les utilisateurs, en s’appuyant sur les retours d’expérience et les signaux reçus de la communauté.

Une personne tient un iPhone affichant l'application Google Gemini, montrant une conversation de chatbot sur Gemini 3.
“Nous n’avons pas nécessairement codé le personnage de Gemini 3”, déclare Kavukcuoglu © Collection Smith/Gado/Getty Images

You may also like

Leave a Comment