Google Cloud Next ’24 a mis l’accent sur l’IA générative, la positionnant au premier plan de la conférence. De nouveaux microprocesseurs, des mises à jour logicielles, des améliorations apportées aux grands modèles linguistiques et l’introduction d’assistants pilotés par l’IA sur Vertex AI ont mis en lumière l’orientation stratégique du géant de la tech. Ces avancées soulignent l’objectif de Google de rationaliser l’intégration de l’IA dans diverses opérations commerciales, en améliorant l’efficacité et l’évolutivité.

Charges de travail et infrastructure de l’IA

Les dernières mises à jour de l’infrastructure cloud de Google montrent une profonde compréhension des exigences uniques que les charges de travail d’IA imposent aux systèmes. La disponibilité générale de la Tensor Processing Unit (TPU) v5p de Google en est l’illustration, car elle offre une prise en charge complète des applications d’intelligence artificielle. L’intégration de ces TPU avec Google Kubernetes Engine (GKE) facilite le service multi-hôtes, améliorant ainsi la polyvalence et l’efficacité des déploiements dans le cloud. En outre, le lancement de l’A3 Mega VM, équipé des GPU H100 de Nvidia, est un engagement à fournir la puissance de calcul de pointe nécessaire aux opérations complexes d’IA. Google présente également le Dynamic Workload Scheduler, une solution innovante conçue pour optimiser l’allocation et la gestion des charges de travail d’IA, rationalisant ainsi les opérations et réduisant les coûts.

Progrès en matière d’aide à la programmation (Gemini Code Assist)

Dans le cadre d’un changement de marque stratégique, Google a rebaptisé son Duet AI for Developers en Gemini Code Assist, l’alignant ainsi sur les nouvelles capacités du modèle Gemini 1.5 Pro. Gemini Code Assist offre désormais des services avancés de complétion de code, de génération et de chat, ce qui en fait un outil complet pour les développeurs. Grâce à l’intégration dans des environnements de développement populaires tels que Google Cloud Console, Visual Studio Code et JetBrains, Gemini Code Assist augmente la productivité en prenant en charge un large éventail de tâches de programmation. La connaissance complète de la base de code et les capacités de personnalisation de l’outil permettent d’élaborer des solutions de codage sur mesure, favorisant ainsi l’innovation. En complément, Google a élargi l’écosystème de partenaires de Gemini Code Assist, en intégrant des leaders technologiques tels que Datadog, Datastax, Elastic et d’autres, afin de renforcer ses fonctionnalités et d’étendre sa portée au sein de la communauté des développeurs. Ces partenariats facilitent un processus de développement plus connecté et plus efficace, en aidant les développeurs à utiliser au mieux les outils et services externes dans leur environnement de codage.

Gestion et exploitation du cloud

Gemini Cloud Assist développe son activité de gestion d’applications et de réseaux au sein de Google Cloud. Cet outil alimenté par l’IA optimise les opérations en se concentrant sur la réduction des coûts, l’amélioration des performances et la fourniture d’une haute disponibilité. Gemini Cloud Assist, accessible via une interface de chat dans la console Google Cloud, utilise le modèle de langage large propriétaire de Google pour interpréter les entrées en langage naturel des équipes de l’entreprise. Grâce à ces données, Gemini Cloud Assist met en évidence les domaines nécessitant une amélioration et fournit des suggestions exploitables. Les entreprises peuvent également intégrer cet outil directement dans diverses interfaces de produits cloud, ce qui facilite la gestion de différentes charges de travail cloud. Au-delà de la gestion du cycle de vie des applications, Gemini Cloud Assist étend son utilité aux tâches de mise en réseau, en offrant une assistance basée sur Cloud pour la conception, les opérations et l’optimisation. Elle joue également un rôle important dans les opérations de sécurité, en fournissant des informations clés pour la gestion des identités et des accès et en soutenant l’informatique confidentielle pour atténuer les risques.

Développement d’un chatbot

Vertex AI Agent Builder, un outil sophistiqué sans code de Google, utilise les capacités des grands modèles de langage Gemini pour simplifier la création d’agents virtuels. Cet outil associe Vertex AI Search aux produits de technologie de conversation de Google afin d’offrir une solution claire pour le développement de chatbots. L’introduction d’un système RAG (Retrieve and Generate) permet d’accélérer la mise en place des agents par rapport aux méthodes traditionnelles. Grâce aux API RAG intégrées, les développeurs peuvent effectuer des vérifications rapides des données de mise à la terre, et l’outil prend également en charge les résultats du modèle de mise à la terre par le biais de Google Search pour des réponses plus précises. Vertex AI Agent Builder comprend l’aperçu public du modèle Gemini 1.5 Pro et des mises à jour de LLM existants comme Imagen 2, qui introduit des capacités telles que l’édition de photos et la génération de courtes vidéos à partir d’invites textuelles.

Gestion des bases de données

Google a considérablement amélioré ses services de base de données en intégrant des capacités d’IA dans ses offres, notamment Bigtable, Spanner, Firestore, CloudSQL pour MySQL et AlloyDB pour PostgreSQL. L’introduction d’un nouveau centre de base de données permet aux opérateurs de gérer plusieurs bases de données à partir d’une seule interface, ce qui simplifie l’administration et améliore la supervision globale des bases de données. Les fonctionnalités basées sur l’IA, alimentées par le modèle de langage Gemini, comprennent la génération SQL assistée par l’IA et des outils sophistiqués de gestion de bases de données. Ces outils facilitent les tâches de migration et de gestion, rendant les opérations complexes sur les bases de données plus intuitives et moins sujettes aux erreurs. Les capacités de Gemini s’étendent également au service de migration des bases de données, améliorant le service en permettant des comparaisons de code côte à côte et des explications détaillées pendant les migrations.

Initiatives en matière de logiciels libres

L’engagement de Google à encourager l’innovation dans le domaine de l’IA générative s’étend à son soutien aux initiatives open source. La société a lancé trois projets open source clés : MaxDiffusion, JetStream et Optimum-TPU. Ces projets visent à accroître l’accessibilité et le développement des technologies d’IA générative. En outre, dans le cadre du projet MaxText, Google a introduit de nouveaux modèles LLM, notamment Gemma, GPT-3, Llama 2 et Mistral. Ces modèles, conçus pour fonctionner efficacement à la fois sur les TPU de Google Cloud et les GPU de Nvidia, offrent aux développeurs une flexibilité et des performances élevées dans le déploiement de modèles d’IA.

Extra à emporter

Google continue de faire progresser l’intégration de l’IA pour affiner les interfaces utilisateur dans l’ensemble de ses services cloud, en visant plus d’intuitivité et de réactivité. Ces améliorations sont conçues pour répondre à l’évolution des attentes des utilisateurs et rationaliser les interactions avec les technologies cloud, afin d’offrir une expérience utilisateur plus attrayante et plus efficace.

Google a clairement mis l’accent sur la durabilité au sein de son infrastructure cloud en intégrant des technologies et des pratiques économes en énergie. Ces initiatives visent à minimiser l’impact environnemental des opérations d’IA à grande échelle, en s’alignant sur les objectifs plus larges de réduction de l’empreinte carbone de l’industrie technologique et de promotion du développement durable.

Alexander Procter

mai 10, 2024

7 Min

Experts Okoone
PARLONS-EN !

Un projet en tête ?
Planifiez un appel de 30 minutes avec nous.

Des experts senior pour vous aider à avancer plus vite : produit, tech, cloud & IA.

Veuillez saisir une adresse email professionnelle valide.