Le monde devra attendre encore un peu avant de pouvoir assister au lancement du modèle d’intelligence artificielle le furthermore complexe de Google à ce jour.
Gemini a été décrit comme la prochaine génération d’IA et multimodale, ce qui signifie qu’il peut traiter plusieurs types de données et aurait la capacité de comprendre et de générer du texte et des photographs ainsi que d’autres styles de contenu – comme des web-sites World wide web – sur la base d’un croquis ou d’un dessin. description écrite.

The Info, citant deux sources anonymes au courant de la décision, a rapporté que des événements de lancement inopinés – initialement prévus la semaine prochaine à New York, Washington et en Californie – ont été discrètement reprogrammés au début de 2024, craignant que l’IA ne soit pas possible. de manière fiable et à la hauteur lorsqu’il répond à certaines invites et demandes de renseignements dans une langue autre que l’anglais.
Bien qu’il n’ait pas encore été rendu public, Gemini surpasse largement le GPT-4 d’OpenAI car or truck il exploite beaucoup moreover de puissance de calcul que son concurrent.
Sissie Hsiao, vice-présidente de Google et responsable de Bard et de Google Assistant, a déclaré à propos de Gemini : « J’essaie de faire un gâteau, dessine-moi 3 photos de les étapes à suivre pour glacer un gâteau à trois étages, et Gemini créera réellement ces illustrations or photos.
Hsiao a ajouté : « Ce sont des images complètement nouvelles. Ce ne sont pas des images provenant d’Internet. Il est désormais capable de parler en photographs avec les humains, pas seulement en texte. »
Bien que Google dispose déjà de son propre modèle d’IA générative appelé Bard, ChatGPT a jusqu’à présent bénéficié d’une as well as grande sensibilisation des consommateurs – mais les analystes affirment que cela pourrait changer lorsque Gemini sera finalement lancé.