Apple présente de nouvelles recherches sur l’intelligence artificielle
Le directeur de l’intelligence et des responsabilités d’Apple, Jeffrey P. Bigham, a récemment dévoilé une série de travaux académiques visant à améliorer les capacités de personnalisation des systèmes d’intelligence artificielle (IA). Ces publications mettent particulièrement en lumière les méthodes d’évaluation des modèles linguistiques ainsi que la compréhension des erreurs dans leurs résultats.

Une référence novatrice pour évaluer l’IA
L’un des articles phares d’Apple introduit la référence massive de compréhension de l’agent multitâche (MMAU), un système qui permet d’évaluer différents modèles de langage sur « cinq capacités essentielles » :
- Compréhension
- Raisonnement
- Planification
- Résolution de problèmes
- Auto-correction
Cette méthode repose sur 20 tâches soigneusement conçues regroupant plus de 3 000 invites distinctes. Selon Apple, le MMAU met non seulement en lumière les forces et faiblesses des agents LLM, mais elle facilite également l’interprétabilité de leurs performances. La société souligne qu’il est crucial d’améliorer ces outils afin d’éviter que « les méthodes d’évaluation existantes brouillent les distinctions entre les différents types d’échecs ».
Personnalisation accrue grâce aux conversations
Dans un autre aspect clé, Apple examine comment améliorer la personnalisation des IA. La firme reproche aux modèles actuels leur incapacité à se souvenir efficacement des échanges précédents avec les utilisateurs. Pour y remédier, elle propose un nouveau système capable d’extraire « les paires questions-réponses » issues des conversations passées afin “d’injecter des connaissances” dans le modèle.
Validation externe pour une meilleure qualité répondante
En ce qui concerne la validité externe des réponses fournies par les LLM, Apple constate que celles-ci peuvent varier considérablement selon la façon dont une question est formulée. Dans cette optique, son article intitulé « Les outils de validation externes peuvent-ils améliorer la qualité de l’annotation pour LLM-AS-A-JUDUS ? » envisage une amélioration potentielle via « des outils basés sur la recherche Web et l’exécution du code ». Toutefois, cela n’a pas toujours produit des résultats probants durant leurs études.
Engagement continu lors d’événements scientifiques
Outre ses publications écrites, Apple a diffusé huit vidéos enregistrées durant son atelier consacré à l’apprentissage automatique centré sur l’humain en 2024, abordant divers sujets comme les interfaces IA ou encore la compréhension utilisateur. Par ailleurs, du 27 juillet 2025 au 1er août, Apple participera activement à l’Association annuelle de linguistique informatique (ACL) à Vienne où elle présentera ses dernières recherches tout en soutenant dix-huit ateliers liés à ses nouveaux articles.
Ces initiatives soulignent le positionnement stratégique d’Apple dans le domaine dynamique et compétitif de l’intelligence artificielle alors que celle-ci continue à évoluer rapidement au sein du paysage technologique actuel.