Les nouveaux modèles d’OpenAI plus enclins aux hallucinations
OpenAI fait face à un défi inattendu avec ses récents modèles o3 et o4-mini. Malgré leurs capacités de raisonnement avancées, ces intelligences artificielles présentent une propension accrue aux hallucinations, générant des informations inexactes ou non fondées.
Des performances paradoxales
Les nouveaux modèles affichent des scores impressionnants sur certains tests cognitifs, notamment sur l’ARC-AGI où o3 atteint 87,5% de réussite. Cependant, cette amélioration des capacités de raisonnement s’accompagne d’effets secondaires inattendus. Les chercheurs constatent une augmentation significative des réponses erronées ou fantaisistes, un phénomène que même les équipes d’OpenAI peinent à expliquer.
Des outils plus lents mais plus complexes
Les modèles o3 et o4-mini se distinguent par leur approche du traitement de l’information. Ils prennent davantage de temps pour analyser et répondre, intégrant des capacités multiples comme l’analyse d’images, la recherche web et le codage. Cette complexité accrue pourrait être liée à l’augmentation des hallucinations, soulevant des interrogations sur l’équilibre entre performance et fiabilité.
Ces observations remettent en question la stratégie de développement des modèles de langage. Alors qu’OpenAI visait une amélioration générale des performances, l’apparition de ces nouveaux défis témoigne de la complexité inhérente au développement des intelligences artificielles avancées.