ChatGPT reçoit des améliorations en août : GPT-5.6 apporte à tous la robustesse et la sécurité

OpenAI ChatGPT
Photo: OpenAI ChatGPT - Photo: One Artist / Shutterstock.com

OpenAI publie une série de mises à jour de ChatGPT en août, introduisant des modèles plus puissants et élargissant l’accès aux fonctionnalités avancées. Les utilisateurs des versions Free and Go utiliseront désormais un nouveau modèle standard pour leurs interactions quotidiennes. Ceux qui s’abonnent aux forfaits Plus et Pro auront accès à une version améliorée de GPT-5.6 Sol, qui comprend un curseur pour ajuster le niveau d’effort de ChatGPT lors de la génération de réponses. Ces nouveaux modèles remplacent GPT-5.5 Instant, marquant une avancée significative dans l’expérience utilisateur.

La société a souligné que les versions d’août de GPT-5.6 Sol et GPT-5.6 Luna sont considérées comme à haute capacité en termes de cybersécurité et de reconnaissance biologique et chimique, selon son cadre de préparation. Cependant, aucune des deux versions n’a atteint le seuil de grande capacité d’auto-amélioration de l’IA. L’évaluation de la sécurité des modèles est effectuée avec leurs paramètres les plus élémentaires, tels que le mode instantané, pour capturer les performances dans la plupart des utilisations, tandis que les capacités sont testées avec leur effort de raisonnement maximal.

Pour la première fois, OpenAI a inclus des évaluations spécifiques pour les utilisateurs de moins de 18 ans. Ces analyses ont été développées pour mesurer le comportement des modèles par rapport aux normes de sécurité créées spécialement pour les adolescents, démontrant un effort continu pour rendre ChatGPT plus sûr pour cette tranche d’âge.

Détails sur les modèles et le processus de formation

Les modèles GPT-5.6 Sol et GPT-5.6 Luna, comme d’autres développés par OpenAI, ont été formés sur de vastes ensembles de données. Cela comprend les informations accessibles au public sur Internet, les données obtenues grâce à des partenariats avec des tiers et les informations fournies ou générées par les utilisateurs, les formateurs et les chercheurs. L’entreprise utilise un processus rigoureux de filtrage des données pour garantir la qualité et réduire les risques possibles. Les classificateurs de sécurité sont utilisés pour prévenir ou atténuer la présence de contenus sensibles ou préjudiciables, tels que des contenus sexuellement explicites impliquant des mineurs.

OpenAI souligne que les valeurs de comparaison des modèles publiés précédemment peuvent présenter de légères variations par rapport aux valeurs initialement publiées, car elles font référence aux versions les plus récentes de ces modèles. L’entreprise rappelle que l’utilisation de GPT-5.6 doit être conforme à ses politiques d’utilisation, conditions de service et conditions d’utilisation, qui garantissent une utilisation responsable de la technologie de l’intelligence artificielle.

Évaluations de sécurité sur les contenus interdits

Pour garantir le respect de ses politiques, OpenAI effectue une analyse comparative de plusieurs catégories de contenus interdits. L’entreprise utilise Production Benchmarks, un ensemble d’analyses qui incluent des conversations difficiles tirées de données d’utilisation réelles. Ces critères sont conçus pour être difficiles et aident à mesurer les progrès, en particulier là où les évaluations standards ont déjà montré des niveaux de performance élevés. Les taux d’erreur observés dans ces évaluations ne reflètent pas le trafic de production moyen, mais plutôt un test rigoureux du comportement du modèle sans garanties au niveau du système.

En évaluant GPT-5.6 Sol par rapport à GPT-5.5 Instant June Update, les résultats montrent des performances similaires dans toutes les catégories interdites, à l’exception du contenu violent et sexuel, pour lequel il n’y avait pas de différence statistiquement significative. Pour GPT-5.6 Luna, les performances étaient également comparables, à l’exception du contenu violent. Concernant le contenu sexuel interdit, OpenAI a mis en œuvre des mesures d’atténuation supplémentaires au niveau du système pour empêcher le matériel érotique explicite d’atteindre les utilisateurs en production. Pour les moins de 18 ans, des protections supplémentaires adaptées à l’âge ont été appliquées, limitant davantage le contenu sexuel et l’exposition à du matériel graphique violent.

Logo ChatGPT
Logo ChatGPT – Markus Mainka/ Shutterstock.com

Protections et limites pour les utilisateurs de moins de 18 ans

Les systèmes d’intelligence artificielle peuvent offrir de grands avantages aux adolescents, en les aidant à apprendre, créer, résoudre des problèmes et développer de nouvelles compétences. OpenAI conçoit soigneusement ses systèmes pour maximiser ces avantages, tout en atténuant les dommages potentiels qui pourraient affecter de manière disproportionnée ou plus grave les utilisateurs de moins de 18 ans. Les principes et exigences qui guident le comportement des modèles sont définis dans les spécifications du modèle.

Pour les adolescents, des dispositions spécifiques à l’âge sont mises en œuvre dans les politiques de sécurité, établissant des limites plus restrictives que celles appliquées aux adultes dans des domaines tels que le contenu sexuel, la dépendance émotionnelle, les troubles de l’alimentation et l’accès à des biens/services soumis à une limite d’âge. Le modèle est formé pour éviter les jeux de rôle romantiques, encourager les défis liés à l’âge ou se positionner comme un substitut aux relations réelles. De plus, lorsqu’il identifie des signes indiquant qu’un adolescent pourrait avoir besoin de soutien, le système est conçu pour renforcer des limites saines et encourager les liens avec des adultes de confiance, comme les parents ou les enseignants. Les mesures de sécurité au niveau du système ajoutent une couche supplémentaire, limitant l’accès au contenu sensible, encourageant les pauses d’utilisation prolongées et fournissant des outils de gestion aux parents. Moins de 18 examens spécifiques démontrent de solides performances de GPT-5.6 Sol e Luna, y compris des améliorations concernant les produits/services soumis à une limite d’âge et le contenu sexuel.

Capacités et évaluations de vision du modèle

OpenAI effectue également des évaluations d’entrée d’image pour mesurer la sortie « not_unsafe » du modèle, en tenant compte des combinaisons de texte et d’image non autorisées. Les résultats montrent que les performances du GPT-5.6 Sol dans les évaluations de la vision sont équivalentes à celles du GPT-5.5-Instant. GPT-5.6 Luna, à son tour, a montré une légère régression dans l’évaluation de l’extrémisme, avec une faible signification statistique, indiquant que la capacité globale reste robuste.

Tests de santé mentale avec simulations utilisateur

Pour une analyse plus approfondie, la société a introduit des évaluations dynamiques multi-interactions pour la santé mentale, la dépendance émotionnelle et l’automutilation. Contrairement aux tests statiques, ces simulations permettent aux conversations d’évoluer en réponse aux résultats du modèle, créant ainsi des trajectoires de test plus réalistes et plus rigoureuses. Cette approche permet d’identifier les problèmes potentiels pouvant survenir lors d’interactions prolongées, fournissant ainsi un test plus précis.

Les tests révèlent que le GPT-5.6 Sol est largement comparable à la mise à jour instantanée de juin du GPT-5.5 dans ces évaluations, bien qu’une régression statistiquement significative ait été observée dans l’évaluation de l’automutilation. Cependant, aucune augmentation des réactions indésirables en matière d’automutilation, de santé mentale et de dépendance émotionnelle n’a été enregistrée lors de l’expérimentation en ligne. La société continue de surveiller ces aspects après le lancement pour vérifier les résultats et enquêter sur les écarts potentiels entre les tests hors ligne et en ligne.

Améliorer la robustesse des modèles

La robustesse du modèle est testée contre les « jailbreaks », qui sont des stimuli contradictoires conçus pour contourner l’entraînement au refus du modèle et obtenir une assistance nuisible. Cette évaluation se concentre sur le déverrouillage direct du modèle, sans l’ensemble complet des garanties en production. C’est une couche de robustesse dans les mesures de sécurité. OpenAI utilise des stratégies d’attaque sophistiquées dérivées d’exercices d’intrusion internes, qui peuvent sonder, s’adapter et s’intensifier au cours d’une conversation. Malgré la variation attendue dans les scénarios de budget d’attaque élevé, les performances de GPT-5.6 Sol et GPT-5.6 Luna sont considérées comme comparables à celles de leurs récents prédécesseurs.

La résistance aux attaques par injection immédiate sur les connecteurs est également évaluée. Ces attaques insèrent des instructions malveillantes dans la sortie de l’outil pour tromper le modèle et écraser les instructions du système, du développeur ou de l’utilisateur. Des versions améliorées de ces attaques, axées sur la recherche et l’appel de fonctions, ont été incluses dans les tests. Les modèles GPT-5.6 Sol et GPT-5.6 Luna ont démontré des performances équivalentes aux modèles Instant précédents lors de ces évaluations.

Améliorations des performances en matière de santé

Les chatbots ont le potentiel de permettre aux gens de mieux comprendre leur santé. Par conséquent, les nouveaux modèles ont été évalués dans HealthBench, qui mesure les performances en matière de santé et de sécurité, et dans HealthBench Professional, axé sur des cas d’utilisation clinique. Pour éviter que des réponses plus longues, qui peuvent gonfler artificiellement les scores, ne nuisent à la convivialité et à la sécurité, les résultats sont ajustés à la longueur de réponse finale. Les réponses plus courtes reçoivent un ajustement positif, tandis que les réponses plus longues sont pénalisées.

La version GPT-5.6 Sol offre des améliorations par rapport à GPT-5.5 Instant dans toutes les catégories HealthBench, avec des gains substantiels dans HealthBench Professional et HealthBench Hard. Les réponses étaient plus courtes dans certaines catégories et légèrement plus longues dans d’autres, mais les scores ajustés et non ajustés se sont globalement améliorés. Le GPT-5.6 Luna a également montré des améliorations dans toutes les évaluations malgré sa petite taille. Ces améliorations devraient se traduire par un accès plus large à des informations fiables sur la santé pour tous les utilisateurs.

Hallucinations réduites et précision factuelle accrue

Pour évaluer la capacité des modèles à fournir des réponses factuellement correctes, OpenAI mesure le taux d’hallucinations factuelles dans des ensembles d’invites difficiles, sélectionnées pour représenter les scénarios dans lesquels le modèle est le plus susceptible d’halluciner. Ces évaluations sont conçues pour être difficiles et fournir un signal de recherche sensible au fil du temps, plutôt que de mesurer la prévalence globale dans la production ou l’expérience utilisateur moyenne. Les scénarios incluent des invites factuelles provenant de conversations ChatGPT, des plantages signalés par les utilisateurs dans les versions précédentes et des situations médicales, juridiques et financières à haut risque.

Les résultats indiquent que GPT-5.6 Sol et GPT-5.6 Luna présentent des améliorations substantielles en termes d’exactitude factuelle par rapport à GPT-5.5 Instant dans toutes les évaluations. GPT-5.6 Luna a réussi à réduire les taux d’erreurs factuelles de plus de 60 % sur les questions à enjeux élevés et d’environ 30 % sur les deux autres séries de questions. GPT-5.6 Sol a démontré des améliorations statistiquement significatives et plus cohérentes, réduisant les taux d’erreur factuelle d’environ 60 % dans les trois ensembles de questions. Cette amélioration vise à accroître la confiance des utilisateurs dans les informations fournies par les modèles.

Cadre de préparation et garanties

Le cadre de préparation OpenAI est son approche de surveillance et de préparation aux capacités de pointe qui pourraient présenter un risque de préjudice grave. Dans ce cadre, l’entreprise s’efforce d’atténuer ces risques en mettant en œuvre des mesures de protection qui minimisent suffisamment les dangers pour les modèles hautement performants. Les modèles GPT-5.6 Sol et GPT-5.6 Luna mis à jour garantissent les mêmes notes du cadre de préparation que les modèles GPT-5.6 précédemment publiés : élevé en sécurité biologique et chimique, élevé en cybersécurité et inférieur à élevé en auto-amélioration de l’IA.

Les évaluations de capacités représentent une limite inférieure des capacités potentielles, car des signaux supplémentaires, des réglages précis ou des interactions innovantes peuvent susciter des comportements allant au-delà de ce qui a été observé lors des tests. Dans les domaines biologique et chimique, la « haute capacité » se définit par l’aide significative que les modèles peuvent apporter aux acteurs « novices » dans la création de menaces sérieuses connues. Des tests en virologie et en connaissances tacites ont montré que les modèles mis à jour dépassaient les seuils d’experts dans certains domaines, tout en étant insuffisants dans d’autres, comme la capacité à dépanner les protocoles de laboratoire.

En cybersécurité, la « haute capacité » est définie par des modèles qui automatisent les cyberopérations de bout en bout contre des cibles raisonnablement protégées ou la découverte/exploitation de vulnérabilités. Les tests sur les défis Capture the Flag (CTF) et CVE-Bench ont montré que GPT-5.6 Sol et Luna ont dépassé le seuil de préparation élevé dans certains scénarios, Sol atteignant 97,06 % en CTF. Dans les simulations de cyber-portée, Sol a démontré plus de succès que Luna, les deux présentant des défis dans des scénarios spécifiques de haute complexité. Les évaluations d’auto-amélioration de l’IA n’ont pas été effectuées car le GPT-5.6 Sol était déjà en dessous du niveau de capacité élevé. Les garanties mises en œuvre visent à entraver et détecter les activités offensives interdites, tout en préservant les utilisations défensives et scientifiques légitimes des capacités biologiques et de cybersécurité, en renforçant la sécurité en ligne et hors ligne.

Voir Aussi Dernières Nouvelles (FR)

Les abonnements aux services Xbox deviennent moins chers après un changement de stratégie
Dernières Nouvelles (FR) • 13/08/2026

Les abonnements aux services Xbox deviennent moins chers après un changement de stratégie

Les propriétaires de PS5 bénéficient d’un accès permanent à deux titres majeurs dans la boutique virtuelle
Dernières Nouvelles (FR) • 13/08/2026

Les propriétaires de PS5 bénéficient d’un accès permanent à deux titres majeurs dans la boutique virtuelle

Epic Games Store propose 12 jeux de haut niveau disponibles gratuitement sur PC en 2026
Dernières Nouvelles (FR) • 13/08/2026

Epic Games Store propose 12 jeux de haut niveau disponibles gratuitement sur PC en 2026

Un adolescent tue sa mère et son frère après avoir utilisé l’IA pour créer des fantasmes sur le crime
Dernières Nouvelles (FR) • 13/08/2026

Un adolescent tue sa mère et son frère après avoir utilisé l’IA pour créer des fantasmes sur le crime

L’abonnement automobile est-il payant en 2026 ? Voir le comparatif avec l’achat
Dernières Nouvelles (FR) • 13/08/2026

L’abonnement automobile est-il payant en 2026 ? Voir le comparatif avec l’achat

La comète interstellaire 3I/ATLAS se déplace à 58 km/s et verra sa route modifiée par Jupiter
Dernières Nouvelles (FR) • 13/08/2026

La comète interstellaire 3I/ATLAS se déplace à 58 km/s et verra sa route modifiée par Jupiter

Toyota annonce le rappel mondial de 655 000 unités Camry en raison d’une défaillance du tableau de bord
Dernières Nouvelles (FR) • 13/08/2026

Toyota annonce le rappel mondial de 655 000 unités Camry en raison d’une défaillance du tableau de bord

Prichard Colón, ancien boxeur, décède à 33 ans après 11 ans de lutte contre une lésion cérébrale
Dernières Nouvelles (FR) • 13/08/2026

Prichard Colón, ancien boxeur, décède à 33 ans après 11 ans de lutte contre une lésion cérébrale

Bloquer un téléphone portable volé : étapes essentielles pour protéger vos données et suivre l’appareil
Dernières Nouvelles (FR) • 13/08/2026

Bloquer un téléphone portable volé : étapes essentielles pour protéger vos données et suivre l’appareil

Google présente la série Pixel 11 avec une puce Tensor G6 améliorée et un nouveau Pixel Tag
Dernières Nouvelles (FR) • 13/08/2026

Google présente la série Pixel 11 avec une puce Tensor G6 améliorée et un nouveau Pixel Tag

La charge lente des Galaxy Watch 9 et Ultra 2 oblige les utilisateurs à faire des astuces comme un ventilateur et de la glace
Dernières Nouvelles (FR) • 13/08/2026

La charge lente des Galaxy Watch 9 et Ultra 2 oblige les utilisateurs à faire des astuces comme un ventilateur et de la glace

L’arrivée inattendue d’Everspace 2 : Galactic Edition renforce le catalogue Nintendo Switch 2
Dernières Nouvelles (FR) • 13/08/2026

L’arrivée inattendue d’Everspace 2 : Galactic Edition renforce le catalogue Nintendo Switch 2

Le télescope Webb de la NASA découvre une nouvelle planète géante grâce à une méthode innovante
Dernières Nouvelles (FR) • 13/08/2026

Le télescope Webb de la NASA découvre une nouvelle planète géante grâce à une méthode innovante

POCO X8 approche du lancement avec une batterie de 9 000 mAh et un écran haute résolution
Dernières Nouvelles (FR) • 13/08/2026

POCO X8 approche du lancement avec une batterie de 9 000 mAh et un écran haute résolution

La fusée SpaceX entre en collision avec la Lune lors d’un événement surveillé par la NASA, ce qui élimine les risques pour la Terre
Dernières Nouvelles (FR) • 13/08/2026

La fusée SpaceX entre en collision avec la Lune lors d’un événement surveillé par la NASA, ce qui élimine les risques pour la Terre