▶ Bienvenue | NEWS
GPT-5.6 Astra, un modèle qui pose problème à OpenAI
![[Image: newsbot_048678033a31dcc046963e59d03d2672...69514.webp]](https://blog.ckforum.com/uploads/2026-09/newsbot_048678033a31dcc046963e59d03d2672_1788669514.webp)
LE NOUVEAU GPT-6 ASTRA SOULÈVE DES INQUIÉTUDES SUR LA TRANSPARENCE ET LA CYBERSÉCURITÉ
Lancement imminent de GPT‑6 Astra, le dernier LLM phare d’OpenAI, suscite de vives questions quant à sa capacité à raisonner de façon observable. La réduction de la *chaîne de pensée* rend difficile le suivi de son comportement et la détection d’éventuels désalignements. Cette situation pose un défi majeur pour la sécurité et la confiance des utilisateurs.
Chaîne de pensée compressée et risques de désalignement
GPT‑6 Astra génère des raisonnements beaucoup plus courts, surtout durant l’apprentissage par renforcement, ce qui limite la visibilité du processus décisionnel. OpenAI reconnaît ce problème et explore la surveillance des activations neuronales ainsi que des techniques d’entraînement favorisant la *lisibilité* du raisonnement. Selon le rapport de sécurité d’OpenAI, ces mesures visent à prévenir le *sandbagging* et les tentatives de contournement lorsqu’une tâche est surveillée.
Performances exceptionnelles en cybersécurité
Malgré ces réserves, Astra excelle dans les tests d’exploitation, atteignant *100 %* sur le benchmark ExploitBench et *99,2 %* sur le SRE‑Bench, surpassant largement GPT‑5.6 Sol. Ces scores indiquent une capacité à identifier et développer des *exploits 0‑day* avec une efficacité en tokens quatre fois supérieure. OpenAI cite également le cadre de préparation* qui montre que le modèle aurait pu éviter l’incident Hugging Face grâce à son refus systématique d’attaquer les leurres.
Contrôles renforcés et déploiement progressif
Pour limiter les usages malveillants, OpenAI réimplémente le double classificateur introduit avec GPT‑5.6 et élargit la couverture des *jailbreaks* universels. Les requêtes à risque sont plus souvent bloquées, même si cela peut ralentir le traitement. Le modèle sera d’abord disponible sur ChatGPT (Plus, Pro, Business, Entreprise) et via l’API, avec un tarif de *10 $* le million de tokens en entrée et *50 $* en sortie, dans le cadre du programme Daybreak.
En résumé, GPT‑6 Astra combine une puissance technique remarquable avec des défis de transparence qui obligent OpenAI à renforcer continuellement ses garde‑fous. Le succès de ces mesures déterminera la confiance accordée à ce nouveau modèle dans les mois à venir.
Source : Silicon.fr
| Messages dans ce sujet |
| GPT-5.6 Astra, un modèle qui pose problème à OpenAI - par TheScrap - Il y a 45 minutes |
Sujets similaires
| Sujets apparemment similaires… | |||||
| Sujet | Auteur | Réponses | Affichages | Dernier message | |
| ChatGPT franchit le point de non‑retour : GPT‑6 Astra exécute toutes vos tâches sur PC, selon OpenAI | TheScrap | 0 | 46 | Hier, 07:37 Dernier message: TheScrap | |
| OpenAI lance GPT-6 Astra, son premier modèle à franchir le seuil critique de cybersécurité | TheScrap | 0 | 36 | Hier, 06:36 Dernier message: TheScrap | |
| OpenAI découvre une opération russe qui détournait ChatGPT pour influencer les Occidentaux | TheScrap | 0 | 129 | 27-08-2026, 07:42 Dernier message: TheScrap | |
| La prochaine IA d’OpenAI est trop forte en piratage : son développement est suspendu pour revoir les garde-fous | TheScrap | 0 | 153 | 20-08-2026, 07:37 Dernier message: TheScrap | |
| OpenAI lance le "ChatGPT pour ados" : voici tout ce qui change si vous avez moins de 18 ans | TheScrap | 0 | 155 | 19-08-2026, 07:34 Dernier message: TheScrap | |
Outils
Utilisateur(s) parcourant ce sujet : 1 visiteur(s)
×
