OpenAI a présenté GPT-6 Astra, un nouveau modèle offrant moins de visibilité directe sur la façon dont il « pense », une évolution qui suscite des inquiétudes en matière de sécurité, quelques semaines après l’incident de piratage visant Hugging Face et ayant nécessité l’intervention d’un modèle open chinois pour enquêter, selon des analystes.
Lors de l’annonce jeudi, OpenAI a décrit Astra comme « le modèle le plus intelligent et le mieux aligné au monde », annonçant un « bond significatif des capacités cyber ». À la fin d’une conférence de presse consacrée au lancement, Greg Brockman, président d’OpenAI, a déclaré que le modèle représentait probablement l’AGI, soit une intelligence artificielle qui égalerait ou dépasserait l’intelligence humaine.
OpenAI a toutefois reconnu que le raisonnement écrit du modèle était « plus difficile à surveiller » que celui de GPT-5.6 Sol, la génération précédente sortie en juillet. « We have found that GPT-6 Astra is more capable of controlling its own CoT (chain of thought) than GPT-5.6 Sol, and less likely to include incriminating information in its CoT, » a indiqué OpenAI, en référence aux étapes intermédiaires de raisonnement qu’une IA produit pour résoudre une tâche.
Pourquoi GPT-6 Astra offre moins de visibilité
Un article paru mardi, avant le lancement, explique que cette perte de visibilité provient d’une technique appelée recurrent depth (ou looped transformers), qui réutilise des parties d’un réseau neuronal. En conséquence, le modèle traiterait des logiques complexes à l’intérieur de boucles mathématiques internes plutôt que sous forme de texte séquentiel lisible pas à pas.

