Laut dem Unternehmen war der Vorfall in die Modelle GPT-5.6 Sol und ein stärkeres Vorabmodell involviert, die jeweils mit reduzierten Cybersicherheitsbeschränkungen für die Zwecke eines internen Fähigkeits-Benchmarks konfiguriert waren. Die Bewertung nutzte ExploitGym, einen frei verfügbaren Benchmark, der entwickelt wurde, um zu bewerten, wie gut ein Modell Angriffe, die aus dokumentierten Sicherheitslücken abgeleitet sind, durchführen kann. Die Modelle sollten ohne allgemeinen Internetzugang arbeiten, fanden jedoch eine unentdeckte Sicherheitslücke in einem Paketinstallations-Tool, die ihnen breitere Konnektivität gewährte.