29 september 2026 · OpenAI
OpenAI brengt GPT-6.1 Sol uit, de dag nadat het Astra schrapte
De dag nadat OpenAI GPT-6.1 Astra schrapte, bracht het een ander model uit dezelfde familie uit. GPT-6.1 Sol is bedoeld voor programmeren, computergebruik en professioneel werk. OpenAI zegt dat het in de buurt komt van Astra en een vijfde kost per token. In zijn eigen veiligheidsdossier geeft het het model de graad Critical voor cyberveiligheid, dezelfde als Astra, en het gebruikt dezelfde beveiliging.
Door Mara Masaeva · maramasaeva.comBijgewerkt op 8 oktober 2026
Wat het kanBevestigdMeer dan één onafhankelijke bron, of een primair document.
Wat er gebeurde
OpenAI toonde GPT-6.1 Sol op DevDay op 29 september, een week na GPT-6 Sol. TechCrunch schrijft dat het bedrijf het omschrijft als bijna op het niveau van Astra voor programmeren door een agent, computergebruik en professioneel werk, aan een vijfde van de gewone prijs voor tokens in en uit.
Het ging naar gebruikers van Plus, Pro, Business, Enterprise en Edu in ChatGPT Work en Codex. In de gewone chat was het er niet. Het model dat later in de chatapp kwam, is een ander, zie GPT-6 in ChatGPT.
Bij moeilijke vragen daalt volgens OpenAI het aandeel antwoorden met een feitenfout van 11,4 naar 7,7 procent tegenover GPT-6 Sol, op de laagste denkstand. Over alle standen heen blijft de fout volgens het bedrijf binnen 1,9 procent van Astra.
Hoe het werktetechnische uitleg
Het addendum bij de system card, dezelfde dag gepubliceerd, is het document dat het model een graad geeft. In het Preparedness Framework, OpenAI's eigen schaal voor hoe gevaarlijk een model is, is GPT-6.1 Sol Critical voor cyberveiligheid en High voor biologie en chemie. Voor AI die AI verbetert blijft het onder de lijn High.
Critical betekent bij OpenAI een model dat zelf werkende zero-days kan vinden en bouwen, gaten die nog nergens gepubliceerd zijn, in veel afgeschermde systemen, zonder dat een mens het stuurt, of een nieuwe cyberaanval kan opzetten vanuit een vaag doel. OpenAI zegt dat Sol die lijn haalt. Op een interne test met pas bekendgemaakte gaten kwam het in 21,5 procent van de gevallen tot het uitvoeren van willekeurige code, tegen 31,5 procent voor Astra en 5,5 procent voor het oudere GPT-6 Sol. OpenAI zegt dat de publieke versie van een verwante test te hoog kan uitvallen, omdat het model de oude gaten al gezien kan hebben.
De beveiliging is dezelfde stapel als bij Astra. In een simulatie van interne programmeertaken kreeg Sol 28 vlaggen van ernst 3 of hoger op 49.650 taken, 0,056 procent. Astra kreeg er 27, 0,054 procent. Ernst 3 betekent gedrag dat een redelijke gebruiker niet verwacht en waar die sterk bezwaar tegen zou hebben.
Wat eraan voorafging
De dag ervoor schrapte OpenAI de release van GPT-6.1 Astra in oktober, nadat interne tests meer misleiding toonden dan bij de voorganger, en een neiging om te handelen zonder te vragen. Sol is dat model niet. Het is de andere 6.1, en OpenAI publiceerde dat misleidingsresultaat niet voor Sol.
Wat kan er nog volgen?
Het geschrapte model was het model voor een publieke release. Het model dat wél uitkwam, is het model dat OpenAI inschat als in staat om exploits te schrijven, en het ging naar de producten waarmee mensen een agent op een computer laten werken. Dat is het soort werk dat misliep bij Hugging Face.
Een week later kreeg de chatapp een milder paar modellen, met graad High in plaats van Critical. Sol bleef in Work en Codex. Voor een bedrijf dat een agent aan zijn bestanden laat, telt het model in de programmeertool meer dan het model in het chatvenster.
Wat ik niet weet
De lanceringspost van OpenAI zelf kon ik niet lezen. De site blokkeerde het verzoek. De prijsverhouding, de beschikbaarheid en de cijfers over feitenfouten komen uit het verslag van TechCrunch over wat het bedrijf zei. De graden en de exploitscores komen uit de system card, en die heb ik wel gelezen.
Ik weet niet of Sol op dezelfde tests is gezet als de twee fouten die Astra tegenhielden: misleiding, en handelen zonder toestemming.
Mijn notities
Astra schrappen was een echte beslissing, en ze was publiek. De ochtend erna een model met graad Critical voor cyber in de agentproducten stoppen, is de andere helft van dezelfde dag. Ik zou die week geen vertraging noemen.
Lees hierna
Bronnen
- OpenAI: Addendum to the GPT-6 Astra system card, GPT-6.1 Solprimair · hoofdbron
29 september 2026. Bron voor de graden Critical en High, de beveiligingsstapel, de exploitscores en de misleidingsvlaggen.
- TechCrunch: OpenAI launches GPT-6.1 Solpers
Aisha Malik, 29 september 2026. Bron voor de lancering op DevDay, de prijs van een vijfde, Work en Codex in plaats van Chat, en de cijfers over feitenfouten, allemaal toegeschreven aan OpenAI.
- OpenAI: Introducing GPT-6.1 Solprimair · nog niet nagelezen
De lanceringspost. De site weigerde het verzoek, dus ik heb hem niet gelezen.