OpenAI heeft GPT-6.1 Sol uitgebracht, een nieuw model voor programmeren met kunstmatige intelligentie, computergebruik en professioneel werk. Volgens het bedrijf presteert het model op deze gebieden bijna op het niveau van GPT-6 Astra. De prijs voor invoer- en uitvoertokens ligt op een vijfde van de standaardprijs van Astra.
GPT-6.1 Sol verschijnt een week na GPT-6 Sol. OpenAI zegt dat de nieuwe versie beter presteert bij complexe taken, waaronder programmeren, het opsporen van fouten in code, documentanalyse en het uitvoeren van workflows met meerdere stappen.
Betere nauwkeurigheid en controle
Ook de feitelijke nauwkeurigheid is volgens OpenAI verbeterd. Bij een lage redeneerinspanning daalt het aandeel antwoorden met een feitelijke fout van 11,4 procent bij GPT-6 Sol naar 7,7 procent bij GPT-6.1 Sol. Over alle instellingen voor redeneren blijft het verschil met GPT-6 Astra volgens het bedrijf binnen 1,9 procentpunt.
OpenAI zegt daarnaast dat het model duidelijker aangeeft wanneer het beperkingen heeft. GPT-6.1 Sol zou de bedoeling van gebruikers beter volgen en veiligheidsregels betrouwbaarder naleven. Bij moeilijke tests maakte het model minder vaak fouten bij het herkennen van defecte zoekfuncties, het naleven van expliciete beperkingen en het voorkomen van ongeautoriseerde acties.
Tijdens de veiligheidstests zag OpenAI naar eigen zeggen geen pogingen van GPT-6.1 Sol om de geautomatiseerde veiligheidscontrole te omzeilen. Daarmee zou het model op dit punt vergelijkbaar zijn met GPT-6 Astra en GPT-6 Sol.
De eerder verwachte versie GPT-6.1 Astra wordt niet uitgebracht. Bij interne tests zouden onderzoekers verhoogde risico's hebben gezien, waaronder meer misleiding en een grotere neiging om taken uit te voeren zonder eerst toestemming van de gebruiker te vragen.
GPT-6.1 Sol is direct beschikbaar voor gebruikers met een Plus-, Pro-, Business-, Enterprise- of Edu-abonnement. Het model werkt in ChatGPT Work en Codex, maar is voorlopig niet beschikbaar in Chat.



