ChatGPT in het Nederlands
ChatGPT Nederland Community

OpenAI’s GPT-5 faalt in programmeertesten, terugkeer naar GPT-4o noodzakelijk

GPT-5 faalt in codetests en laat gebruikers terugverlangen naar GPT-4o. Ondanks de hype blijkt de nieuwste AI van OpenAI minder betrouwbaar in programmeertaken en roept het kritiek op van gebruikers.
OpenAI's GPT-5 faalt in programmeertesten, terugkeer naar GPT-4o noodzakelijk

De introductie van GPT-5 door OpenAI heeft geleid tot veel discussie binnen de techgemeenschap, vooral vanwege de prestaties op het gebied van programmeren. Hoewel de nieuwste versie van de taalmodelreeks veel verwachtingen met zich meebracht, lijkt de praktijk soms tegen te vallen. GPT-5, dat wordt aangekondigd als opvolger van het alom geprezen GPT-4o, heeft gemengde resultaten laten zien bij tests die speciaal zijn ontworpen om de programmeervaardigheden van AI-modellen te evalueren.

Een van de belangrijkste tests die GPT-5 moest doorstaan, was het schrijven van een WordPress-plugin. Dit soort tests zijn cruciaal, omdat ze laten zien hoe goed een AI-model kan omgaan met praktische programmeertaken die ontwikkelaars dagelijks uitvoeren. In eerdere versies, zoals GPT-3.5 en GPT-4o, slaagde het model er meestal in om deze taak zonder problemen uit te voeren. GPT-5 daarentegen faalde in eerste instantie en leverde een niet-functionerende plugin op. Pas na het verstrekken van meer specifieke instructies, slaagde het model erin om de plugin correct te genereren.

Bij een andere test, waarin GPT-5 werd gevraagd een string-functie te herschrijven om dollars en centen beter te controleren, voldeed het model aan de verwachtingen. Het leverde een functionele oplossing zonder onnodige toevoegingen, wat aantoont dat het model in staat is om specifieke taken uit te voeren wanneer de opdrachten duidelijk zijn.

Toch waren er ook aanzienlijke tekortkomingen. Een test gericht op het identificeren van een bug in een WordPress-omgeving, die een diepgaande kennis van het platform vereist, werd succesvol doorstaan door GPT-5. Echter, bij het schrijven van scripts die gebruikmaken van minder bekende tools zoals Keyboard Maestro, faalde het model. Het toonde een gebrek aan begrip van de nuances van AppleScript, wat leidde tot fouten in de gegenereerde code.

Deze gemengde prestaties hebben geleid tot kritiek vanuit de gebruikersgemeenschap, vooral omdat OpenAI aanvankelijk geen gemakkelijke manier bood om terug te schakelen naar de eerdere versie GPT-4o, die voor velen betrouwbaarder bleek in programmeertaken. Deze beslissing werd snel herzien na een golf van negatieve reacties online, en gebruikers kregen de optie om terug te keren naar de oudere versie indien gewenst.

De introductie van GPT-5 toont aan dat, hoewel de technologie zich blijft ontwikkelen, er nog steeds uitdagingen zijn op het gebied van nauwkeurigheid en betrouwbaarheid bij het automatiseren van programmeertaken. Het is duidelijk dat gebruikers, vooral diegenen die afhankelijk zijn van AI voor complexe programmeerprojecten, zorgvuldig moeten evalueren welke versie van het model het beste aan hun behoeften voldoet.

De toekomst van GPT-5 en zijn opvolgers hangt af van de mate waarin OpenAI in staat is om deze kinderziektes op te lossen en de functionaliteit van hun modellen verder te verbeteren. Voor nu lijkt het erop dat veel gebruikers teruggrijpen naar GPT-4o voor betrouwbare programmeeroutput, terwijl ze de verdere ontwikkelingen van GPT-5 met belangstelling volgen.

De vraag blijft of toekomstige updates van GPT-5 de huidige tekortkomingen zullen aanpakken en of het in staat zal zijn om het niveau van betrouwbaarheid en nauwkeurigheid te bieden dat nodig is voor breed gebruik in programmeeromgevingen. Tot die tijd blijven de oudere modellen een waardevol hulpmiddel voor ontwikkelaars die op zoek zijn naar geautomatiseerde ondersteuning bij hun programmeerwerk.