Nul verkeerd ingedeeld
De code noemde nul een negatief getal. ChatGPT vond de fout. Een nieuwe test bevestigde het probleem; Codex repareerde het en kreeg daarna akkoord.
Kan Codex code aanpassen, ChatGPT die laten controleren en de feedback zelf verwerken? In deze kleine, afgebakende proef werkte de hele lus.
Codex doet het programmeerwerk. Een gewone ChatGPT-chat beoordeelt de code via de GitHub-koppeling en schrijft feedback bij het wijzigingsvoorstel. Codex leest die feedback, controleert de bevindingen en past de code aan. Daarna volgt een nieuwe beoordeling.
Drie kleine Python-proeven
De code noemde nul een negatief getal. ChatGPT vond de fout. Een nieuwe test bevestigde het probleem; Codex repareerde het en kreeg daarna akkoord.
De code gaf een uitkomst waar een foutmelding nodig was. ChatGPT signaleerde dit. Codex voegde een test toe, herstelde de code en liet die opnieuw beoordelen.
De even/oneven-functie was al correct. ChatGPT keurde die goed. Twee extra controles in verse chats gaven ook akkoord op dezelfde codeversie.
De samenwerking werkt bij deze kleine tests: feedback ophalen, fouten herstellen en opnieuw laten controleren lukte. Dat is een geslaagde proef van het proces, geen garantie dat grotere projecten automatisch foutloos worden. De controller en browser zelf draaiden bovendien niet volledig geïsoleerd.
Het volledige verslag
Download het volledige testverslag met de bevindingen, reviewverwijzingen, codeversies en veiligheidsgrenzen.
Download testverslag · Markdown (.md)Het verslag is openbaar te downloaden. Voor sommige bronlinks is toegang tot de private repository of de oorspronkelijke chat nodig.